人工智能
新能源汽车
智能家居
机器人
云计算
大数据
VR/AR
芯片
元宇宙
智能穿戴
物联网
生物医药
网络安全
硬件
新能源
AI导航
AI工具库
AI应用集
AI快讯
AI热点
最新文章
最近使用
清空
暂无历史
首页
•
标签云
•
视觉
标签:视觉
关注
谷歌Gemini卷土重来!多模态能力与GPT-4V齐名|港中文128页全面测评报告
再见,汤晓鸥:致敬一代文坛巨匠
商汤创始人汤晓鸥逝世,享年55岁,世人缅怀
中国计算机视觉领军者、商汤创始人汤晓鸥不幸离世
斯坦福华人提出LLM生成无限延伸的3D动画生成框架,一句话一幅图创造无限3D世界
GPT-4V作为机器人大脑,你可能都不需要AI进行规划
厦大等发布「视觉感知基础模型」APE,涵盖160个SOTA参数
梅卡曼德联合创始人付翱:AI与3D技术共同引领智能制造新时代|甲子引力
首个全方位精通3D任务的拟人智能体:具备感知、推理、规划和行动能力
字节月底推出生成式AI开发平台;马斯克旗下Grok将在一周左右向X订阅用户开放;王慧文投资大型AI创企丨AIGC大事日报
资深学者共同研发的纯CV大模型在UC伯克利呈现通用视觉推理突破
何恺明、谢赛宁回归学界,R-CNN创始人Ross Girshick离开,Meta CV迎来了多少大神
哈工深发布多模态大模型「九天」,性能直升5%,横扫13个视觉语言任务!
北大新发布的多模态大模型:可在混合数据集上直接应用于图像和视频任务训练
北大仅用3天训练130亿参数的Chat-UniVi统一图片和视频理解大模型
沈向洋展示IDEA研究院新模型:开箱即用,无需训练或微调
IDEA 研究院院长沈向洋宣布重磅研究成果发布
GPT-4V新王加冕,斩获视觉问答冠军
北大发布全新Video-LLaVA视觉语言大模型,视频问答技术达到新高度
北京大学发布新一代模型,领跑搞笑抖音视频AI识别笑点技术,已开源
抢秒必胜:人工智能引领战场速度较量!
用户疑似发现OpenAI Bug,有机会免费体验GPT4
微软利用GPT-4V将视频转化为文字,让盲人也能轻松理解电影内容,1小时即可完成
快手推出基于 LaVIT 模型的视觉分词器,实现图文信息统一处理效果
Octopus:基于视觉的AI模型称霸GTA五星玩家
南洋理工大学、清华大学发布视觉可编程智能体Octopus:打游戏、做家务全能干
特斯拉首席执行官马斯克发布最新脑机芯片,可帮助失明人群“看见”
微软 MM-VID 让 GPT-4V 实现追剧、刷抖音、打游戏、玩手机的全新可能性!
OpenAI 首届开发者大会:打造更便宜、更强大的模型
何恺明:科研先锋,我问你答完整版曝光
GPT-4V基准测试错误率高达90%:红绿灯认错、勾股定理也不会
中科大等团队提出「Woodpecker」幻觉修正架构,成功降低30%多模态大模型幻觉误差
清华大学光电计算实现新突破:芯片性能大幅提升,研究成果发表在《自然》杂志
GPT-4V 连北京烤鸭都不认识?别再盲目吹捧了!
基于视觉大模型,虹软引领商拍市场的革新|甲子光年
秋季新品发布:电商卖家秀一键生成神器来袭,虹软商拍玩法大改革!
NeurIPS 2023研究:多模态查询方法让大模型看图比打字管用,准确率提升7.8%
智源和清北联手,发布10亿参数Uni3D视觉大模型,助你从「最强2D」升级到「最强3D」
Meta最新研究揭示:AI读脑成真,仅延迟0.25秒!LeCun点赞MEG实时解码大脑图像
华人团队打造的超热门Mini GPT-4在视觉能力上大幅提升,GitHub星数达两万
1
2