人工智能
新能源汽车
智能家居
机器人
云计算
大数据
VR/AR
芯片
元宇宙
智能穿戴
物联网
生物医药
网络安全
硬件
新能源
AI导航
AI工具库
AI应用集
AI快讯
AI热点
最新文章
最近使用
清空
暂无历史
首页
•
标签云
•
视觉
标签:视觉
关注
马斯克睁眼发现,中国上海市中心实现全自动驾驶:街头一镜到底、高速城区无需驾驶
MQ-Det登上NeurIPS 2023,多模态开放世界检测大模型,精确率提升7.8%
MiniGPT-4升级版本MiniGPT-v2:多模态任务更高效
十年变革:深度学习与经典元素共挑重任
谷歌与CMU合作研究:大语言模型击败扩散模型,视频图像生成双SOTA,北大校友担任一作
升级版美图视觉大师 3.0:设计师的甲方之选
语言模型首次战胜扩散模型在图像和视频生成中,tokenizer关键性作用凸显
清华大学唐杰团队与智谱合作,发布多模态14边形战士,挑战GPT-4V,在线可玩
美图秀秀推出全新自研大模型,多种AIGC玩法让你畅快体验
MiniGPT-5新特性发布:Token转化为Voken,新增图文交叉生成功能
美图自研视觉大模型3.0发布:生图“脑补”和精准修图全面进化,100天看得见巨变
前百度高管接手亚马逊AWS大中华区;英伟达取消人工智能峰会;华为透露小艺语音转写功能丨人工智能大事日报
MiniGPT-5发布:Token变Voken,文图生成新功能助力创作
浙大校友开源多模态大模型LLaVA-1.5,130亿参数,用8个A100一天训练完成挑战GPT-4V
微软发布《GPT-4V多模态大模型》166页使用指南,速览简报
康奈尔大学研究:小鼠也有VR头显了,开颅探究大脑和行为
ICCV'23年度论文颁奖揭晓:Meta分割与ControlNet齐获殊荣,评委惊艳之作浮出水面
微软最新发布的166页测评报告:揭秘视觉模态GPT-4V的强大之处
纽约大学研究揭示智能进展:学会开罐头依靠视觉反馈,成功率提升135%,LeCun点赞
微软发布166页GPT-4V测评报告,业内人士强烈推荐高级用户阅读
多模态大模型的综合审查:从专家级到通用助手
探秘微软最新发布的多模态基础模型及其AI代理应用
KOSMOS-2.5:探索「文本密集图像」的多模态大语言模型
马毅团队新研究:微调多模态大模型导致"灾难性遗忘",性能显著下降
多模态大模型: 未来人机交互的发展方向?
IEEE杰出会员张磊:在手机端实现大模型的普及刻不容缓
微软7位研究员合作撰写的多模态大模型全面综述:涵盖5大主题,共计119页
OpenAI准备对抗谷歌Gemini:推出多模态大模型和新指令语言模型
颜水成与他的学生们:揭秘七次 CV 夺冠背后
水下探测技术:关键技术与智能装备
RACV2023:大规模模型和ChatGPT对计算机视觉的影响总结
阿里云AI大模型通用问答千问完成备案,全面开放!
Meta发布FACET:大规模视觉模型评估基准,DINOv2视觉模型开源商用
字节发布 Vi-PRoM 视觉预训练方案,提高机器人操作成功率和效果
1
2