模型

共 1477 篇文章

LeCun提出AGI之路七阶段:打造世界模型是首要关键

本文来自新智元,在报道中指出了OpenAI提出的「登月计划」,旨在实现超级人工智能。LeCun认为实现AGI仍有一段距离,打造世界模型只是迈出的第一步。他认为发展「超人AI」需要经历多个阶段。第一阶段是构建能学习世界运作方式的系统,让AI能够观察环境并学习,为构建更高级的AI能力奠定基础。 据报道,...
LeCun提出AGI之路七阶段:打造世界模型是首要关键

OpenAI研究员回应:GPT-4.5解禁是网友幻觉?灰度测试引发热议

最新消息称,有关 GPT-4.5 提前曝光的传闻引发了网友们的热议。尽管 OpenAI 的研究人员甚至公司创始人 Altman 都予以否认,但这并未阻止网友们欢快地讨论。关于 GPT-4.5 究竟是否已经悄悄上线仍是一个谜。 最近,许多网友发现了一个让人震惊的现象。在询问 ChatGPT 在 API...
OpenAI研究员回应:GPT-4.5解禁是网友幻觉?灰度测试引发热议

华人团队成功开发大型模型实现“读心术”:将大脑活动直接转化为文字 | NeurIPS 2023

最新的研究成果引起了广泛关注,华人团队成功实现了利用大模型来解读脑电波并将其转化为文字的技术。这项名为DeWave的成果在NeurIPS 2023上引起了轰动。通过分析脑电波数据,研究团队创造性地将受试者的脑电图信号转化为可读的文本,而且整个过程所需的设备仅为一块特制的“头巾”,无需使用大型设备如M...
华人团队成功开发大型模型实现“读心术”:将大脑活动直接转化为文字 | NeurIPS 2023

Gemini大曝中文情感语料用百度文心一言训练,网友惊讶质疑:大公司相互获取用户数据?

AIGC动态欢迎阅读 原标题:Gemini自曝中文用百度文心一言训练,网友看呆:大公司互薅羊毛?? 关键字:模型,中文,表示,清华,身份 文章来源:量子位 内容字数:2806字 内容摘要: 丰色 发自 凹非寺量子位 | 公众号 QbitAI谷歌Gemini中文语料疑似来自文心一言???先是有读者向我...
Gemini大曝中文情感语料用百度文心一言训练,网友惊讶质疑:大公司相互获取用户数据?

360集团梁志辉谈企业发展:员工不需全部成为AI发烧友|MEET2024

本文是关于360集团副总裁梁志辉在MEET2024大会上分享大模型应用实践经验的报道。梁志辉指出,在推广大模型应用时,应充分利用其内容生成能力,避免其长期记忆能力不足的缺点,并实现人机协同。合理运用大模型作为员工智能助手,可以显著提高企业的工作效率和产出。MEET2024大会是一场智能科技领域的商业...
360集团梁志辉谈企业发展:员工不需全部成为AI发烧友|MEET2024

NeurIPS 2023|美图&国科大基于文生图模型提出新方法EI² 有效提升视频编辑一致性

本文介绍了美图影像研究院(MT Lab)与中国科学院大学合作提出的基于文生图模型的视频生成新方法EI²,旨在提高视频编辑过程中的语义和内容一致性。文章指出现有视频编辑过程中存在的不一致性问题,主要由引入的时序信息学习模块导致特征空间的协变量偏移,针对此问题设计了新的网络模块以生成高质量的编辑结果。该...
NeurIPS 2023|美图&国科大基于文生图模型提出新方法EI² 有效提升视频编辑一致性

OpenAI官方指南:如何玦玩ChatGPT的Prompt功能

最近,OpenAI官方发布了一份提示工程指南,旨在帮助用户更好地利用像ChatGPT、GPT-4这样的大型语言模型(LLM)以获得更优质的输出结果。该指南重点介绍了写作prompt的六个策略,其中包括了写清楚指令、要求专家级别的写作等。写好prompt对于影响模型输出结果至关重要,因为模型无法读取用...
OpenAI官方指南:如何玦玩ChatGPT的Prompt功能

字节自研大模型使用ChatGPT遭封号,引发争议?官方回应曝光

本文由机器之心报道,谈论了字节跳动因使用ChatGPT技术开发自有大语言模型而被封号的事件。据报道,字节跳动正在进行名为「种子计划」的大语言模型项目,涉及违反OpenAI的服务条款。在大模型领域,利用其他AI生成的内容进行训练是一种被认为超出底线的行为。OpenAI明确规定用户不得滥用其技术。如果违...
字节自研大模型使用ChatGPT遭封号,引发争议?官方回应曝光

北京大学发布LLMs数据管理全流程综述:预训练与微调

近日,北京大学的学者发布了一篇关于大型语言模型(LLMs)训练数据管理全流程的综述文章。该文章探讨了LLMs在预训练和有监督微调两个阶段的数据管理情况,包括数据规模、数据质量、领域组成以及数据管理系统等方面的研究内容。在这篇综述中,作者详细总结了数据管理对于LLMs性能提升的重要性,强调了数据规模与...
北京大学发布LLMs数据管理全流程综述:预训练与微调

OpenAI 或正在进行 GPT-4.5 的灰度测试!

AIGC动态欢迎阅读原标题:OpenAI 疑似正在进行 GPT-4.5 灰度测试!关键字:模型,美元,网友,幻觉,价格文章来源:夕小瑶科技说内容字数:2903字内容摘要:夕小瑶科技说的原创作者王二狗向大家问好。今天,有网友爆料OpenAI疑似正在进行GPT-4.5灰度测试。询问ChatGPT API...
OpenAI 或正在进行 GPT-4.5 的灰度测试!

微软发布LLMLingua大模型压缩框架,压缩比高达20倍

AIGC动态欢迎阅读近期,关于大型语言模型(LLM)在实际应用中推理和生成能力的研究日益增多。随着诸如ChatGPT等模型的广泛应用和研究,如何在保留关键信息的同时压缩较长的提示成为当前大模型研究的一个关键问题。微软提出了一种名为LLMLingua的提示压缩框架,旨在加速模型推理过程并降低成本。该方...
微软发布LLMLingua大模型压缩框架,压缩比高达20倍

GPT推断中批处理效应的深度剖析

本篇文章来自《人工智能学家》,探讨了GPT模型中批处理效应的重要性。作者指出,机器学习模型如ResNet和DenseNet等小型计算机视觉模型,在提高推断吞吐量时依赖于批处理。然而,在当前最炙手可热的大语言模型领域,比如GPT,批处理仍然是否适用,这是一个值得探讨的问题。文章简述了GPT的整体架构和...
GPT推断中批处理效应的深度剖析

OpenAI首席科学家呼吁研究方法以控制超级人工智能

本文介绍了OpenAI最近成立的研究团队致力于研究未来超级人工智能,并着重讨论了寻找控制超级人工智能的方法的重要性。OpenAI的首席科学家指出,通用人工智能即将到来,超级智能模型具有巨大能力但也可能非常危险,目前还没有找到控制它们的方法。该公司正投入资源探索确保超级人工智能安全和可控的途径。欢迎阅...
OpenAI首席科学家呼吁研究方法以控制超级人工智能

银行工程师离职删除数据库被判两年监禁,华为被指采用“财散人聚”机制致成功,GPT-4.5被质疑售价是GPT-4的6倍|AI周报

AIGC动态欢迎阅读本文来源于AI前线,内容摘要如下:一名银行工程师因离职删库、嘲讽同事被判两年监禁,并被美国司法部勒令赔偿529,000美元。该工程师Miklos Daniel Brody被解雇后故意删除公司的代码存储库,最终导致法律制裁。文章具体描述了此案的经过和细节。关键字:华为,公告,报告,...
银行工程师离职删除数据库被判两年监禁,华为被指采用“财散人聚”机制致成功,GPT-4.5被质疑售价是GPT-4的6倍|AI周报

华科大 & 上科大研发出解决GPT-4V难题的未来推理方法

欢迎阅读AIGC动态原文标题:GPT-4V无法理解的未来推理现在有解决方案了!华中科技大学和上海科技大学联合研究关键词:模型、轨迹、能力、语言、主体引用自:量子位字数:总计8005字摘要:由于当前最强大的GPT-4V等模型仍然难以基于当前信息进行未来推理,华中科技大学和上海科技大学的研究团队提出了新...
华科大 & 上科大研发出解决GPT-4V难题的未来推理方法

速度提升1000倍!MIT与康奈尔的研究:复杂体系下“炼金”过程加速效应

欢迎阅读AIGC动态 本文原标题为:速度暴涨1000倍!扩散模型预测材料“炼金”过程,体系越复杂加速度越大,详细介绍了MIT和康奈尔大学合作开发的新研究成果。他们利用扩散模型预测化学反应中关键的过渡态结构,取得了令人意想不到的准确性,同时计算速度提升了1000倍。相关研究成果已在Nature Com...
速度提升1000倍!MIT与康奈尔的研究:复杂体系下“炼金”过程加速效应

源代码打造无敌小模型,性能媲美ChatGPT和谷歌Gemini

本文节选自机器之心,是关于代码生成人工智能的最新发展的报道。文章介绍了伊利诺伊大学香槟分校(UIUC)张令明老师团队开发的Magicoder,在短短一周内获得了广泛关注并在GitHub上获得了超过1200颗星,同时受到业内大佬的推荐。文章指出,类似Magicoder和OSS-INSTRUCT等开源创...
源代码打造无敌小模型,性能媲美ChatGPT和谷歌Gemini

率先体验GPT 4.5?3D、视频直接输入对话框,大模型精准跨模态推理

欢迎阅读AIGC动态原标题:谈论GPT 4.5的最新进展:3D和视频输入能力,大模型实现跨模态推理关键词:模型、数据、解读、能力、音频文献来源:机器之心字数:8603字内容摘要:最近有人在社交媒体上分享了一张关于GPT4.5更新的截图。根据截图内容显示,相较于先前的GPT系列模型,GPT4.5 最大...
率先体验GPT 4.5?3D、视频直接输入对话框,大模型精准跨模态推理

Mistral携微软发布”小语言模型”,超越GPT-4,成本降低2/3

最近,小语言模型的兴起备受关注。法国AI初创公司Mistral近日发布了Mixtral 8x7B模型,尽管规模不大,但在某些基准测试中表现出色,甚至胜过了GPT-3.5。这一消息在开发者中引起一片赞誉。Mistral 8x7B模型采用了稀疏专家混合的设计,结合多种较小模型,在特定任务上取得了高效运行...
Mistral携微软发布”小语言模型”,超越GPT-4,成本降低2/3

王小川创业 8 个月:尚未达到谈 PMF 的阶段

精选文章:AIGC动态 原标题:王小川创业8个月:大模型尚未谈及PMF 关键词:模型、产品、技术、华为、公司 文章来源:Founder Park 字数:17055字 内容摘要:王小川在创业八个月的过程中发现,很多行业常识和惯例在大模型时代已经不适用。他认为当前很多大模型并未真正满足用户需求,继续发展...
王小川创业 8 个月:尚未达到谈 PMF 的阶段

Ilya负责率先发布OpenAI首篇超级对齐论文:《从弱监督到强泛化:实现强大AI能力》,AI对齐AI并取得实证结果

这篇文章介绍了OpenAI首席科学家Ilya Sutskever关于人工智能发展的预测和对齐方法的重要性。文章指出,人工智能在以预测下一个Token为基础的大模型中展现出巨大潜力,可能会在不久的将来超越人类智能。然而,超级人工智能的出现也可能带来意想不到的负面后果,因此对其进行有效的对齐显得尤为重要...
Ilya负责率先发布OpenAI首篇超级对齐论文:《从弱监督到强泛化:实现强大AI能力》,AI对齐AI并取得实证结果

OpenAI:调查字节GPT账户不当行为并冻结

深度了解 AIGC 动态 原文标题:字节 GPT 账户遭冻结,OpenAI:调查不当行为 关键词:字节跳动,政策,模型,微软,种子 文章来源:量子位 字数统计:3430字 摘要内容:根据 The Verge 的报道,字节跳动最近因秘密使用 OpenAI 技术开发自家大语言模型(LLM)而备受舆论关注...
OpenAI:调查字节GPT账户不当行为并冻结

DeepMind提出代码链方法,通过“代码思考”优化推理性能

<img src="" /> 深度学习动态:DeepMind提出代码链,通过“代码思考”改进推理性能 本文内容来源于夕小瑶科技说,是由智商掉了一地撰写的原创文章。在未来,想要精准控制机器人可能需要更智能、能够理解复杂推理的方法来执行指令。最近,谷歌DeepMind提出...
DeepMind提出代码链方法,通过“代码思考”优化推理性能

大模型时代下的对话系统:演进、机会与港中大华为联合发布

本文来自夕小瑶科技说,通过作者Hongru Wang的视角,探讨了大模型时代对话系统的演进和机会。自然语言处理领域一直以来都备受关注,而随着大模型如ChatGPT和GPT4的问世,几乎所有自然语言处理任务都可以通过对话形式来处理。文章回顾了对话系统从简单基于规则、领域、任务和语言单一形式的早期发展,...
大模型时代下的对话系统:演进、机会与港中大华为联合发布

PaLM 2数学性能提升至6%,DeepMind新研究揭示「合成数据」是通往AGI关键

本文介绍了最新研究表明,利用合成数据可以显著提升AI模型在数学问题解决和代码生成方面的能力。研究人员发现,利用AI系统自己生成数据进行训练可以带来巨大的好处。特别是在MATH高级推理和APPS编码基准测试中,使用PaLM-2模型进行测试后,发现其性能比仅在人类数据上微调的模型要好得多。这一发现引发了...
PaLM 2数学性能提升至6%,DeepMind新研究揭示「合成数据」是通往AGI关键

下一代自动驾驶系统所需的大模型调研结果揭晓

欢迎阅读AIGC动态 原文标题:下一代自动驾驶系统不可或缺的大型模型——系统调研终结篇 关键词:腾讯,模型,语言,报告,车辆 文章来源:机器之心 字数:7822字 内容摘要:本文详细介绍了将多模态大型语言模型(MLLMs)融入下一代自动驾驶系统的模式。随着大型语言模型(LLM)和视觉基础模型(VFM...
下一代自动驾驶系统所需的大模型调研结果揭晓

陶哲轩偏好的证明助手Lean在大型模型上大放异彩

<img src=""> 阅读AIGC动态 本文原标题为:陶哲轩青睐的证明助手Lean,用上了大模型。 关键词:报告、数学、模型、策略、定理。 文章来源:机器之心。 字数:4657字。 摘要:机器之心的编辑陈萍报道指出,数学辅助证明工具逐渐采用大模型。数学家陶哲轩在一...
陶哲轩偏好的证明助手Lean在大型模型上大放异彩

AI视频生成:大型模型的新里程碑和未来展望

欢迎阅读AIGC动态 本文原标题:AI视频生成技术的突破与未来走向 关键词:视频, 字节跳动, 模型, 技术, 领域 文章来源:机器之心 字数:3306字 摘要:时至年末,2023年被誉为大模型元年,从文本大模型ChatGPT到图片生成模型Stable Diffusion和Midjourney,技术...
AI视频生成:大型模型的新里程碑和未来展望

字节跳动被OpenAI拉黑,使用ChatGPT技术开发自有模型的秘密曝光

欢迎阅读AIGC动态 原文标题:字节跳动使用ChatGPT技术开发自己的模型,遭到OpenAI拉黑 关键词:字节跳动,政策,模型,人工智能,账户 文章来源:AI范儿 文章长度:1921字 文章摘要:请点击上方链接关注我们。字节跳动秘密地使用OpenAI技术开发竞争性的大型语言模型(LLM)。这一行为...
字节跳动被OpenAI拉黑,使用ChatGPT技术开发自有模型的秘密曝光

AI智能眼镜新潮流:AI Pin、Meta AI和Snap现身,可穿戴设备再掀风潮?

近期,科技领域的巨头们再次开始看好可穿戴设备,特别是智能眼镜。Meta、Google、微软、OpenAI等公司正致力于将视觉和语言 AI 技术融入智能眼镜和其他可穿戴设备中。虽然智能可穿戴设备已存在多年,但随着多模态 AI 技术的突破,巨头们重新对这一领域充满信心。例如,OpenAI正考虑将GPT-...
AI智能眼镜新潮流:AI Pin、Meta AI和Snap现身,可穿戴设备再掀风潮?

GPT-4.5泄露事件曝光,Altman回应辟谣!价格疑涨至6倍,谷歌或着急提前发布Gemini API

最新消息显示,GPT-4.5可能遭遇了泄漏事件,引发了不小的轰动。据Altman否认,价格甚至可能飙升6倍。与此同时,谷歌可能会提前推出Gemini API。这样的情况下,各界对于GPT-4.5的发布时间存在不小的疑虑。不过,虽然网络上爆料频频,Altman却迫不及待地澄清了事实。这次的曝料或许并非...
GPT-4.5泄露事件曝光,Altman回应辟谣!价格疑涨至6倍,谷歌或着急提前发布Gemini API

GPT-4.5泄露:新增视频3D支持,价格暴涨6倍!奥特曼亲自回应

本文是关于GPT-4.5最新动态的内容。据爆料称,新版GPT-4.5将拥有多模态能力,可以处理文本、语音、图片、视频和3D信息,并支持跨模态理解,推理执行更为复杂。API调用的价格也狂涨了6倍,其中基础版价格为6美分/千token输入,18美分/千token输出;64k上下文版价格为12美分/千to...
GPT-4.5泄露:新增视频3D支持,价格暴涨6倍!奥特曼亲自回应

百度智能云千帆系列直播课成功收官,揭示更多隐藏潜力等你发现!

AIGC动态欢迎阅读 原标题:首个大模型平台系列直播课圆满结束!百度智能云千帆等你解锁更多潜在能力! 关键词:模型、智能、平台、场景、用户 文章来源:量子位 内容字数:2966字 内容摘要:12月5日,百度智能云千帆举办的《大模型应用实践》实训营顺利结束!这是百度智能云千帆推出的首个教学类课程;共有...
百度智能云千帆系列直播课成功收官,揭示更多隐藏潜力等你发现!

探秘智能未来大会:ChatGPT万字详细实录,令人激动不已

AIGC动态欢迎阅读 原标题:MEET智能未来大会万字实录,ChatGPT:看完让人激动不已 关键字:小米,模型,政策,智能,数据 文章来源:量子位 内容字数:27548字 内容摘要:编辑部 发自 凹非寺量子位 | 公众号 QbitAI不包含大厂在内,中美相加最后将有五、六家大模型公司笑到最后。真正...
探秘智能未来大会:ChatGPT万字详细实录,令人激动不已

机器人:AI变革的头号玩家

本文为甲子光年刊登的文章,标题为《AI变革的头号玩家,为什么是机器人?|甲子光年》。文章主要讨论了机器人行业的发展现状,特别是在2023年,机器人行业呈现出蓬勃的发展势头。中国作为世界机器人市场的头号市场,机器人销量占全球总销量的50%以上。随着新型工业化的不断推进,越来越多的领域对机器人提出需求,...
机器人:AI变革的头号玩家

港中大团队利用大型蛋白质语言模型提升分类性能10%,发现未知的信号肽

本文介绍香港中文大学团队利用大型蛋白质语言模型发现未知信号肽的研究成果。他们开发了一种名为无偏生物体不可知信号肽网络(USPNet)的深度学习方法,用于信号肽的分类和切割位点预测。实验结果显示,USPNet的分类性能比现有方法提高了10%。该方法从宏基因组数据中发现了347个与训练数据中信号肽差异很...
港中大团队利用大型蛋白质语言模型提升分类性能10%,发现未知的信号肽

深度解读具身智能:方法、进展和挑战

本文是关于具身智能的内容,通过与环境的交互来获取认知能力、学习新技能和知识。主要涉及模仿学习和强化学习两大方法。模仿学习借助深度学习技术对任务轨迹数据进行学习,而强化学习则是通过环境交互来学习优化特定任务奖励函数。若要了解更多信息,请访问原文链接:一文读懂具身智能:方法、进展及挑战。如需进一步了解,...
深度解读具身智能:方法、进展和挑战
1 2 3 4 5 37