语言

共 106 篇文章

超过500项研究、50个模型的代码大模型全面总览

最新动态:AIGC详细内容原文标题:涵盖500多项研究、50多个模型,代码大模型综述来了关键词:代码、模型、语言、任务、报告文章来源:机器之心总字数:20064字主笔:Panda W,机器之心编辑本文全面探讨了LLM编写代码的各种方法。近年来,随着BERT和GPT等预训练Transformer的问世...
超过500项研究、50个模型的代码大模型全面总览

微软发布性能超越对手的小型语言模型Orca 2

AIGC动态欢迎您的阅读原文标题:微软发布小型语言模型Orca 2,性能超越竞争对手关键词:模型、语言、任务、能力、基准文章来源:AI范儿文章长度:3744字内容摘要:微软发布了Orca 2,这款小型语言模型在复杂的推理任务中表现出色,超越了大型模型。这为资源有限的企业提供了更好的选择。同时,其他公...
微软发布性能超越对手的小型语言模型Orca 2

MIT学者独家揭秘:ChatGPT的瓶颈及突破之道|甲子光年

本文摘自甲子光年,介绍了MIT学者撰写的关于“ChatGPT的瓶颈与解药”的文章。文章主要探讨了自然语言处理领域的重要问题,作者是在MIT从事博士后研究的年轻科学家罗鸿胤。他的研究兴趣涵盖自然语言处理的多个方向,包括自训练算法、蕴含模型以及语言模型推理等问题。文章指出,NLEP技术有望突破大型模型推...
MIT学者独家揭秘:ChatGPT的瓶颈及突破之道|甲子光年

GPT-4超出预料!网上贴文暴露个人隐私,化身现代福尔摩斯

AIGC动态欢迎阅读最近有关GPT-4的报道引起了广泛关注。一篇报道称,这一模型具备类似福尔摩斯的推理能力,仅凭帖子内容就能推测用户的隐私信息。根据瑞士苏黎世联邦理工学院的研究人员发现,这种大语言模型可以对用户在Reddit上发表的帖子进行深度分析,并成功“猜测”出用户的年龄、地点、性别和收入等个人...
GPT-4超出预料!网上贴文暴露个人隐私,化身现代福尔摩斯

GPT-4的自问自答:模型复述让对话更流畅

<img src="" /> 欢迎阅读AIGC动态 原文标题:GPT-4超越你的提问能力:让大型模型自主概述,突破与人类对话的局限 关键词:模型、问题、解释、语言、人类 文章来源:机器之心 字数:5377字 内容摘要:机器之心编辑部最新的人工智能领域动态中指出,人工智...
GPT-4的自问自答:模型复述让对话更流畅

霉霉中文开口跪AI开源平台,每月省350DOGEO!

AIGC动态欢迎阅读原标题:“让霉霉中文开口跪”的AI都已开源替代!每月可节省350(doge)关键词:报告,视频,英文,效果,语言文章来源:量子位内容字数:3064字内容摘要:最新消息来自凹非寺的量子位|公众号QbitAI,那个AI已经开源替代了!它展示了让罗翔能够使用英文就行普法的效果,完全满足...
霉霉中文开口跪AI开源平台,每月省350DOGEO!

复旦大学等发现LLaMA2-13B一个参数导致语言能力完全丧失的新秘密

AIGC动态欢迎阅读 原标题:修改LLaMA2-13B一个参数,语言能力全丧失,复旦等发现大模型新秘密 关键词:解读,语言,模型,能力,参数 文章来源:机器之心 内容字数:2470字 内容摘要:今年以来,ChatGPT、LLaMA等大型语言模型(LLM)已展示出与人类相似的语言能力。这些大型模型可以...
复旦大学等发现LLaMA2-13B一个参数导致语言能力完全丧失的新秘密

清华、中科院、MIT联合发布Co-Pilot人机交互框架:实现ChatGPT辅助驾驶,精准理解乘客意图

欢迎阅读AIGC动态 原标题:将ChatGPT整合至副驾驶! 清华、中科院、MIT联合提出Co-Pilot人机交互框架:完美掌握乘客意图 关键词:模型、语言、意图、控制器、任务 文章来源:新智元 内容字数:12717字 内容摘要:新智元编辑报道:LRS【新智元导读】这项工作首次尝试将语言模型用作辅助...
清华、中科院、MIT联合发布Co-Pilot人机交互框架:实现ChatGPT辅助驾驶,精准理解乘客意图

北大等提出首个「多轮、多模态」PPT任务完成基准PPTC,GPT-4正确率仅为6%

AIGC动态欢迎阅读 原文标题:GPT-4完成正确率仅6%!北大等提出首个「多轮、多模态」PPT任务完成基准PPTC 关键词:模型、轮次、指令、任务、语言 文章来源:新智元 内容字数:9968字 内容摘要:针对LLM在复杂多模态环境中利用复杂工具完成多轮、多模态指令的评估空白,研究人员引入了Powe...
北大等提出首个「多轮、多模态」PPT任务完成基准PPTC,GPT-4正确率仅为6%

AI大佬Wolfram最新演讲:LLM自主在计算空间探索,揭示宇宙尽头的奇点降临

《AIGC动态欢迎阅读》本文探讨了英国科学家Stephen Wolfram在最新演讲中对宇宙尽头的独特看法。他认为,宇宙运行在一种计算模型下,空间和物质都是由遵循简单计算规则的离散元素构成。Wolfram还提出了ruliad的概念,指涵盖所有可能的计算过程极限复杂性。文章探讨了宇宙的计算性质,引发人...
AI大佬Wolfram最新演讲:LLM自主在计算空间探索,揭示宇宙尽头的奇点降临

英伟达发布首款大型语言模型,专注于辅助芯片设计

AIGC动态欢迎阅读 本文转载自夕小瑶科技说,内容题为《英伟达终于发布自家大语言模型,专攻辅助芯片设计》。英伟达最新发布了拥有430亿参数的大型语言模型ChipNeMo。据英伟达官方透露,该模型主要应用于辅助AI芯片设计工作,具体包括回答与芯片设计相关的问题、总结错误文档以及编写EDA工具脚本等任务...
英伟达发布首款大型语言模型,专注于辅助芯片设计

英伟达发布专为辅助芯片设计而打造的大型语言模型

近日,英伟达发布了一款名为ChipNeMo的430亿参数大语言模型,专门用于辅助AI芯片设计。根据英伟达官方披露的消息,ChipNeMo可以帮助从事芯片设计相关任务的工作人员,包括回答与芯片设计有关的问题、总结bug文档,以及为EDA工具编写脚本等。英伟达首席科学家Bill Dally表示,他们的目...
英伟达发布专为辅助芯片设计而打造的大型语言模型

微软利用童话故事训练AI模型,发现探索生成模型参数的新途径

AIGC动态欢迎阅读 本文原标题为:微软通过童话故事训练AI模型,发现了探索生成模型参数的新途径。 关键词:模型、语言、故事、数据、参数 文章转自:机器之心 文章字数:10764字 文章摘要:本文选自《量子杂志》作者Ben Brubaker,由机器之心编辑赵阳翻译。尽管大型语言模型的参数数量不断增加...
微软利用童话故事训练AI模型,发现探索生成模型参数的新途径

清华朱文武团队:图神经网络的规模到底有多重要?

<img src=""> 欢迎阅读AIGC的最新动态 原文标题:清华朱文武团队谈图模型巨大化的观点 关键词:模型、语言、数据、任务、自然语言 文章来源:机器之心 字数:13955字 在大模型时代,图机器学习面临着怎样的机遇和挑战?图的大模型是否真实存在,以及应该如何发...
清华朱文武团队:图神经网络的规模到底有多重要?

李航探讨大模型的研究思考和热点

<img src="" alt="图片">AIGC动态欢迎阅读文章原题为:李航:大规模模型的思考和研究热点关键词:模型、语言、序列、字节跳动、心理文章来源:人工智能学家内容字数:17376字内容摘要:本文来源于图灵人工智能,详细阐述了李航老师对大型语言模型(LLM)的见解:Ch...
李航探讨大模型的研究思考和热点

仿佛搭乐高般轻松,GPT-3.5在数学定理证明方面取得最新SOTA成功率

本文介绍了机器之心编辑部中山大学和华为等机构的研究者提出的LEGO-Prover项目,实现了数学定理的生成、整理、储存、检索和复用的全流程闭环。作为衡量语言模型推理能力的基准之一,数学推理被认为是严格推理的典范。文章还提到了GSM8K和MATH等数学文字问题数据集在语言模型测评和比较中的广泛应用。 ...
仿佛搭乐高般轻松,GPT-3.5在数学定理证明方面取得最新SOTA成功率

港大发布GraphGPT:微调参数比通用GPT模型1/50,准确率提升10倍!LLM也能理解图结构,无需长token

图神经网络(Graph Neural Networks)已成为分析和学习图结构数据的重要框架,推动了多个领域的进步,如社交网络分析、推荐系统和生物网络分析等。最新的研究表明,利用GraphGPT框架将图结构模型和大语言模型进行参数对齐,通过双阶段图指令微调提高模型对图结构的理解能力和适应性,并整合C...
港大发布GraphGPT:微调参数比通用GPT模型1/50,准确率提升10倍!LLM也能理解图结构,无需长token

NYU登上Nature:神经网络具有类人泛化能力,35年来首次证明超GPT-4

《AIGC动态》热烈欢迎您的阅读。 最近,纽约大学等机构的研究人员在人工智能领域取得了重大突破,并首次在《Nature》杂志上发表了关于神经网络具有类人泛化能力的研究成果。这一发现再次强调了人工智能发展的巨大潜力。长达35年的时间里,认知科学、人工智能、语言学和哲学领域的研究人员一直在讨论神经网络是...
NYU登上Nature:神经网络具有类人泛化能力,35年来首次证明超GPT-4

霉霉的中文水平惊呆国外,国产AI背后火了起来

最近,在各大平台上走红的霉霉说中文的视频确实引起了不少关注。人们发现,霉霉并没有真的学会中文,而是通过人工智能技术实现的。这种技术不仅可以完成语言翻译,而且连声线和口型都能非常逼真地模仿,令人叹为观止。网友们被这样惊艳的表现吓得直呼“妈呀”!除了霉霉,还有其他人物,如赫敏、憨豆和蔡明等,也通过类似的...
霉霉的中文水平惊呆国外,国产AI背后火了起来

2023年AI与开源行业盘点:揭秘今年首篇文章

在2023年,AI与开源行业的动态备受关注。今年首篇盘点文章由AI前线带来,涵盖了丰富的内容关键词如报告、模型、公告、数据和语言。文章原作者是Sebastian Raschka博士,翻译是核子可乐,由Tina策划。回顾2023年AI研究与行业动态,以及开源领域的重要变化,虽无法面面俱到,但挑选了精华...
2023年AI与开源行业盘点:揭秘今年首篇文章

ChatGPT Voice 如何助您掌握一门语言

本文介绍了如何借助ChatGPT Voice这一功能来学习语言。ChatGPT Voice是一种与人工智能进行语音互动的方式,非常高效。iPhone和Android用户都可以通过这一功能与ChatGPT进行语音互动,就像与一名语言导师交流一样。ChatGPT是一款强大的机器人,不仅可以进行文本交流、...
ChatGPT Voice 如何助您掌握一门语言

港大团队发布OpenAgents开源智能体,支持200+插件,助力数据分析

最近,香港大学的研究团队发布了一个名为OpenAgents的全新开源智能体框架,可用于用户实际场景,特别是在使用自然语言执行复杂任务时。相较于之前主要关注概念验证或供开发人员使用的语言智能体框架,OpenAgents更注重非专家用户的使用体验和应用设计。它提供了一个开放平台,让更多人能够在日常生活中...
港大团队发布OpenAgents开源智能体,支持200+插件,助力数据分析

文心大模型4.0对决GPT-4:神秘的对决!

在夕小瑶科技说发布的文章中,提到了百度创始人、董事长兼CEO李彦宏宣布文心大模型4.0的发布,并声称其综合水平与GPT-4不相上下。这一消息在业界引起了不小的关注。文章指出,在百度举办的世界大会上,可以如此自信地宣称这一言论,说明对该模型的测评和评估工作在内部已经相当完善。作者特别提到了自己对于这个...
文心大模型4.0对决GPT-4:神秘的对决!

大佬联手!COLM学术会议,引领大型模型新风潮!

欢迎阅读AIGC动态 原文标题:为大型模型而生!顶尖专家发起成立学术会议COLM,或将成为未来NLP最强顶级会议?! 关键词:政策、模型、语言、会议、研究人员 文章来源:夕小瑶科技说 字数:3974字 内容摘要:夕小瑶科技说原创作者|智商掉了一地、ZenMoore最近,ACL 2024的主席公开批评...
大佬联手!COLM学术会议,引领大型模型新风潮!

GitHub 使用大语言模型构建 Copilot 的经验和教训

欢迎阅读AIGC动态 本文原标题为:GitHub 基于大型语言模型构建Copilot的经验和教训。 本文关键词:代码、模型、用户、语言、问题。 文章来源:AI前线 内容字数:3299字 内容摘要:本文作者为Matt Saunders,译者是明知山,策划者是丁晓昀。GitHub在一篇博文中分享了他们在...
GitHub 使用大语言模型构建 Copilot 的经验和教训

谷歌与CMU合作研究:大语言模型击败扩散模型,视频图像生成双SOTA,北大校友担任一作

欢迎阅读AIGC动态 原标题:大型语言模型击败传统扩散模型!视频和图像生成双SOTA,最新研究由谷歌CMU团队完成,主要作者是北大校友。 关键词:模型、视觉、语言、分词、人工智能 文章来源:量子位 内容字数:2561字 内容摘要:最新来自凹非寺量子位发布的消息称,语言模型在视频和图像生成领域取得双重...
谷歌与CMU合作研究:大语言模型击败扩散模型,视频图像生成双SOTA,北大校友担任一作

香港中文大学研究团队发布全面的中文大语言模型评测

欢迎阅读AIGC动态 原文标题:全面的中文大语言模型评测来啦!香港中文大学研究团队发布 关键词:模型、中文、数据、语言、能力 文章来源:量子位 内容字数:6594字 摘要:2023年,全球大语言模型竞赛拉开帷幕。近期,工业界和研究机构推出了各种大语言模型,特别是中文大语言模型在过去半年间蓬勃发展。在...
香港中文大学研究团队发布全面的中文大语言模型评测

最新AI研究热点论文(10月9日-10月15日)

欢迎阅读AIGC动态 原文题目:最新人工智能热点论文(10/9-10/15) 关键词:语言,事实性,模型,规则,策略 文章来源:AI范儿 文章字数:5736字 内容摘要:AI范儿整理了最新人工智能论文(10/9-10/15)的要点:- 环形注意力- 通用模拟器- LLMs中事实性的概述- LLMs ...
最新AI研究热点论文(10月9日-10月15日)

字节跳动李航:语言大模型的观察和思考

欢迎阅读AIGC动态 原标题:字节跳动李航:对语言大模型的一些观察和思考 关键词:模型、语言、序列、字节跳动、心智 文章来源:机器之心 文章长度:17188字 内容概要:本文系机器之心专栏作者、字节跳动研究负责人李航就大规模语言模型(LLM)发表观点,主要包括以下几点:ChatGPT通过规模和模型方...
字节跳动李航:语言大模型的观察和思考

UC伯克利提出LAMP框架:强化学习与视觉语言模型的语言奖励调节

《AIGC动态》欢迎阅读 本文原标题为:强化学习与视觉语言模型之间的交汇:UC伯克利提出语言奖励调控LAMP框架 关键词:任务、模型、作者、语言、提示 文章来源:大数据文摘 字数:8947字 内容概要:本文授权转载自将门创投作者seven_。在强化学习(RL)领域,一个关键的研究方向是如何巧妙设计模...
UC伯克利提出LAMP框架:强化学习与视觉语言模型的语言奖励调节

智源发布强大的开源中英双语LLM模型“全家桶”,超越Llama 2

AIGC动态欢迎阅读 本文介绍了智源研究院最新推出的Aquila2-34B大语言模型,这一340亿参数的新成员超越了Llama 2-70B,在22个评测基准中表现出色。被称为当前最强的开源中英双语大模型。此举进一步提升了大模型在各项业绩评估中的地位。智源研究院强调该模型不仅在大模型榜单上取得成功,还...
智源发布强大的开源中英双语LLM模型“全家桶”,超越Llama 2

语言模型首次战胜扩散模型在图像和视频生成中,tokenizer关键性作用凸显

AIGC动态欢迎阅读 原标题:在图像、视频生成上,语言模型首次击败扩散模型,tokenizer是关键 关键词:模型, 视觉, 语言, 视频, 本文 文章来源:机器之心 内容字数:6122字 内容摘要:机器之心报道编辑:张倩、陈萍。为何语言模型在视觉生成方面落后于扩散模型?来自谷歌、CMU的研究表明,...
语言模型首次战胜扩散模型在图像和视频生成中,tokenizer关键性作用凸显

贾佳亚团队发布全球首个可用于读论文和看小说的70B长文本大语言模型 ProMax

AIGC动态欢迎阅读 原文题:贾佳亚团队开源全球首个70B长文本大语言模型,读论文看小说直接ProMax 关键词:模型、文本、解读、论文、语言 文章来源:量子位 内容字数:8340字 内容摘要:金磊 发自 凹非寺量子位 | 公众号 QbitAI家人们,长期以来一直受困于处理长篇文本的大型语言模型(L...
贾佳亚团队发布全球首个可用于读论文和看小说的70B长文本大语言模型 ProMax

斯坦福大学自然语言处理课程XCS224U视频全集免费放出,干货满满,赶紧来学习

AIGC动态欢迎阅读 原标题:斯坦福大学NLP课程XCS224U视频全部发布,内容丰富,欢迎学习 关键字:课程, 自然语言, 语言, 模型, 机器 文章来源:机器之心 内容字数:3242字 内容摘要:机器之心报道编辑:大盘鸡50 个视频供学习!从对话智能体到搜索查询,自然语言理解(NLP)是当今许多...
斯坦福大学自然语言处理课程XCS224U视频全集免费放出,干货满满,赶紧来学习

清华校友开发的大模型,400万token推理速度提升22倍,在GitHub上获得1.8k星,备受关注!

AI GC动态欢迎阅读 原标题:400万代币,大型模型推理激增22倍!清华校友创作走红,GitHub获得1.8k个星 关键词:注意力、模型、研究人员、语言 文章来源:新智元 内容字数:9827字 内容摘要:新智元报道编辑:润【新智元导读】大型模型受限于上下文长度?大语言模型的上下文长度限制将成为历史...
清华校友开发的大模型,400万token推理速度提升22倍,在GitHub上获得1.8k星,备受关注!
1 2 3