长度

共 13 篇文章

陈丹琦高徒与Meta合作,推出新方法增强大模型记忆力

本文介绍了一项关于利用4k窗口长度的大模型读取长文本的新方法。由普林斯顿的华人博士生团队开发的MemWalker树形记忆策略能够突破模型窗口长度限制,使模型可以阅读超过1.2万个token的长文本。这一方法不仅可以回答各种问题,而且只需通过prompt就可以完成整个实现过程,无需额外训练。源自《量子...
陈丹琦高徒与Meta合作,推出新方法增强大模型记忆力

MITAI解密:两行神奇代码让您轻松读完《三体》!

近日,夕小瑶科技发表了一篇题为“一键读完《三体》!港中文联MITAI遗忘魔咒,2行代码引领超长文本!”的文章。该文讨论了使用MITAI技术消除大型语言模型在处理超长文本时的困难。传统大语言模型对话存在的缺陷得到了解决,使得处理长文本不再是问题。文章指出,之前使用大型语言模型时,由于模型处理能力受限,...
MITAI解密:两行神奇代码让您轻松读完《三体》!

AI 天才杨植麟发布长模型产品,特点:长长长长长

<img src=""> AI模型革新:杨植麟打造超长文本产品 原标题:AI 天才杨植麟推出长篇大作 关键词:模型、上下文、清华、文本长度 文章来源:量子位 文章字数:8018字 内容摘要:杨植麟推出的万字级大模型产品支持长达20万字的文本输入,堪称全球最长。此举刷新...
AI 天才杨植麟发布长模型产品,特点:长长长长长

LLaMA2上下文扩展至100k:MIT和港中文引入LongLoRA方法

欢迎阅读AIGC动态 原标题:MIT和香港中文学院的研究者开发出了名为LongLoRA的方法,将LLaMA2模型的上下文扩展至100k 关键词:上下文、模型、研究者、长度、长上 文章来源:机器之心 内容字数:6020字 内容摘要:机器之心报道,编辑部成功扩展了大型模型的上下文长度,无需消耗过多计算资...
LLaMA2上下文扩展至100k:MIT和港中文引入LongLoRA方法

大规模模型在长序列上的关键挑战

欢迎阅读AIGC动态原标题:探讨大型模型在处理长上下文时的关键问题关键词:上下文、数据、长度、注意力、模型本文内容摘要来自人工智能学家,文章字数达到20128字。长上下文语言模型的发展成为LLM领域的一大亮点。在过去的一年中,出现了几种处理长上下文的语言模型,比如GPT-4(32k上下文)、Mosa...
大规模模型在长序列上的关键挑战