首页 游戏 软件 资讯 排行榜 专题
首页
业界动态
姚顺雨腾讯论文首讲:AI听不懂人话的症结何在

姚顺雨腾讯论文首讲:AI听不懂人话的症结何在

热心网友
99
转载
2026-02-04

2月4日消息,近期,腾讯混元团队与复旦大学联合团队共同发布了一篇题为《CL-bench》的论文。

免费影视、动漫、音乐、游戏、小说资源长期稳定更新! 👉 点此立即查看 👈

值得关注的是,这也是姚顺雨加入腾讯、担任首席AI科学家后,首次署名发布的研究论文。

他在文中指出,当前人工智能与真正智能之间的核心差距,并非在于知识储备的多少,而在于持续学习的能力。

一个知识库庞大却不懂得学习的AI,就如同一个背下整本字典却不会写作的人,看似博学,实则思维僵化。

首席科学家姚顺雨腾讯首篇论文:道破为何AI死活听不懂人话

人类的学习并不依赖于多年前习得的“死”知识,而是能够实时地从眼前的具体情境中汲取新知并加以运用。

在这篇论文中,研究团队提到,即使是当前的大型语言模型,在有效利用上下文信息方面,依然存在显著的短板。

为了准确衡量现有模型距离真正的“上下文学习者”还有多远,研究团队构建了CL-bench基准测试。

这是一个专门用于评测语言模型能否从上下文中学习新知识并正确应用的专业基准。

CL-bench包含了由资深领域专家精心制作的500个复杂上下文、1899个具体任务,以及31607个验证标准。

CL-bench只包含一个简单却严苛的核心要求:“解决每个任务时,模型必须从提供的上下文中,学习到它预训练阶段不曾具备的新知识,并将其正确应用。”

通过实验发现,全球排名前十的语言模型在CL-bench上的任务解决率平均值仅为17.2%。

这意味着,即便是目前最顶尖的语言模型,在利用上下文进行学习和推理方面,表现依然不尽人意,甚至可以说,它们还未真正掌握从动态情境中学习的能力。

不过,这一结果也为大语言模型未来的迭代指明了可能的方向:强化模型从具体上下文中进行实时学习的能力,将是迈向更高级智能的关键一步。

来源:https://m.mydrivers.com/newsview/1102350.html
免责声明: 游乐网为非赢利性网站,所展示的游戏/软件/文章内容均来自于互联网或第三方用户上传分享,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系youleyoucom@outlook.com。

相关攻略

DeepSeek-V4与姚顺雨大模型联袂发布,下月震撼登场
AI
DeepSeek-V4与姚顺雨大模型联袂发布,下月震撼登场

新智元报道编辑:艾伦【新智元导读】3 月 12 日,据《白鲸实验室》独家爆料,DeepSeek V4 和姚顺雨领衔操刀的混元新模型,均预计将于下个月(2026 年 4 月)发布。3 月 11 日,O

热心网友
03.15
姚顺雨腾讯首研:上下文中,参会者均未及格
科技数码
姚顺雨腾讯首研:上下文中,参会者均未及格

作者 | 周一笑邮箱 | zhouyixiao@pingwest com2025年4月,还在OpenAI的姚顺雨发了一篇博文《The Second Half》,提出一个判断:AI进入下半场了,接

热心网友
02.05
姚顺雨腾讯论文首讲:AI听不懂人话的症结何在
业界动态
姚顺雨腾讯论文首讲:AI听不懂人话的症结何在

2月4日消息,近日,腾讯混元团队和复旦联合团队发布了首篇论文《CL-bench》。值得一提的是,这也是姚顺雨入职腾讯首席AI科学家后,首次署名的研究论文。他在文中提到,当前AI与真正智能之间的鸿沟,

热心网友
02.04
姚顺雨首篇论文解读:AI为何难懂人话的根源与突破
科技数码
姚顺雨首篇论文解读:AI为何难懂人话的根源与突破

今天的大语言模型能解奥数题、通过专业考试、写复杂代码,但它们在真实世界的应用中却常常“翻车”。问题出在哪里?在姚顺雨加入腾讯后发布的首篇论文里,他对于这个现象提出了一个观点:“当前AI与真正智能之间

热心网友
02.04
姚顺雨加盟腾讯首秀,发布小米多项AI顶会成果
科技数码
姚顺雨加盟腾讯首秀,发布小米多项AI顶会成果

21世纪经济报道新质生产力研究院综合报道早上好,新的一天又开始了。在过去的24小时内,科技行业发生了哪些有意思的事情?来跟21tech一起看看吧。【巨头风向标】谷歌旗下自动驾驶企业Waymo宣布完成

热心网友
02.04

最新APP

凡人传说
凡人传说
角色扮演 03-30
恶魔秘境
恶魔秘境
角色扮演 03-29
猫和老鼠华为
猫和老鼠华为
休闲益智 03-29
暗黑之地
暗黑之地
角色扮演 03-28
你比我猜
你比我猜
休闲益智 03-26

热门推荐

vivo Pad6 Pro发布:首款4K原彩屏配骁龙8,售4499元起
网络安全
vivo Pad6 Pro发布:首款4K原彩屏配骁龙8,售4499元起

3月30日消息,今晚除了手机之外,vivo还发布了全新的旗舰平板——vivo Pad6 Pro。行业首发13 2英寸4K原彩屏,分辨率3840×2160,347PPI,支持1-144Hz LTPS自

热心网友
03.30
WPS表格提取括号内容:3步掌握MID函数实战用法
电脑教程
WPS表格提取括号内容:3步掌握MID函数实战用法

WPS表格中提取括号内容有四种方法:一、单对英文小括号用FIND+MID;二、中英文括号通用需SUBSTITUTE预处理;三、多对括号取最后一对需REVERSESTRING反向查找

热心网友
03.30
聚焦AI文创与跨境,“数智苏豪”新街口OPC社区启幕
科技数码
聚焦AI文创与跨境,“数智苏豪”新街口OPC社区启幕

3月30日,南京新街口核心商圈,苏豪大厦一楼广场上机器人迎宾起舞,充满科技感。由苏豪资产运营集团与南京新街口金融商务区管理委员会(以下简称“新街口管委会”)共同打造的“数智苏豪”新街口OPC社区揭牌

热心网友
03.30
1.9亿年薪背后:又一位车企CEO薪酬为何大幅上涨?
科技数码
1.9亿年薪背后:又一位车企CEO薪酬为何大幅上涨?

电 动 知 家消 息,近日,据外媒报道,据福特汽车日前发布的一份文件,该公司首席执行 官吉姆·法利2025年的总薪酬大幅增长了11%,达到约2752万美元(约1 9亿元人民币),这是其自2020年末

热心网友
03.30
美议员为何急于拉黑中国机器人却暗留后门?
科技数码
美议员为何急于拉黑中国机器人却暗留后门?

白宫里,一台人形机器人缓步走入东厅,与美国“第一夫人”并肩亮相,动作仍带着明显的机械感;仅仅一天后,国会山上,这种“会走路的机器”却被划为潜在安全威胁,写进立法提案。这是上周美国上演的荒诞一幕。两党

热心网友
03.30