当前位置:首页 > Deepseek最新资讯 > 正文内容

谷歌研究:DeepSeek推理模型通过“脑内群聊”提升智能

7个月前 (01-21)Deepseek最新资讯98

  据量子位,谷歌最新研究发现,DeepSeek-R1等顶尖推理模型在解题时,内部会自发“分裂”出不同性格的虚拟人格,如外向deepseek、严谨、多疑等。这些人格在模型解题过程中展开激烈的社交与辩论,类似“左右脑互搏”,从而让模型越吵越聪明。研究显示,在面对高难度任务时,这种内部冲突会更加激烈,而在简单任务时则明显减少。

  团队通过分析DeepSeek-R1和QwQ-32B等模型的思维轨迹发现,这些模型的推理过程充满对话感,内部分裂出的虚拟角色性格迥异且覆盖更多解题角度。例如,创意型角色提出新颖思路,批判型角色挑错补漏,执行型角色负责落地验证。这种多角色互动并非开发人员刻意设计,而是模型在追求推理准确率过程中自发形成的。

  研究人员借助稀疏自编码器SAE,成功“监听”到AI的脑内群聊。通过提取模型隐藏层神经元的激活数值,并利用SAE的稀疏约束机制,将复杂信号拆解为独立的对话语义特征,进而识别出不同的内部逻辑实体,并打上虚拟角色标签,解码了AI内部的多角色对话行为。

  实验发现,推理模型的对话式行为出现频率显著高于普通指令模型。有趣的是,当强化模型的对话特征,放大“哦!”这类表达惊讶或转折的话语标记时,模型在算术推理任务中的准确率显著提升。此外,在强化学习训练中,模型会自发学会用对话式思考,且先经过多智能体对话数据微调的模型,在推理训练中的进步速度远快于直接训练或用独白式推理数据微调的模型。

  这一发现呼应了人类演化生物学中的社会脑假说,即大脑的进化是为了应对复杂的社交关系和群体互动需求。如今,AI也通过与不同“人格”的社交互动来提升智能。原文出处:谷歌研究:DeepSeek推理模型通过“脑内群聊”提升智能,感谢原作者,侵权必删!

标签: deepseek

“谷歌研究:DeepSeek推理模型通过“脑内群聊”提升智能” 的相关文章

AI能成交客户?2026年AI销冠智能体正在颠覆转化效率,快来雇佣AI员工!

AI能成交客户?2026年AI销冠智能体正在颠覆转化效率,快来雇佣AI员工!

  在大模型语言能力快速升级的背景下,2025年作为AI Agent元年,AI智能体已经广泛应用在内容生成、客服等领域,随着技术的发展,2026年,企业级AI应用将会更规模化落地。...

DeepSeek助力算力与算法平权,AI界聚焦高质量数据集 数博会

DeepSeek助力算力与算法平权,AI界聚焦高质量数据集 数博会

  “DeepSeek的开源推动了算力和算法的平权,但数据平权仍面临挑战。”北京交通大学信息管理理论与技术国际研究中心(ICIR)特聘教授张向宏在接受《中国经营报》记者采访时指出,高质量数...

从Deepseek到Seedance:两年两炸,中国AI凭什么改写下一个十年?

从Deepseek到Seedance:两年两炸,中国AI凭什么改写下一个十年?

  2025年春节前后,DeepSeek R1横空出世,一记重拳撼动全球AI格局,连英伟达的股价都被牵连震荡;2026年春节将近,字节跳动Seedance 2.0低调登场,没有发布会、没有...

11月6日 DeepSeek预测 鹈鹕vs独行侠:伤病潮下的西部垫底对决,独行侠

11月6日 DeepSeek预测 鹈鹕vs独行侠:伤病潮下的西部垫底对决,独行侠

  西部垫底两强鹈鹕与独行侠即将在达拉斯展开对决,两队合计仅3胜11负的战绩让这场比赛成为名副其实的摆烂大战。鹈鹕核心威廉森高挂免战牌,独行侠则折损戴维斯和欧文双星,伤病阴影笼罩下,谁能抓...

Deepseek推荐全国旅游百强区第60名:广西南宁市江南区

Deepseek推荐全国旅游百强区第60名:广西南宁市江南区

  日前,全国县镇发展研究课题组、天和经济研究所县镇发展研究院联合发布了2024《全国县镇发展报告》deepseek,报告评价篇对全国县市以及包含乡村人口的市辖区旅游发展水平进行了综合评价...

DeepSeek改造何恺明残差连接!梁文峰亲自署名,十年首次重大升级

DeepSeek改造何恺明残差连接!梁文峰亲自署名,十年首次重大升级

  其核心机制简洁明了,x𝑙+1 = x𝑙 + F (x𝑙 ,W𝑙),即下一层的输出等于当前层输入加上残差函数的输出。   随着Transformer架构的崛起,这一范式...