当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek双模型发布:一位是“话少助手” 一位是“偏科天才”

9个月前 (12-04)Deepseek最新资讯184

  12月1日,DeepSeek(深度求索公司)同时发布两个正式版模型:DeepSeek-V3.2和DeepSeek-V3.2-Speciale。在公开推理测试中,V3.2水平达到了开放人工智能公司(OpenAI)今年8月推出的大模型GPT-5水平,略低于谷歌(Google)的Gemini3 Pro,国产大模型再一次吸引全球目光。

  “简单来说,区别于聊天机器人式大模型,DeepSeek-V3.2更像一位‘话少活好’的助手。”DCCI互联网研究院院长、中国社会科学院大学数字中国研究院特聘研究员刘兴亮解释道,这位助手主打高性价比与日常使用,具备更强的推理能力和智能体(Agent)能力,未来有望成为“数字劳动力”,完成自动生成报表、编写代码等复杂工作。

  而V3.2-Speciale更像一位“偏科”的科研天才,专攻高难度数学问题求解、学术研究逻辑验证、编程竞赛解题等,旨在将开源模型推理能力推向极致。

  工业和信息化部信息通信经济专家委员会委员盘和林表示,新模型有两个质的突破:引用DSA(领域专用架构)和思考型工具调用技术。

  盘和林用了一个形象的比喻解释DSA技术:“如果把大模型比作图书管理员,以往旧模型在找书时,每次都要从头一本一本找deepseek,词元消耗多且效率低。而DSA让它只需检索最关键信息,可以大幅缩小书架寻找范围,进而提升效率、降低消耗。”

  思考型工具调用技术,则瞄准大模型“一思考手就停”的短板。“此前大模型多限于单轮问答,无法像人类一样,在解决复杂问题时进行多轮思考和查阅资料。”盘和林说,“这项新技术让模型得到指令后,能先思考再调用代码执行、数据库查询等工具接口,然后根据结果继续思考、再次调用,如此交替反复,并保留记录供后续推理使用。”

  “这是DeepSeek首次将思考融入工具使用,改变了以往模型依赖人‘喂’数据的发展范式,实现AI的自我训练和进化。”盘和林说。

  过去一年,大语言模型快速发展,以Google、OpenAI等为代表的闭源社区在复杂任务中表现得愈发优越,而开源社区受制于架构、资源分配及智能体能力等方面的关键缺陷,与闭源社区性能差距进一步扩大。

  刘兴亮认为,新模型缩小了当前开源模型与闭源模型间的差距,证明了闭源大模型的巅峰并非不可逾越,为我国乃至全球开源大模型的发展注入强心剂。

  盘和林表示,从今年初发布R1大模型,以深度思考模式和超低成本预算实现中国人工智能发展弯道超车后,DeepSeek的发展主线始终聚焦实用性和泛化能力,让“赶超闭源”从美好愿景变为闭源厂商的现实压力。“最重要的是,DeepSeek为全球开发者提供了一个强大、可控且经济的模型底座,助力大语言模型融入千行百业、形成商业闭环。”他说。

  同时,盘和林也提醒,新模型为大语言模型带来了新的治理难题。“需警惕工具调用风险,以及学术造假、自动化生成代码漏洞、产业不公平竞争等挑战,推动开源模型向‘少说话多办事更安全’跃升。”

  据悉,DeepSeek的官方网页端、App和API(应用程序编程接口)均已更新为正式版DeepSeek-V3.2,但Speciale版本目前仅以临时API服务形式开放,供社区评测与研究。原文出处:DeepSeek双模型发布:一位是“话少助手” 一位是“偏科天才”,感谢原作者,侵权必删!

标签: deepseek

“DeepSeek双模型发布:一位是“话少助手” 一位是“偏科天才”” 的相关文章

10月29日DeepSeek预测:国王vs雷霆,雷霆主场延续连胜,亚历山大对决拉

10月29日DeepSeek预测:国王vs雷霆,雷霆主场延续连胜,亚历山大对决拉

  北京时间10月29日,NBA常规赛将迎来西部强弱对话——萨克拉门托国王客场挑战俄克拉荷马雷霆。目前雷霆以4胜0负高居西部第二,而国王1胜2负暂列第11位。这场对决不仅是排名悬殊的较量,...

一场睡眠科技共创,慕思AI破局智能感知与交互

一场睡眠科技共创,慕思AI破局智能感知与交互

  中国睡眠研究会发布的《2025年中国睡眠健康调查报告》显示,中国超3亿人存在睡眠障碍,其中约1.5亿人需积极干预,而且,睡不着、睡不醒、睡不好等睡眠障碍问题,呈现出年轻化的趋势。...

11月17日DeepSeek预测:快船vs凯尔特人,哈登单核带队难敌绿军双星

11月17日DeepSeek预测:快船vs凯尔特人,哈登单核带队难敌绿军双星

  北京时间11月17日凌晨4:30,NBA常规赛将迎来一场东西部中游球队的较量——洛杉矶快船客场挑战波士顿凯尔特人。两支胜率不足五成的球队都急需一场胜利来扭转颓势,但快船在伦纳德缺阵的情...

DeepSeek的小更新,暴打了OpenAI,追上了Gemini。

DeepSeek的小更新,暴打了OpenAI,追上了Gemini。

  前者和 GPT-5 能打的有来有回,后面的高性能版更是直接把 GPT 爆了,开始和闭源模型天花板 —— Gemini 打了个五五开。   还在IMO 2025(国际数...

DeepSeek更新后被吐槽变冷变傻:比20年前的青春伤感文学还让人尴尬!业内人

DeepSeek更新后被吐槽变冷变傻:比20年前的青春伤感文学还让人尴尬!业内人

  据科创板日报报道,多名用户反馈,DeepSeek在网页端和APP端进行了版本更新,支持最高1M(百万)Token的上下文长度。而去年8月发布的DeepSeekV3.1上下文长度拓展至1...

【华西计算机】0121 R1模型发布一周年, DeepSeek新模型“MODEL

【华西计算机】0121 R1模型发布一周年, DeepSeek新模型“MODEL

  智谱:GLM-4.7 上线带动 GLM Coding Plan 用户增长,算力阶段性紧张,套餐将暂时限量发售   智谱公告显示,受 GLM-4.7 上线后用户增长影响...