当前位置:首页 > Deepseek最新资讯 > 正文内容

国泰海通:DeepSeek~V3.1加强智能体支持 与国产AI芯片协同创新

9个月前 (08-27)Deepseek最新资讯355

  发布研报称,DeepSeek V3.1在多项指标上性能大幅领先R1-0528,加强了智能体支持,独创性使用UE8M0 FP8 Scale精度,与国产AI芯片协同创新。DeepSeek-V3.1加强了智能体支持,并且针对下一代国产AI芯片设计;该行维持计算机板块“增持”评级。

  ①混合推理架构,一个模型同时支持思考模式和非思考模式,官方App与网页端模型已同步升级为DeepSeek-V3.1,用户可以通过“深度思考”按钮,实现思考模式和非思考模式自由切换;②更高的思考效率,相比DeepSeek-R1-0528deepseek,DeepSeek-V3.1-Think能在更短时间内给出答案;③更强的Agent能力,通过Post-Training优化,新模型在工具使用与智能体任务中的表现有较大提升。

  ①编程智能体,在代码修复测评SWE与命令行终端环境下的复杂任务(Terminal-Bench)测试中,DeepSeek-V3.1相比之前的DeepSeek系列模型有明显提高。②搜索智能体,DeepSeek-V3.1在多项搜索评测指标上取得了较大提升。在需要多步推理的复杂搜索测试(browsecomp)与多学科专家级难题测试(HLE)上,DeepSeek-V3.1性能已大幅领先R1-0528。③思考效率提升,测试结果显示,经过思维链压缩训练后,V3.1-Think在输出token数减少20%-50%的情况下,各项任务的平均表现与R1-0528持平。同时,V3.1在非思考模式下的输出长度也得到了有效控制,相比于DeepSeek-V3-0324,能够在输出长度明显减少的情况下保持相同的模型性能。

  ①V3.1的Base模型在V3的基础上重新做了外扩训练,一共增加训练了840Btokens。Base模型与后训练模型均已在Hugging face与魔搭开源。②需要注意的是,DeepSeek-V3.1使用了UE8M0 FP8 Scale的参数精度,UE8M0 FP8是针对即将发布的下一代国产芯片设计。③另外,V3.1对分词器及chat template进行了较大调整,与DeepSeek-V3存在明显差异。

  /特朗普:已有人选接替库克,鲍威尔也很快就离开了!美联储首次回应, 库克的律师宣布将起诉......

  /这次没有空中爆炸!1个小时飞越半个地球,马斯克星舰终于成功了,现场欢呼声、鼓掌声响成一片

  /苹果发布会前瞻:iPhone 17—“史上最薄iPhone”,以及苹果硬件发布会的其他预期新品

  /中国石油拟400亿元人民币收购储气库企业:德国汽车欧宝放弃先前电动化战略,延长燃油车型供应时间原文出处:国泰海通:DeepSeek~V3.1加强智能体支持 与国产AI芯片协同创新,感谢原作者,侵权必删!

标签: deepseek

“国泰海通:DeepSeek~V3.1加强智能体支持 与国产AI芯片协同创新” 的相关文章

拜耳可以使用Deepseek?

拜耳可以使用Deepseek?

  拜耳健康消费品中国区总经理何勇表示,真正的突破不仅在于技术,更在于精准识别消费者潜在需求,确保从源头创新deepseek,打造出真正契合消费者需求的产品。原文出处:拜耳可以使用Deep...

DeepSeek预测:皇家贝蒂斯vs巴塞罗那,莱万领衔巴萨客场险胜!

DeepSeek预测:皇家贝蒂斯vs巴塞罗那,莱万领衔巴萨客场险胜!

  西甲第15轮即将迎来一场焦点战,皇家贝蒂斯将在主场迎战巴塞罗那。目前巴萨以37分领跑积分榜,而皇家贝蒂斯以24分排名第五,两队都处于欧战区。巴萨本赛季进攻火力十足,42个进球排名联赛第...

美媒文章:“这会是又一个‘DeepSeek时刻’吗?”

美媒文章:“这会是又一个‘DeepSeek时刻’吗?”

  一家鲜为人知的中国人工智能公司近日发布了一款开源推理模型,对西方的主导地位构成挑战,而研发成本仅为西方同类产品的一小部分。但这家公司并非深度求索。   本月早些时候,...

一个模型超了DeepSeek R1、V3,参数671B,成本不到350万美元

一个模型超了DeepSeek R1、V3,参数671B,成本不到350万美元

  Deep Cogito,一家鲜为人知的 AI 初创公司,总部位于旧金山,由前谷歌员工创立,如今开源的四款混合推理模型,受到大家广泛关注。   Deep Cogito...

寒武纪、海光信息领涨,多家AI芯片厂商已适配DeepSeek模型

寒武纪、海光信息领涨,多家AI芯片厂商已适配DeepSeek模型

  22日多只算力领域个股开盘大涨。截至发稿,晶圆代工厂商中芯国际盘中涨6.29%,芯片定制和半导体IP授权服务厂商芯原股份涨5.39%。AI算力相关的个股中,海光信息涨17.19%,中科...

没有商业模式--DeepSeek最坚固的“护城河”

没有商业模式--DeepSeek最坚固的“护城河”

  在全球AI巨头都被资本裹挟着必须赚钱的时候,DeepSeek是唯一一个可以不计成本、不看脸色、只为AGI梦想狂奔的“自由人”。幻方量化(去年回报率53%)超级“印钞机”兜底之下,Dee...