当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek发布V3.1版本,专为国产芯片优化,支持双模式推理架构

1年前 (2025-08-21)Deepseek最新资讯522

  8月21日,DeepSeek正式发布其最新版本DeepSeek-V3.1,该版本采用了UE8M0 FP8 Scale的参数精度。据悉,这一技术规格专门为即将发布的下一代国产芯片进行优化设计。

  新版本在技术架构方面实现重要突破,引入了混合推理架构设计。该架构允许单一模型同时支持思考模式与非思考模式两种运行状态。用户可通过官方应用程序或网页端的深度思考按钮自由切换不同模式。

  与此同时,V3.1版本在运行效率方面取得显著提升。相比前代DeepSeek-R1-0528,新版本能够在更短时间内提供响应结果。通过思维链压缩训练技术,模型在输出token数量减少20%至50%的情况下,仍能保持相同的任务表现水平。

  在智能体能力方面,V3.1通过后训练优化实现了质的飞跃。新模型在工具使用、编程任务以及复杂搜索等智能体相关任务中表现获得较大幅度提升。在代码修复测评SWE与命令行终端环境测试中,该模型展现出更强的处理能力。

  技术规格方面,V3.1版本将上下文窗口扩展至128K,并新增对Anthropic API格式的支持。API接口同步升级deepseek,提供deepseek-chat与deepseek-reasoner两个不同接口,分别对应非思考模式和思考模式。

  值得注意的是,V3.1对分词器及chat template进行了较大调整,与DeepSeek-V3存在明显差异。这些调整旨在更好地适配即将推出的国产芯片硬件环境。

  官方应用程序与网页端模型已同步升级为DeepSeek-V3.1版本。据了解,公司计划于2025年9月6日起执行新的API定价方案并取消夜间优惠政策。原文出处:DeepSeek发布V3.1版本,专为国产芯片优化,支持双模式推理架构,感谢原作者,侵权必删!

标签: deepseek

“DeepSeek发布V3.1版本,专为国产芯片优化,支持双模式推理架构” 的相关文章

工信部:DeepSeek、通义千问等国产大模型引领全球开源创新生态

工信部:DeepSeek、通义千问等国产大模型引领全球开源创新生态

  【工信部:DeepSeek、通义千问等#国产大模型引领全球开源创新生态#】据中国网,工信部副部长张云明在国新办新闻发布会上表示,“十四五”期间,我国人工智能企业数量和产业规模持续增长,...

11月5日 DeepSeek预测 雷霆vs快船:西部榜首大战,亚历山大率队冲击八

11月5日 DeepSeek预测 雷霆vs快船:西部榜首大战,亚历山大率队冲击八

  11月5日中午12点,NBA常规赛将迎来一场焦点对决——西部第一的雷霆(7胜0负)客场挑战洛杉矶快船(3胜3负)。作为联盟目前唯一保持全胜的球队,雷霆若能延续状态,将创造队史最佳开局纪...

128TOPS媲美256TOPS体验!轻舟智航单芯片城市NOA方案正式上车

128TOPS媲美256TOPS体验!轻舟智航单芯片城市NOA方案正式上车

  1月23日,在QCraft DAY 2026活动上deepseek,轻舟智航宣布行业首个基于地平线单征程6M芯片的城市NOA方案实现量产上车,首发搭载车型为理想L系列智能焕新版AD P...

AI算力国产化再添标杆,核心成果入选服贸会北京方案

AI算力国产化再添标杆,核心成果入选服贸会北京方案

  当前,人工智能正从技术突破迈向规模化应用,算力统筹、算法创新与数据流通构成产业发展的核心三角,智能算力需求呈指数级增长。   配套政策持续细化落地:《算力基础设施高质...

当我问deepseek,中国女排如何在洛杉矶奥运会夺冠,回答太犀利!

当我问deepseek,中国女排如何在洛杉矶奥运会夺冠,回答太犀利!

  中国女排若要在2025年洛杉矶奥运会中实现突破,需直面当前结构性困境,摒弃“粉饰太平”的惯性思维,以系统性改革应对以下核心挑战:   蔡斌的局限性:蔡斌执教能力虽可保...

青春在代码中闪光 匠心在实战中成长——成都市新都区烟草专卖局(分公司)青年人才培

青春在代码中闪光 匠心在实战中成长——成都市新都区烟草专卖局(分公司)青年人才培

  早上8点,成都市新都区烟草专卖局(分公司)营销办公室已传出键盘敲击声。青年员工帅怡帆正和团队调试新开发的数据分析模块,这是他们针对卷烟营销开发的智慧服务系统。“如果系统上线,客户经理查...