当前位置:首页 > DeepSeek技术交流 > 正文内容

新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练

1年前 (2025-03-26)DeepSeek技术交流581

明敏 发自 凹非寺

量子位 | 公众号 QbitAI

刚刚,DeepSeek官方发布DeepSeek-V3模型更新技术报告。

V3新版本在数学、代码类相关评测集成绩超过GPT-4.5!

而且这只是通过改进后训练方法实现。

DeepSeek-V3-0324和之前的DeepSeek-V3使用同样的base模型。

打破了之前传言该版本base模型是R2的传言。

新版本参数量约为660B,与此前网传的685B有所出入。

开源版本上下文长度为128K(网页端、App和API提供 64K 上下文)。

私有化部署时只需要更新checkpoint和tokenizer_config.json(tool calls相关变动)。

目前,想要体验这一版本模型,只需用户登录官方网页、APP、小程序进入对话界面后,关闭深度思考即可体验。API 接口和使用方式保持不变。

官方建议,此后非复杂推理任务使用V3新版本更好。

此外,官方还进一步展示了新版本在各个维度的能力。

前端开发

生成代码可用性更高,视觉效果也更好。

中文写作

相较于R1版有进一步优化,特别提升了中长篇的内容质量。

比如写一篇关于苏轼生平的散文:

中文搜索

联网情况下,V3新版本的搜索输出内容也更详实准确、排版更清晰美观。

现在写一份3000字的市场报告也是so easy(上下滑动查看完整内容):

此外,V3新版本在工具调用、角色扮演、问答闲聊等方面也进一步提升。

今天白天不少网友也上手实测了诸多能力,比如做个小游戏:

该版本模型采用宽松的MIT开源协议。

且可直接部署在M3 Ultra的Mac Studio上。

这意味着大模型开发应用的门槛更进一步降低。

话不多说,趁着深夜,还没睡的赶紧去体验最新版吧~


原标题:《新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练》


“新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练” 的相关文章

全民AI启蒙之后,DeepSeek向产业纵深处走去

全民AI启蒙之后,DeepSeek向产业纵深处走去

“DeepSeek比过去两年多以来,全行业对于用户的教育都要更加有效。”近日,谈及DeepSeek带来的变化,OPPO ColorOS系统设计总监陈希对第一财经感慨,一夜之间几乎全民都知道了什么是大模...

DeepSeek-V3击败R1开源登顶!杭州黑马撼动硅谷抹去1万亿市值神话

DeepSeek-V3击败R1开源登顶!杭州黑马撼动硅谷抹去1万亿市值神话

【新智元导读】DeepSeek又卷起来了!上周刚出的DeepSeek-V3-0324在大模型竞技场排名中,打败了自己的DeepSeek-R1,成为开源AI至尊。DeepSeek依然很能打,春节余波还在...

鹰潭公司:开展Deepseek应用培训 推动AI技术与业务融合

鹰潭公司:开展Deepseek应用培训 推动AI技术与业务融合

5月21日,鹰潭公司组织召开Deepseek应用培训,鹰潭公司董事长汪斌等参加。培训内容涵盖基础原理、实际应用案例,并特别设置了AI技术实操演练环节,让学员们更加直观地掌握了工具使用技巧。此次培训内容...

官宣!海信电视正式接入DeepSeek

官宣!海信电视正式接入DeepSeek

2月11日,海信电视宣布正式接入DeepSeek,并支持满血R1和V3版本自由切换,成为行业首个搭载深度思考智能体的电视品牌。目前,海信电视正在进行用户终端的升级发布,预计3-5天内,所有搭载智能体的...

黄仁勋如何抗过DeepSeek冲击?

黄仁勋如何抗过DeepSeek冲击?

摘要:除了核心业务外,英伟达几乎不为任何事分心。4月13日,华尔街日报发文,人工智能基础设施领域的王者英伟达似乎无处不在,人们很容易将成功原因归结为该公司掌握的强大技术。但它广泛的影响力也反映出一种商...

概念动态|恒润股份新增“DeepSeek概念”

概念动态|恒润股份新增“DeepSeek概念”

2025年4月2日,恒润股份(603985)新增“DeepSeek概念”。据同花顺数据显示,入选理由是:2025年3月18日闰六尺微信公众号发布,公司自主研发的DeepSeek大模型一体机:"...