当前位置:首页 > DeepSeek技术交流 > 正文内容

文心大模型X1对上最新版DeepSeek V3,表现谁更好?

1年前 (2025-03-27)DeepSeek技术交流645

3月26日,在多个公开数据集测评中,百度最新发布的文心大模型X1,在数学、代码、推理等能力上表现优异,超越升级后的DeepSeek-V3-0324。

在数学场景中,GSM8K数据集测试后结果显示,文心X1得分95.6,DeepSeek-V3-0324得分93.6;代码生成层面,HumanEval数据集测试后结果显示,文心X1得分90.9,DeepSeek-V3-0324得分86.6;在知识推理层面,C-Eval数据集测试后结果显示,文心大模型X1得分88.6,DeepSeek-V3-0324得分85.1。

近日,DeepSeek官方宣布V3模型完成小版本升级的消息,包括推理、前端开发、中文写作、中文搜索几个方面的能力优化。

而在不久前,百度正式发布文心大模型X1,具备更强的理解、规划、反思、进化能力。文心X1由百度的慢思考技术发展而来。作为能力更全面的深度思考模型,兼备准确、创意和文采,在中文知识问答、文学创作、文稿写作、日常对话、逻辑推理、复杂计算及工具调用等方面表现尤为出色。

据悉,文心大模型X1即将上线千帆大模型平台,API调用价格为DeepSeek-R1调用价格的50%。


“文心大模型X1对上最新版DeepSeek V3,表现谁更好?” 的相关文章

深度解析:DeepSeek揭示7大时间浪费行为,助你高效管理时间

深度解析:DeepSeek揭示7大时间浪费行为,助你高效管理时间

时间是人生最宝贵的资源,浪费时间等同于慢性自杀。DeepSeek通过大数据分析,揭示了生活中最严重的7大时间杀手,帮助我们深刻反思,重新掌控生活节奏。第一,垃圾娱乐如游戏和短视频虽然短暂放松,但长期沉...

国家知识产权局:驳回63枚恶意抢注的DeepSeek商标

国家知识产权局:驳回63枚恶意抢注的DeepSeek商标

大象新闻记者 王瑞麟2月24日,据国家知识产权局发文,近期,杭州深度求索人工智能基础技术研究有限公司研发的DeepSeek人工智能大模型在全球范围内引发了广泛关注。个别企业和自然人以社会公众普遍知悉的...

​快手可灵AI已全面接入DeepSeek-R1

​快手可灵AI已全面接入DeepSeek-R1

快手可灵AI已全面接入DeepSeek-R1。在视频生成、图片生成等场景下,用户可通过DeepSeek协助生成或者优化提示词。在文生视频场景下,DeepSeek灵感版还可以和此前的“灵感词库”功能联动...

锚定“技术+场景”融合|中国电信新疆吐鲁番分公司成功举办DeepSeek大模型应用交流论坛

锚定“技术+场景”融合|中国电信新疆吐鲁番分公司成功举办DeepSeek大模型应用交流论坛

当DeepSeek大模型技术遇上丝绸之路明珠,会碰撞出怎样的火花?近日,中国电信新疆吐鲁番分公司以“智创未来·共赢发展”为主题,成功举办DeepSeek人工智能大模型交流论坛。活动汇聚各单位机构、行业...

DeepSeek火了,淘金者失落,卖铲者狂欢

DeepSeek火了,淘金者失落,卖铲者狂欢

今天凌晨,亚马逊云科技宣布在Amazon Bedrock平台上推出全托管、无服务器的DeepSeek-R1模型,是首个提供DeepSeek-R1作为全托管、正式商用模型的海外云厂商。所以,对于出海企业...

新华网:可提供基于Deepseek模型的训练推理服务

新华网:可提供基于Deepseek模型的训练推理服务

金融界3月26日消息,有投资者在互动平台向新华网提问:Deepseek释放了算力需求,贵公司算力情况如何?公司回答表示:新华AIGC应用使能平台的高弹性算力包产品,可以为客户提供低成本普惠的算力资源,...