当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek开源新基础模型,但不是V4,而是V3.1-Base

6小时前Deepseek最新资讯32

  昨晚,深度求索在用户群里宣布「DeepSeek 线上模型版本已升级至 V3.1,上下文长度拓展至 128k」并更新了 UI (去掉了 DeepThink 旁的 R1 标示)之后deepseek,在 Hugging Face 发布了一款新模型

  从名字也能看出来,该模型是 DeepSeek-V3 系列最新的基础模型。至于为什么命名为 V3.1,而不是像之前以前命名为 V3 带四位日期数字的形式(如 V3-0324),尽管社区有诸多猜测,但深度求索官方尚未给出明确说明 —— 和该公司之前的操作一样,这一次同样是模型先行,说明和宣传还在后面。

  该模型一发布就吸引了 AI 社区的广泛关注,短短几个小时就已经冲上了 Hugging Face 热门模型榜第 4 位!

  整体来看,社交网络上对深度求索的这次更新看法不一。有人表示非常振奋,认为这是深度求索在为接下来的 DeepSeek-V4 和 DeepSeek-R2 做铺垫,但也有人认为这次更新不够亮眼,没有达到该公司之前的一贯水准。原文出处:DeepSeek开源新基础模型,但不是V4,而是V3.1-Base,感谢原作者,侵权必删!

标签: deepseek

“DeepSeek开源新基础模型,但不是V4,而是V3.1-Base” 的相关文章

DeepSeek公司要上市了?知情人士回应

DeepSeek公司要上市了?知情人士回应

  《辟谣财知道》注意到,近期一则关于DeepSeek(深度求索)公司上市的消息出现在诸多权威的新闻网站。   版本一是DeepSeek准备科创板上市,于7月18日发布。...

突破性进展!国际首台,“悟空”研制成功

突破性进展!国际首台,“悟空”研制成功

  8月2日,浙江大学脑机智能全国重点实验室发布新一代神经拟态类脑计算机—Darwin Monkey(以下简称“悟空”)。“悟空”支持的脉冲神经元规模超过20亿,神经突触超过千亿,其神经元...

小摩:AI和DeepSeek的崛起提升三大电讯商潜力 首选中国电信

小摩:AI和DeepSeek的崛起提升三大电讯商潜力 首选中国电信

  摩根大通发布研报称,中国电讯业营运商的股价在2019年至2024年间表现超过恒指,差距达到双位数,而本年迄今的表现优于市场deepseek。该行指出,前三大电信营运商不仅提供具吸引力的...

陕西水电:实干作答“上半场” 五维聚力正当时

陕西水电:实干作答“上半场” 五维聚力正当时

  上半年,陕西水电在集团公司的坚强领导下,在清洁能源赛道上踔厉奋发,交出一份亮眼的“期中答卷”:发电量同比增长7.59%,营业收入同比增长2.99%,固定资产投资完成20.27亿元,同比...

聚焦高质量发展

聚焦高质量发展

  智绘绿洲亮相WAIC大会 诠释智算产业新内涵...

2025世界人工智能大会|中国铁塔展示“AI+行业应用”亮点特色

2025世界人工智能大会|中国铁塔展示“AI+行业应用”亮点特色

  指出“中国正在推进高水平对外开放,北电数智首次展示了基于“星火·政务底座”的“村落庄振兴幸福大模型”,这次WAIC,2025天下人工智能大会本周六在上海开幕。实现人工智能、大数据与村落...