当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek发布新一代AI模型:推理更强,使用成本降一半

11个月前 (09-30)Deepseek最新资讯422

  中国人工智能开发商 DeepSeek 推出了一款实验性大型语言模型(LLM),号称在训练与推理能力上有显著提升,并能以更低的成本运行。

  总部位于杭州的DeepSeek表示,该模型采用 稀疏注意力(sparse attention) 技术,使得API(应用程序接口)调用价格可降低一半。API是企业和开发者接入AI模型的主要方式,按使用次数或调用量付费。

  DeepSeek在开发者社区 Hugging Face 上发布文章称,这款新模型是其“下一代AI产品线的重要进展”。

  随着国内外竞争日益激烈,中国科技企业正不断升级自研大模型。就在上周,巴巴推出了其迄今规模最大、功能最强的新一代旗舰模型。

  事实上,谷歌与OpenAI等国际巨头早在2019年就探索过稀疏注意力技术。OpenAI当时指出,对于超大规模输入,完整的注意力矩阵计算成本过高deepseek,而“稀疏模式”可通过只关注部分关键输入,大幅提高效率。

  DeepSeek在随新模型发布的论文中介绍称,该模型采用了 “闪电索引器(lightning indexer)” 与 “精细化的token选择机制”,确保注意力计算仅应用于最相关的token。

  值得注意的是,华为云已在周一晚间发文确认,已“快速完成”对 DeepSeek-V3.2-Exp 模型的适配工作。

  目前,DeepSeek的V3.1版本与阿里巴巴的通义千问Qwen3系列,在人工智能分析平台的全球LLM排名中位列中国前两名,仅次于OpenAI、xAI与Anthropic等国际厂商。原文出处:DeepSeek发布新一代AI模型:推理更强,使用成本降一半,感谢原作者,侵权必删!

标签: deepseek

“DeepSeek发布新一代AI模型:推理更强,使用成本降一半” 的相关文章

基于DeepSeek的证券业AI Agent平台分析与实践

基于DeepSeek的证券业AI Agent平台分析与实践

  当前,无疑正处于AIGC应用的拐点时刻。一方面,DeepSeek的性能已经达到高智商人类的水平,许多此前由于基础能力不足而无法实现的场景,如今得以落地。另一方面,开源的出现使得券商行业...

聚焦高质量发展

聚焦高质量发展

  智绘绿洲亮相WAIC大会 诠释智算产业新内涵...

DeepSeek-V3.1发布版本更新

DeepSeek-V3.1发布版本更新

  新京报贝壳财经讯(记者罗亦丹)9月22日21时15分,DeepSeek在官方微信公号发文称,DeepSeek-V3.1 现已更新至 DeepSeek-V3.1-Terminus 版本。...

从GPT-5到DeepSeek V3.1,顶尖AI大模型的新方向出现了!

从GPT-5到DeepSeek V3.1,顶尖AI大模型的新方向出现了!

  从美团最新开源的龙猫大模型,到OpenAI下一代旗舰GPT-5和明星创业公司DeepSeek的新品,顶尖玩家们不约而同地将目光投向了“混合推理”与“自适应计算”,  ...

Deepseek母公司幻方量化返佣门:6年1亿佣金黑洞,牵出招商证券财富管理部原

Deepseek母公司幻方量化返佣门:6年1亿佣金黑洞,牵出招商证券财富管理部原

  相较于主动管理的权益产品,量化私募最明显的特征就是短线交易频繁,大量交易通过博取时间差获得收益,虽然单笔收益不高,但是巨量高频交易过程中,也产生巨额利润。在高频策略还未被监管降频降速的...

[流言板]男篮热身赛:古德温22分10助攻,卡塔尔男篮不敌日本男篮

[流言板]男篮热身赛:古德温22分10助攻,卡塔尔男篮不敌日本男篮

  虎扑07月31日讯 据媒体人三土带刺分享,日本男篮亚洲杯前的倒数第二场热身,在多哈103-92击败卡塔尔。   球员方面,西田优大21分6篮板3助攻(三分球7中6),...