当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek发布新一代AI模型:推理更强,使用成本降一半

  中国人工智能开发商 DeepSeek 推出了一款实验性大型语言模型(LLM),号称在训练与推理能力上有显著提升,并能以更低的成本运行。

  总部位于杭州的DeepSeek表示,该模型采用 稀疏注意力(sparse attention) 技术,使得API(应用程序接口)调用价格可降低一半。API是企业和开发者接入AI模型的主要方式,按使用次数或调用量付费。

  DeepSeek在开发者社区 Hugging Face 上发布文章称,这款新模型是其“下一代AI产品线的重要进展”。

  随着国内外竞争日益激烈,中国科技企业正不断升级自研大模型。就在上周,巴巴推出了其迄今规模最大、功能最强的新一代旗舰模型。

  事实上,谷歌与OpenAI等国际巨头早在2019年就探索过稀疏注意力技术。OpenAI当时指出,对于超大规模输入,完整的注意力矩阵计算成本过高deepseek,而“稀疏模式”可通过只关注部分关键输入,大幅提高效率。

  DeepSeek在随新模型发布的论文中介绍称,该模型采用了 “闪电索引器(lightning indexer)” 与 “精细化的token选择机制”,确保注意力计算仅应用于最相关的token。

  值得注意的是,华为云已在周一晚间发文确认,已“快速完成”对 DeepSeek-V3.2-Exp 模型的适配工作。

  目前,DeepSeek的V3.1版本与阿里巴巴的通义千问Qwen3系列,在人工智能分析平台的全球LLM排名中位列中国前两名,仅次于OpenAI、xAI与Anthropic等国际厂商。原文出处:DeepSeek发布新一代AI模型:推理更强,使用成本降一半,感谢原作者,侵权必删!

标签: deepseek

“DeepSeek发布新一代AI模型:推理更强,使用成本降一半” 的相关文章

清华学者Nature Medicine发文:DeepSeek狂奔,已在近800家

清华学者Nature Medicine发文:DeepSeek狂奔,已在近800家

  DeepSeek-R1 成为美国苹果应用商店下载量最高的聊天机器人,超越了 OpenAI 的 ChatGPT。与相比,DeepSeek-R1 在效率、成本和透明度方面具有优势,一度导致...

汤道生:腾讯是最早拥抱DeepSeek的,背后是基于用户诉求

汤道生:腾讯是最早拥抱DeepSeek的,背后是基于用户诉求

  新浪科技讯 9月17日午间消息,2025年腾讯全球数字生态大会上,腾讯集团高级执行副总裁、云与智慧产业事业群CEO汤道生分享了订阅制模式对于云厂商未来的商业发展的看法。...

达嘉维康:公司现有业务板块暂未接入DeepSeek、ChatGPT端口

达嘉维康:公司现有业务板块暂未接入DeepSeek、ChatGPT端口

  金融界8月25日消息,有投资者在互动平台向达嘉维康提问:“请问董秘,贵公司有没有应用到人工智能技术,有没有接入应用到相关的大模型,比如deepseek,chatgpt?”...

华为云发布企业级智能体平台Versatile,打造Agent全链条技术底座

华为云发布企业级智能体平台Versatile,打造Agent全链条技术底座

  9月19日,华为常务董事、华为云计算CEO张平安在华为全联接大会2025上正式发布企业级智能体平台Versatile,该平台通过极简流程实现企业级Agent生成——仅需输入业务逻辑描述...

DeepSeek线上模型版本升级至V3.1

DeepSeek线上模型版本升级至V3.1

  8月19日,澎湃新闻记者获悉deepseek,DeepSeek线上模型版本已升级至 V3.1,上下文长度拓展至 128k,用户可前往官方网页、APP、小程序测试,API 接口调用方式保...

HLE首次突破60分!Eigen-1基于DeepSeek V3.1领先GPT-5

HLE首次突破60分!Eigen-1基于DeepSeek V3.1领先GPT-5

  就在最近,由耶鲁大学唐相儒、王昱婕,上海交通大学徐望瀚,UCLA万冠呈,牛津大学尹榛菲,Eigen AI金帝、王瀚锐等团队联合开发的   最令人振奋的是,这一成就并非...