当前位置:首页 > Deepseek最新资讯 > 正文内容

叫板OpenAI,DeepSeek-V3.1正式发布

1周前 (08-21)Deepseek最新资讯76

  8月21日,DeepSeek 正式发布 V3.1版本,并将其称为“迈向 Agent 时代的*步”。与以往的大模型迭代不同,它*的特征是混合推理架构,一个模型同时支持思考模式与非思考模式。这意味着模型在保持性能稳定的同时,能够根据需求选择是快速给出答案,还是展开更长链路的推理。

  更重要的是,经过思维链压缩训练,新版模型在生成结果时的token数量减少了20%至50%(同前代模型DeepSeek-R1-0528相比),这不仅带来响应速度的提升,也直接降低了使用成本。

  配合128K的上下文扩展和FP8精度推理,V3.1在工程层面强化了吞吐效率与能耗表现,为大规模应用打下基础。

  除了推理效率上的改进,V3.1在智能体能力上的进化尤为关键。官方测试显示,在代码修复和命令行任务等编程智能体场景中,新模型展现出更强的执行力和稳定性,能够在真实环境中完成多轮迭代修正,避免“越改越乱”的问题。

  在复杂搜索任务上,V3.1则展现了更成熟的检索与整合能力,它可以规划搜索步骤、筛选证据并综合多源信息,在高难度的多学科题目测试中,性能已经远超前代模型。

  在商业与生态层面,DeepSeek 选择了“双轨”策略deepseek,一方面继续提供 API 服务,但将于9月6日起调整价格并取消夜间优惠;另一方面,V3.1的Base模型与后训练版本已在Hugging Face和魔搭同步开源。

  值得一提的是,在这一次的官方发布说明中,DeepSeek提到“V3.1使用了 UE8M0 FP8 Scale的参数精度”,更为通俗的说,它设置了一个适配于即将发布的新一代国产芯片的技术规范与设计标准。“建议有部署需求的用户仔细阅读新版说明文档。”而在此之前,国产芯片部署DeepSeek通常会有一定性能减弱,除非再做专门的软件适配。

  本次DeepSeek-V3.1的发布也似有与GPT5对垒的意味,都支持超长上下文,都有更强的复杂任务处理能力,基础模型调用更为灵活,成本更为弹性。原文出处:叫板OpenAI,DeepSeek-V3.1正式发布,感谢原作者,侵权必删!

标签: deepseek

“叫板OpenAI,DeepSeek-V3.1正式发布” 的相关文章

对话中关村科金总裁喻友平:DeepSeek热潮之后,To B需求正回归理性

对话中关村科金总裁喻友平:DeepSeek热潮之后,To B需求正回归理性

  过去两年,大模型在中国经历了从技术快速突破到产业加速落地的转折。资本和算力的集中投入推动了模型能力的提升,但真正进入企业日常并产生持续价值的,还取决于在具体行业场景中的应用深度。金融、...

DeepSeek服务今日突发大规模中断,技术升级遇流量峰值致宕机

DeepSeek服务今日突发大规模中断,技术升级遇流量峰值致宕机

  截至今日(2025年8月11日),DeepSeek服务确实出现大规模中断,引发大量用户集中反馈。以下是综合整理的关键信息与建议:   网传DeepSeek-R2(性能...

第三届北京交叉科学大会“人工智能时代的场所精神”论坛在京举行

第三届北京交叉科学大会“人工智能时代的场所精神”论坛在京举行

  8月23日,由北京交叉学会与泛华集团低碳设计研究院联合主办的“人工智能时代的场所精神”前沿交叉论坛在北京成功举行。   泛华建设集团董事长杨天举,中国女医师协会副会长...

C罗香港比赛 到底哪里还有票😫 想要官方票1990 2490 2990都可以

C罗香港比赛 到底哪里还有票😫 想要官方票1990 2490 2990都可以

  主要去年就是这么搞的,最后还来不了了,不过其实也是一种卖票的手段,正常操作,之前抖音还直播卖票来着,虎扑应该可以搜到,我没截图   主要去年就是这么搞的,最后还来不了...

Deepseek推荐全国旅游百强县市第97名:宁夏贺兰县

Deepseek推荐全国旅游百强县市第97名:宁夏贺兰县

  日前,全国县镇发展研究课题组、天和经济研究所县镇发展研究院联合发布了2024《全国县镇发展报告》,报告评价篇对全国县市以及包含乡村人口的市辖区旅游发展水平进行了综合评价,并发布了天和2...

党建引智入基层,AI惠民暖民心

党建引智入基层,AI惠民暖民心

  7月8日-11日,广东工业大学“数智燎原”社会实践队赴广东省湛江市吴川市,开展以“科技不再是高高在上,而是服务于每一个人”为主题的“三下乡”社会实践活动。实践队不仅深入苏村等多个村委会...