当前位置：首页 > DeepSeek技术交流 > 正文内容

新版DeepSeek-V3官方报告出炉：超越GPT-4.5，仅靠改进后训练

6个月前 (03-26)DeepSeek技术交流378

明敏发自凹非寺

量子位 | 公众号 QbitAI

刚刚，DeepSeek官方发布DeepSeek-V3模型更新技术报告。

V3新版本在数学、代码类相关评测集成绩超过GPT-4.5！

而且这只是通过改进后训练方法实现。

DeepSeek-V3-0324和之前的DeepSeek-V3使用同样的base模型。

打破了之前传言该版本base模型是R2的传言。

新版本参数量约为660B，与此前网传的685B有所出入。

开源版本上下文长度为128K（网页端、App和API提供 64K 上下文）。

私有化部署时只需要更新checkpoint和tokenizer_config.json（tool calls相关变动）。

目前，想要体验这一版本模型，只需用户登录官方网页、APP、小程序进入对话界面后，关闭深度思考即可体验。API 接口和使用方式保持不变。

官方建议，此后非复杂推理任务使用V3新版本更好。

此外，官方还进一步展示了新版本在各个维度的能力。

前端开发

生成代码可用性更高，视觉效果也更好。

中文写作

相较于R1版有进一步优化，特别提升了中长篇的内容质量。

比如写一篇关于苏轼生平的散文：

中文搜索

联网情况下，V3新版本的搜索输出内容也更详实准确、排版更清晰美观。

现在写一份3000字的市场报告也是so easy（上下滑动查看完整内容）：

此外，V3新版本在工具调用、角色扮演、问答闲聊等方面也进一步提升。

今天白天不少网友也上手实测了诸多能力，比如做个小游戏：

该版本模型采用宽松的MIT开源协议。

且可直接部署在M3 Ultra的Mac Studio上。

这意味着大模型开发应用的门槛更进一步降低。

话不多说，趁着深夜，还没睡的赶紧去体验最新版吧~

原标题：《新版DeepSeek-V3官方报告出炉：超越GPT-4.5，仅靠改进后训练》

标签: DeepSeek 人工智能数据分析应用场景

返回列表

上一篇：DeepSeek V3再次震撼硅谷，中美AI差距突然缩至3个月！

下一篇：DeepSeek-V3升级：评测达75.9%正确率，代码生成提速40%

“新版DeepSeek-V3官方报告出炉：超越GPT-4.5，仅靠改进后训练” 的相关文章

零跑B10上市搭载DeepSeek+通义千问双模型

人民财讯4月10日电，4月10日，零跑汽车全新B系列首款全球化车型——零跑B10正式上市。新车共推出5款车型，包括510km和600km两种CLTC续航版本，官方指导价格区间为9.98万元至12.98...

天融信：公司已发布DeepSeek安全智算一体机

新京报贝壳财经讯（记者林子）2月28日，面对投资者询问公司日常是否会借助AI技术辅助工作，赛轮轮胎表示，公司积极探索AI等新技术在相关业务领域的应用，目前公司已私有化部署DeepSeek大模型，目前正...

腾讯、华为等接入DeepSeek每月亏损超4亿

钛媒体App 2月19日消息，近日，腾讯、百度、华为、阶跃星辰等多家AI大模型企业接入DeepSeek-R1模型，使得“DeepSeek朋友圈”企业超过100家。尽管DeepSeek R1模型具备训练...

梁文锋参与发表回顾性论文：DeepSeek首次揭秘V3模型背后扩展方案

DeepSeek刚刚发表了一篇名为《深入解读 DeepSeek-V3：AI 架构的扩展挑战与硬件思考》（Insights into DeepSeek-V3: Scaling Challenges an...

直击股东大会｜麒麟信安：2025年国防业务发展有所加快，希望利用DeepSeek一体机打开市场

5月21日下午，麒麟信安召开2024年年度股东大会，包括公司总经理、董秘等在内的高管参加并与投资者现场交流。据悉，麒麟信安2024年实现企稳回升，全年实现营业收入2.86亿元，同比增长75.24%；归...

如何找到并启用微信内的DeepSeek功能（附排查方法）

我的iOS微信和安卓微信都有接入DeepSeek的AI搜索功能，而且用了10多天，重度用户一枚。作为过来人，有必要给不知道的人分享下经验。一句话总结，微信内的DeepSeek功能有多个登入口，...

新版DeepSeek-V3官方报告出炉：超越GPT-4.5，仅靠改进后训练

“新版DeepSeek-V3官方报告出炉：超越GPT-4.5，仅靠改进后训练” 的相关文章

零跑B10上市搭载DeepSeek+通义千问双模型

天融信：公司已发布DeepSeek安全智算一体机

腾讯、华为等接入DeepSeek每月亏损超4亿

梁文锋参与发表回顾性论文：DeepSeek首次揭秘V3模型背后扩展方案

直击股东大会｜麒麟信安：2025年国防业务发展有所加快，希望利用DeepSeek一体机打开市场

如何找到并启用微信内的DeepSeek功能（附排查方法）

温馨提示：
DeepSeek爱好者为非盈利站点，所有内容均来自网络整理，不保证内容的真实性。

Powered By Z-BlogPHP. Theme by TOYEAN.

新版DeepSeek-V3官方报告出炉：超越GPT-4.5，仅靠改进后训练

“新版DeepSeek-V3官方报告出炉：超越GPT-4.5，仅靠改进后训练” 的相关文章

零跑B10上市 搭载DeepSeek+通义千问双模型

天融信：公司已发布DeepSeek安全智算一体机

腾讯、华为等接入DeepSeek每月亏损超4亿

梁文锋参与发表回顾性论文：DeepSeek首次揭秘V3模型背后扩展方案

直击股东大会｜麒麟信安：2025年国防业务发展有所加快，希望利用DeepSeek一体机打开市场

如何找到并启用微信内的DeepSeek功能（附排查方法）

Powered By Z-BlogPHP. Theme by TOYEAN.

零跑B10上市搭载DeepSeek+通义千问双模型