当前位置:首页 > Deepseek最新资讯 > 正文内容

性能大幅领先R1!DeepSeek V3.1免费上线官网和App:回答更快

1周前 (08-21)Deepseek最新资讯74

  据介绍,DeepSeek-V3.1具备128K超长上下文处理能力,支持混合推理架构(一个模型同时支持思考模式与非思考模式)。

  不仅如此,DeepSeek-V3.1拥有更强的Agent(智能体)能力,通过Post-Training(后训练)优化,新模型在工具使用与智能体任务中的表现有较大提升。

  比如,在代码修复测评SWE与命令行终端环境下的复杂任务(Terminal-Bench)测试中,以及在需要多步推理的复杂搜索测试(browsecomp)与多学科专家级难题测试(HLE)上,DeepSeek-V3.1均大幅领先DeepSeek-R1-0528。

  另外,DeepSeek-V3.1思考效率提升有了巨幅提升。经过思维链压缩训练后,V3.1-Think在输出token数减少20%-50%的情况下deepseek,各项任务的平均表现与R1-0528 持平。

  对于DeepSeek R2发布延迟的原因,DeepSeek总结称,主要由于采用国产昇腾芯片进行训练时遇到技术挑战,以及公司对模型质量的高标准要求。虽然之前有8月发布的传闻,但已被官方否认。目前看来,我们可能需要再等待几周的时间,但具体日期还需以官方消息为准。原文出处:性能大幅领先R1!DeepSeek V3.1免费上线官网和App:回答更快,感谢原作者,侵权必删!

标签: deepseek

“性能大幅领先R1!DeepSeek V3.1免费上线官网和App:回答更快” 的相关文章

[流言板]杨幂用华为Pura X晒自拍,谐音梗祝福鸿蒙5终端数破1000万

[流言板]杨幂用华为Pura X晒自拍,谐音梗祝福鸿蒙5终端数破1000万

  随后,演员杨幂使用华为Pura X发布自拍,并配文“你负责‘红’,我负责‘萌’。”用谐音梗为鸿蒙送上祝福。   据了解,华为Pura X是首款全面搭载鸿蒙5的手机,已...

打造多元AI算力,推动实现算力普惠 全栈AI,让AI成为创新生产力

打造多元AI算力,推动实现算力普惠 全栈AI,让AI成为创新生产力

  8月23日,2025中国算力大会在山西大同举办。联想集团副总裁、中国基础设施业务群总经理陈振宽受邀在主论坛发表《联想全栈AI 让AI成为创新生产力》主旨演讲,分享了联想八年来在智能化转...

科技人才济济的印度,为何搞不出英伟达和DeepSeek?

科技人才济济的印度,为何搞不出英伟达和DeepSeek?

  英国《金融时报》日前的一篇报道,曾发出了一个疑问——印度作为全球顶尖科技人才的“摇篮”,为硅谷输送了无数精英工程师,为何却未能在本土培育出像英伟达或中国DeepSeek这样的尖端科技企...

亚洲杯即将来袭!快来评选你心中中国男篮现役最佳阵容

亚洲杯即将来袭!快来评选你心中中国男篮现役最佳阵容

  中国男篮即将奔赴沙特,征战8月5日开打的男篮亚洲杯。此次出征的队员共有14名,包括胡金秋、胡明轩、赵睿、程帅澎、朱俊龙、赵嘉义、廖三宁、余嘉豪、雷蒙、王俊杰、徐杰、高诗岩、李祥波、张宁...

DeepSeek突传重磅!寒武纪20CM涨停,成交额超138亿元

DeepSeek突传重磅!寒武纪20CM涨停,成交额超138亿元

  今日,半导体芯片股和人工智能概念股集体大爆发,寒武纪20CM涨停,成交额超138亿元,上海合晶更是20%涨停。这一切的背后,似乎与DeepSeek-R2的发布传闻紧密相关。据市场消息,...

DeepSeek母公司陷1.18亿返佣大案!

DeepSeek母公司陷1.18亿返佣大案!

  国内顶级量化私募机构幻方量化陷入一场牵涉金额高达1.18亿元的返佣案件。此案涉及幻方量化市场总监李橙deepseek,时间跨度长达六年。案件曝光后,幻方量化作为大模型DeepSeek的...