当前位置:首页 > Deepseek最新资讯 > 正文内容

百度发布两款大模型,对标DeepSeek、聚焦多模态

15小时前Deepseek最新资讯34

3月16日,在文心一言正式发布两周年后,百度发布了多模态大模型文心4.5和对标DeepSeek的文心X1。

今日文心大模型4.5在百度智能云千帆大模型平台上线,输入价格为0.004元/千tokens;文心大模型X1输入价格0.002元/千tokens,为DeepSeek R1一半。

百度曾是国内最早一批发布大模型的厂商之一,在过去两年时间里,大模型领域国内大模型赛道竞争异常激烈,DeepSeek-R1以颠覆性姿态“杀”了进来,其开源+低价策略引发的"鲇鱼效应",迫使全球大模型厂商重新校准竞争维度。第一财经记者了解到,李彦宏在今年内部讲话中透露,百度将于下半年发布文心大模型的5.0版本,并加大AI应用商业化实践。接下来,百度还将在6月30日正式将文心大模型开源。

今日上午记者体验了百度原生多模态大模型文心4.5,用户可上传包括文档、图片、音频、视频的文件,让AI进行解读。记者上传了一张《哪吒》电影视频截图,就此询问文心4.5,但AI没能给出正确答案,而是称这是来自迪士尼动画电影《公主与青蛙》中的场景。不过在逻辑测试中,AI能准确识别脑筋急转弯的陷阱并给出回答,针对数学物理题、益智问答基本能给出准确回答。

文心大模型X1为深度思考模型,运用到的关键技术包括递进式强化学习、基于思维链和行动链的端到端训练、多元统一的奖励系统等,百度称在性能上对标DeepSeek-R1,具备“长思维链”。记者体验看到,除了联网搜索外,增加了多模态能力和多工具调用,能理解和生成图片,调用工具生成代码、图表等。目前DeepSeek-R1支持上传的附件仅识别文字。

在文本创作上,过去文心4.0的观点较为“端水”,4.5擅长写“锐评”;在图片理解方面,当记者再次拿出《哪吒》电影截图考考X1时,AI给出的答案是《快乐池塘》。记者在进一步的对话中告诉X1答错了,这是电影《哪吒》 场景后,AI表示感谢指正,经过分析后表示提供的图片场景确实出自电影《哪吒》。事实上AI每次错误都在拓宽技术边界,它的视觉理解也将在"犯错-修正"的螺旋中不断改进。

随着人工智能技术从基础问答向复杂推理跃迁,除了百度外,近期包括阿里旗下AI应用夸克、字节旗下豆包、腾讯混元等都陆续上线了“深度思考”功能。这也意味着生成式AI的竞争已从早期的信息整合、简单逻辑推导转向“认知重构”,试图让AI突破表层语义匹配,建立因果推理、价值判断及跨领域知识迁移能力。这种竞争不仅体现在模型性能上,各家更通过云计算捆绑、行业解决方案等生态卡位争夺B端市场。

(本文来自第一财经)


“百度发布两款大模型,对标DeepSeek、聚焦多模态” 的相关文章

清华免费发布DeepSeek入门手册遭网店打印兜售,团队回应

清华免费发布DeepSeek入门手册遭网店打印兜售,团队回应

近日,清华大学新闻与传播学院新媒体研究中心元宇宙文化实验室团队免费发布的《DeepSeek 从入门到精通》电子文档引发了网友的广泛关注。然而,某电商平台上随后出现出售的打印版,价格超过13元/本,引发...

全国首个!东胜一卫生院接入DeepSeek

全国首个!东胜一卫生院接入DeepSeek

东胜区罕台中心卫生院与国内领先的AI大模型场景落地企业百沐数智达成战略合作正式接入DeepSeek-R1“满血版”大模型成为全国首个将大模型技术应用于基层医疗服务场景的医疗机构东胜区罕台中心卫生院通过...

从Deepseek谈东方数理哲学与AI新文明

从Deepseek谈东方数理哲学与AI新文明

2 月 28 日下午,由北京市社会组织党建联合会与中关村超互联新基建产业创新联盟联合主办的 “从Deepseek谈东方数理哲学与AI新文明范式” 交流会在北京成功举办。此次活动汇聚了人工智能、传统文化...

破!DeepSeek引发中国资产重估,后劲还有多大?

破!DeepSeek引发中国资产重估,后劲还有多大?

近期,资金持续加仓港股态势显著。2月18日,恒生科技指数继续上涨2%至5609.27点。上周,恒生科技指数大涨7.3%,在冲破去年10月的高位之后,创约3年来的收市新高。多只港股科技股近日已经突破去年...

中国港口接入DeepSeek以提升运营效率

中国港口接入DeepSeek以提升运营效率

海外网2月21日电据香港《南华早报》2月20日报道,中国人工智能企业深度求索的大语言模型DeepSeek正在赋能中国各行业和关键基础设施。报道称,中国三大港口已陆续实施或计划接入DeepSeek,以提...

中国多地政务服务系统接入DeepSeek效率大增

中国多地政务服务系统接入DeepSeek效率大增

考消息网2月20日报道据台湾“中央社”2月19日报道,深度求索(DeepSeek)推出低成本且高效的大型语言模型掀起热潮,中国多地相继宣布政务服务系统接入应用,称可以大幅提升工作效率。以往要花一天时间...