当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek发布开源周首个成果 可优化英伟达GPU效率

7个月前 (02-24)Deepseek最新资讯371

新京报贝壳财经讯(记者罗亦丹)北京时间2月24日上午,DeepSeek发布了其“开源周”的第一项成果:FlashMLA(直译为快速多头潜在注意力机制)的代码。


据了解,MLA(多头潜在注意力机制)正是DeepSeek降低大模型成本使用的关键技术之一,其可以显著减少大模型训练和推理过程中的内存占用,而FlashMLA则是针对Hopper GPU(一种英伟达GPU架构)开发的高效MLA解码内核,其针对可变长度序列进行了优化,目前已投入了生产,其可以使得H800达到3000GB/s内存,实现580TFLOPS(每秒浮点运算次数)计算性能。


贝壳财经记者注意到,根据此前DeepSeek发布V3大模型时公开的技术文档,该大模型正是使用英伟达的H800芯片训练而成。


上海骊翰科技咨询有限公司发文称,FlashMLA能在不损失模型性能的前提下,将缓存体积压缩至原来的1/4,从而大幅降低显存需求。例如,原始需要存储的100GB中间结果,压缩后仅需25GB,通过开源让企业可以直接使用FlashMLA来优化自家模型。随着FlashMLA的普及,AI推理有望进入千元级硬件跑百亿模型的时代。


“DeepSeek发布开源周首个成果 可优化英伟达GPU效率” 的相关文章

北京大学联合华为发布全栈开源 DeepSeek 推理方案

北京大学联合华为发布全栈开源 DeepSeek 推理方案

IT之家 3 月 10 日消息,据华为技术有限公司和北京大学高性能计算校级公共平台消息,2025 年 3 月 9 日,北京大学联合华为发布 DeepSeek 全栈开源推理方案。据介绍,该方案...

DeepSeek能干些什么?探索AI技术的无限可能

DeepSeek能干些什么?探索AI技术的无限可能

标题:DeepSeek能干些什么?探索AI技术的无限可能关键词:DeepSeek,人工智能,数据分析,自动化,创新研发,AI工具,智能化变革描述:DeepSeek作为领先的人工智能工具,正通过其强大的...

公元:DeepSeek只打开一扇门,大模型远没到终局

公元:DeepSeek只打开一扇门,大模型远没到终局

谁会先迈出下一只脚?DeepSeek如何改变中国AI投资?具身智能距离清晰商业化还要多久?这些热门话题吸引了众多资深投资人热烈讨论。在 “第19届中国投资年会·年度峰会”上,投中网主编曹玮钰与红杉中国...

DeepSeek上车 能撼动图商的专业主义吗|时空智能新十年

DeepSeek上车 能撼动图商的专业主义吗|时空智能新十年

撰文 |泰伯网 林槿近期,吉利、比亚迪、奇瑞、长城等超20家车企宣布接入DeepSeek大模型,四维图新、腾讯地图、百度地图等地图厂商也争相跟进。一时间,“DeepSeek上车”成为行业标配,甚至冠以...

协鑫能科:公司暂时没有与DeepSeek开展业务合作

协鑫能科:公司暂时没有与DeepSeek开展业务合作

金融界2月17日消息,有投资者在互动平台向协鑫能科提问:尊敬的董秘你好!新年好!公司DeepSeek有合作吗?公司回答表示:公司主要从事能源资产投资管理及综合能源服务相关业务,目前公司暂时没有与Dee...

美财长称最近美股崩盘原因是DeepSeek而非特朗普的政策

美财长称最近美股崩盘原因是DeepSeek而非特朗普的政策

据环球时报援引路透社报道,在4月5日公开的一次采访中,美国财政部长贝森特将美股崩盘归咎于DeepSeek,而非特朗普的经济政策。...