当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek发布开源周首个成果 可优化英伟达GPU效率

6个月前 (02-24)Deepseek最新资讯301

新京报贝壳财经讯(记者罗亦丹)北京时间2月24日上午,DeepSeek发布了其“开源周”的第一项成果:FlashMLA(直译为快速多头潜在注意力机制)的代码。


据了解,MLA(多头潜在注意力机制)正是DeepSeek降低大模型成本使用的关键技术之一,其可以显著减少大模型训练和推理过程中的内存占用,而FlashMLA则是针对Hopper GPU(一种英伟达GPU架构)开发的高效MLA解码内核,其针对可变长度序列进行了优化,目前已投入了生产,其可以使得H800达到3000GB/s内存,实现580TFLOPS(每秒浮点运算次数)计算性能。


贝壳财经记者注意到,根据此前DeepSeek发布V3大模型时公开的技术文档,该大模型正是使用英伟达的H800芯片训练而成。


上海骊翰科技咨询有限公司发文称,FlashMLA能在不损失模型性能的前提下,将缓存体积压缩至原来的1/4,从而大幅降低显存需求。例如,原始需要存储的100GB中间结果,压缩后仅需25GB,通过开源让企业可以直接使用FlashMLA来优化自家模型。随着FlashMLA的普及,AI推理有望进入千元级硬件跑百亿模型的时代。


“DeepSeek发布开源周首个成果 可优化英伟达GPU效率” 的相关文章

财务人如何用DeepSeek摆脱加班?这6招让你躺赢!DeepSeek能自动做账、出报表、写分析,财务人员会被干掉吗?

财务人如何用DeepSeek摆脱加班?这6招让你躺赢!DeepSeek能自动做账、出报表、写分析,财务人员会被干掉吗?

DeepSeek能自动做账、出报表、写分析,财务人员会被干掉吗?每次新技术浪潮涌来,总有人说财务会被取代。但工具再先进,还是要看在什么人手里。DeepSeek不会让财务这个职业消失,但一定会加剧两极分...

用DeepSeek做图的4种方法,做小红书图文、海报、日报太快了,不服不行!1分钟教会,90%的人还不知道!(附保姆级教程)

用DeepSeek做图的4种方法,做小红书图文、海报、日报太快了,不服不行!1分钟教会,90%的人还不知道!(附保姆级教程)

DeepSeek 虽然只能生成文本,但 DeepSeek 和其他工具结合,却可以实现做图表、做 PPT、做图、做视频等各种日常实用功能。之前分享了用 DeepSeek 做图表和 PPT 的教程:用 D...

职场DeepSeek写材料指令100条

职场DeepSeek写材料指令100条

以下是为您整理的100条职场常用DeepSeek写材料指令,涵盖各类办公场景需求:一、工作总结类(10条)   1.生成[XXXX]年度部门工作总结模板(含数据可视化图表模块)&n...

DeepSeek创始人梁文锋,首登全球富豪榜

DeepSeek创始人梁文锋,首登全球富豪榜

3月27日,胡润研究院发布《2025胡润全球富豪榜》,今年40岁的DeepSeek创始人梁文锋第一次上榜,小米集团56岁的雷军成为财富增长最快的中国企业家。在AI领域,梁文锋和OpenAI 39岁的S...

马云再次现身引热议!DeepSeek爆火,阿里巴巴能否借势AI?

马云再次现身引热议!DeepSeek爆火,阿里巴巴能否借势AI?

《科创板日报》2月11日讯(记者 黄心怡)今日,阿里巴巴创始人马云再度现身阿里园区。《科创板日报》记者了解到,马云出现在夸克所处的阿里智能信息事业群,与员工交流。今日港股开盘后,阿里股价一度上涨触及1...

深圳大学与腾讯云达成合作 推出DeepSeek相关课程

深圳大学与腾讯云达成合作 推出DeepSeek相关课程

每经快讯,据深圳大学微信公众号2月17日消息,深圳大学大数据系统计算技术国家工程实验室近日与腾讯云达成合作,共同推出基于DeepSeek的人工智能通识课程。深大学生本学期即可选课学习。课程内容将涵盖人...