当前位置:首页 > Deepseek最新资讯 > 正文内容

报道:DeepSeek决定使用华为人工智能芯片训练部分模型

  观点网讯:8月29日,据媒体报道,DeepSeek已决定使用华为的人工智能芯片来训练其部分模型,反映其正在减少对英伟达芯片的依赖。

  DeepSeek方面称,本次升级包含以下主要变化:混合推理架构让一个模型同时支持思考模式与非思考模式;相比DeepSeek-R1-0528,DeepSeek-V3.1-Think能在更短时间内给出答案,让模型拥有更高的思考效率;通过Post-Training优化,让新模型有更强的Agent能力,在工具使用与智能体任务中的表现有较大提升。

  据悉,DeepSeek-V3.1采用了UE8MO FP8 Scale参数精度,该模型与UE8M0FP8动态范围大,提升稳定性与效率,适配华为昇腾等芯片deepseek。原文出处:报道:DeepSeek决定使用华为人工智能芯片训练部分模型,感谢原作者,侵权必删!

标签: deepseek

“报道:DeepSeek决定使用华为人工智能芯片训练部分模型” 的相关文章

刚刚,DeepSeek梁文锋NSA论文、北大杨耀东团队摘得ACL 2025最佳论

刚刚,DeepSeek梁文锋NSA论文、北大杨耀东团队摘得ACL 2025最佳论

  ACL 是计算语言学和自然语言处理领域的顶级国际会议,由国际计算语言学协会组织,每年举办一次。一直以来,ACL 在 NLP 领域的学术影响力都位列第一,它也是 CCF-A 类推荐会议。...

Databricks:全球AI第四大独角兽,估值1000亿美元,碾压DeepSe

Databricks:全球AI第四大独角兽,估值1000亿美元,碾压DeepSe

  估值1000亿美元!一个华人小伙子参与创办的公司,成了全球第四大AI独角兽,仅次于OpenAI、字节跳动和马斯克的xAI。   这家公司叫 Databricks,听起...

为下一代国产芯片设计!DeepSeek新版本再次震惊科技界

为下一代国产芯片设计!DeepSeek新版本再次震惊科技界

  【为下一代国产芯片设计!#DeepSeek新版本再次震惊科技界#】#外媒热议DeepSeek升级#中国人工智能初创企业深度求索21日正式发布其旗舰模型升级版DeepSeek-V3.1。...

DeepSeek等大模型集体“打标”,从此告别AI造假?

DeepSeek等大模型集体“打标”,从此告别AI造假?

  9月1日,DeepSeek在官方公众号发布公告,表示对AI生成合成内容添加标识,并明确提醒用户相关内容由AI生成。   其他大模型厂商其实也早有动...

穗森居启动《睡眠AI智荐系统》项目:AI重构睡眠生态,开启健康睡眠新纪元

穗森居启动《睡眠AI智荐系统》项目:AI重构睡眠生态,开启健康睡眠新纪元

  民以食为天,曾经人们见面最常用的问候语便是“您吃了吗”,而在如今快节奏的社会生活中,“昨晚睡得如何”成为另一句高频问候语。睡眠,已成为当下人们关心的大事。 据《2024中国居民睡眠健康...

【行业资讯】RPA到AI:商业银行报表实践的全面智能化升级——从三井住友银行到D

【行业资讯】RPA到AI:商业银行报表实践的全面智能化升级——从三井住友银行到D

  在商业银行的运营版图中,报表管理一直是极为关键但也极为繁琐的板块。从手工记录到数字化探索,这一领域经历了漫长的发展历程。近年来,随着金融科技的飞速发展,商业银行报表实践正迎来一场由机器...