当前位置:首页 > DeepSeek技术交流 > 正文内容

新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练

5个月前 (03-26)DeepSeek技术交流333

明敏 发自 凹非寺

量子位 | 公众号 QbitAI

刚刚,DeepSeek官方发布DeepSeek-V3模型更新技术报告。

V3新版本在数学、代码类相关评测集成绩超过GPT-4.5!

而且这只是通过改进后训练方法实现。

DeepSeek-V3-0324和之前的DeepSeek-V3使用同样的base模型。

打破了之前传言该版本base模型是R2的传言。

新版本参数量约为660B,与此前网传的685B有所出入。

开源版本上下文长度为128K(网页端、App和API提供 64K 上下文)。

私有化部署时只需要更新checkpoint和tokenizer_config.json(tool calls相关变动)。

目前,想要体验这一版本模型,只需用户登录官方网页、APP、小程序进入对话界面后,关闭深度思考即可体验。API 接口和使用方式保持不变。

官方建议,此后非复杂推理任务使用V3新版本更好。

此外,官方还进一步展示了新版本在各个维度的能力。

前端开发

生成代码可用性更高,视觉效果也更好。

中文写作

相较于R1版有进一步优化,特别提升了中长篇的内容质量。

比如写一篇关于苏轼生平的散文:

中文搜索

联网情况下,V3新版本的搜索输出内容也更详实准确、排版更清晰美观。

现在写一份3000字的市场报告也是so easy(上下滑动查看完整内容):

此外,V3新版本在工具调用、角色扮演、问答闲聊等方面也进一步提升。

今天白天不少网友也上手实测了诸多能力,比如做个小游戏:

该版本模型采用宽松的MIT开源协议。

且可直接部署在M3 Ultra的Mac Studio上。

这意味着大模型开发应用的门槛更进一步降低。

话不多说,趁着深夜,还没睡的赶紧去体验最新版吧~


原标题:《新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练》


“新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练” 的相关文章

DeepSeek加持的AlphaGPT,助力高文律师事务所全面拥抱AI

DeepSeek加持的AlphaGPT,助力高文律师事务所全面拥抱AI

2025年初,中国团队精心雕琢的通用大模型DeepSeek凭借其创新的架构优化以及深入的数据挖掘技术,在逻辑推理、多轮对话和知识搜索等关键领域大放异彩,其为诸多垂直领域,特别是法律行业的智能化转型,开...

华为首款鸿蒙电脑接入 DeepSeek,模型与芯片深度协同

华为首款鸿蒙电脑接入 DeepSeek,模型与芯片深度协同

IT之家 5 月 8 日消息,在今日盛大举行的鸿蒙电脑技术与生态沟通会上,华为首款鸿蒙电脑正式揭开神秘面纱,惊艳亮相。这一消息瞬间引发了科技圈的广泛关注,众多业内人士与科技爱好者都对这款具有开创性意义...

DeepSeek“崩上热搜”,官网回应:APP、WEB对话功能已恢复正常

DeepSeek“崩上热搜”,官网回应:APP、WEB对话功能已恢复正常

DeepSeek今日(5月13日)登上微博热搜,不少网友反馈一直在转圈、无法使用。晚间,DeepSeek服务状态页面更新称,APP、WEB对话功能恢复正常,对话历史有概率获取失败。...

DeepSeek:“边缘革命” 的可能性

DeepSeek:“边缘革命” 的可能性

DeepSeek:“边缘革命” 的可能性复旦《管理视野》·2025年05月07日 10:32连这样优秀的前沿大模型都以开源的方式呈现,那么大学似乎就更应该以“开源”的魄力面对公众和未来专注通用人工智能...

百万年薪!DeepSeek带火这个岗

百万年薪!DeepSeek带火这个岗

2025年春节,中国人工智能大模型DeepSeek在全球引发轰动。DeepSeek的崛起也让相关领域的人才在这个春招季炙手可热。有企业开出百万年薪!据南方日报报道,在2月的深圳市南山区新春大型招聘活动...

YY直播接入DeepSeek,推出低延时“YYDS”满血版,开启智能社区新体验

YY直播接入DeepSeek,推出低延时“YYDS”满血版,开启智能社区新体验

近日,YY公司宣布正式接入DeepSeek,并推出了低延时、不卡顿的YY-DeepSeek R1-满血版(简称“YYDS”)。目前,广州津虹YY直播和YY语音等产品已经上线了该产品的入口,供用户使用。...