当前位置:首页 > Deepseek应用场景 > 正文内容

DeepSeek昨夜上新!新旧版V3对比实测,代码能力飙升,震惊海外用户

5个月前 (03-26)Deepseek应用场景304

原创 陈骏达 智东西

新版V3都来了,R2和V4还会远吗?

作者 | 陈骏达

编辑 | 漠影

智东西3月25日报道,昨日晚间,DeepSeek在开源平台悄然上线了升级后的DeepSeek-V3模型。新模型的版本号为DeepSeek-V3-0324,模型参数为6850亿,较早期版本的6710亿有小幅增长。不过,DeepSeek尚未放出新版模型的系统卡,我们暂时无法获取关于这款模型的更多信息。

开源地址:https://huggingface.co/deepseek-ai/DeepSeek-V3-0324

同时,DeepSeek也将DeepSeek-V3模型的开源协议更新为与DeepSeek-R1一致的MIT协议,这一协议更为宽松,允许模型蒸馏、商用等行为,给了开发者更多的自主权。

新版DeepSeek-V3上线后,智东西第一时间进行了代码、数学和通用能力等多方面的测试,并关注到广大网友的测试结果。据众多已经体验上这款模型的网友分享,升级后的DeepSeek-V3在代码、数学等方面有明显的性能提升。

一位海外AI博主称,DeepSeek终于能在代码领域和Anthropic的Claude Sonnet 3.5一决高下了。而之前,Claude Sonnet 3.5在程序员圈内拥有极高的声誉,无论诸多模型在代码上的成绩如何变化,程序员依旧更青睐使用Claude系列模型。

在智东西的测试中,新版DeepSeek-V3在网站开发能力、UI设计方面展现出巨大的进步,在输入“设计一个美观的个人博客网站,带有科技感,直接开发成可用网页”的提示词之后,直接获得了如下的网页效果。

新版DeepSeek-V3在2分钟的时间内交付了一个总计400多行代码、设计精良的网站,据其介绍,网站采用了粒子背景动画、赛博朋克UI(霓虹光效、悬浮动画和科技感配色)等设计元素,标题使用打字机动画,按钮具备光波扩散效果。

这一网站还使用了响应式设计,能自动适配手机和桌面设备。

而当旧版DeepSeek-V3获得相同的指令时,其解决方案仅有100多行代码,输出的结果在审美上也不如新版的DeepSeek-V3。

有网友称,这次的“小更新”比预期中的更大,改进显著,尤其是在数学方面。

智东西将之前实测中,曾难倒旧版DeepSeek-V3和DeepSeek-R1的一道数学题交给新版DeepSeek-V3。这次,DeepSeek-V3输出的token与原版DeepSeek-V3总量明显更长,单次输出达到了输出上限,在点击继续生成后,DeepSeek-V3继续思考,但这次的答案依旧是错误的。

不过,从错误的答案中,我们也能观察到一些新的变化,如今的DeepSeek-V3在给出最终答案后,会进行一定程度的反思,并修改自己的解题过程。

而在智东西先前测试的文科类问题上,新版DeepSeek-V3的答案变得更为全面。智东西的测试问题为:“布须曼人喝不喝牛奶?”旧版DeepSeek-V3对这一问题的回答仅有三小段话,信息量不多。

新版DeepSeek-V3采用了更为结构化的回答模式,分析的内容更为全面,补充了更多的背景信息,同时生成的速度依旧比较理想。

这也印证了部分网友总结出来的特点:新版DeepSeek-V3像是V3与R1的结合体,更倾向用长输出解决问题。

新版DeepSeek-V3的发布,也让诸多网友不禁遐想:新版V3都来了,R2和V4还会远吗?


“DeepSeek昨夜上新!新旧版V3对比实测,代码能力飙升,震惊海外用户” 的相关文章

比肩 H100!硅基流动上线基于昇腾云 CloudMatrix 超节点的 DeepSeek-R1

比肩 H100!硅基流动上线基于昇腾云 CloudMatrix 超节点的 DeepSeek-R1

近日,硅基流动创始人袁进辉在华为云生态大会上宣布,硅基流动联合华为云基于 CloudMatrix 384超节点昇腾云服务和高性能推理框架 SiliconLLM,用大规模专家并行最佳实践正式上线 Dee...

西藏大学、拉萨高新区等“尝鲜”DeepSeek

西藏大学、拉萨高新区等“尝鲜”DeepSeek

中新网拉萨5月27日电 (记者 江飞波)西藏大学近日推出“藏大智言”DeepSeek(深度求索)平台,人工智能教学服务将延伸至雪域高原。中新网记者获悉,除西藏大学外,目前西藏自治区昌都市政务云已完成D...

中国电信舟山分公司:自研完成全市首个DeepSeek本地化应用,深度赋能社会救助数智化转型

中国电信舟山分公司:自研完成全市首个DeepSeek本地化应用,深度赋能社会救助数智化转型

自DeepSeek全新开源模型掀起AI浪潮以来,中国电信舟山分公司作为数字舟山建设的主力军,凭借强大的技术实力和创新能力,迅速行动、深度探索DeepSeek大模型融合各行各业,为舟山市民政局率先实现D...

哈医大一院开辟Deepseek“看病问诊”新场景

哈医大一院开辟Deepseek“看病问诊”新场景

“Deepseek作为当下热点,尤其是在医疗场景下的部署应用,是医疗新质生产力的生动实践。”近日,哈尔滨医科大学附属第一医院深入贯彻落实国家“人工智能+医学”深度融合政策,积极推动人工智能AI技术在医...

DeepSeek智能体正在改变工作方式?学会这3招,提升你的职业竞争力

DeepSeek智能体正在改变工作方式?学会这3招,提升你的职业竞争力

你还在手动整理数据?还在为写不出高质量文案而苦恼?小心被AI淘汰!2024年,职场内卷已经到了白热化阶段。但比内卷更可怕的是什么?是降维打击!当别人用DeepSeek智能体几分钟搞定你一天的工作,你的...

DeepSeek赋能:从90亿跃升6700亿

DeepSeek赋能:从90亿跃升6700亿

原创 湖北应急管理 湖北应急管理近日,湖北省应急管理厅传来振奋消息,风险隐患监测预警平台完成重大技术升级,依托移动云算力支撑,核心AI模型“楚小应”对接“满血版”DeepSeek - R1(671B)...