当前位置:首页 > Deepseek最新资讯 > 正文内容

性能大幅领先R1!DeepSeek V3.1免费上线官网和App:回答更快

  据介绍,DeepSeek-V3.1具备128K超长上下文处理能力,支持混合推理架构(一个模型同时支持思考模式与非思考模式)。

  不仅如此,DeepSeek-V3.1拥有更强的Agent(智能体)能力,通过Post-Training(后训练)优化,新模型在工具使用与智能体任务中的表现有较大提升。

  比如,在代码修复测评SWE与命令行终端环境下的复杂任务(Terminal-Bench)测试中,以及在需要多步推理的复杂搜索测试(browsecomp)与多学科专家级难题测试(HLE)上,DeepSeek-V3.1均大幅领先DeepSeek-R1-0528。

  另外,DeepSeek-V3.1思考效率提升有了巨幅提升。经过思维链压缩训练后,V3.1-Think在输出token数减少20%-50%的情况下deepseek,各项任务的平均表现与R1-0528 持平。

  对于DeepSeek R2发布延迟的原因,DeepSeek总结称,主要由于采用国产昇腾芯片进行训练时遇到技术挑战,以及公司对模型质量的高标准要求。虽然之前有8月发布的传闻,但已被官方否认。目前看来,我们可能需要再等待几周的时间,但具体日期还需以官方消息为准。原文出处:性能大幅领先R1!DeepSeek V3.1免费上线官网和App:回答更快,感谢原作者,侵权必删!

标签: deepseek

“性能大幅领先R1!DeepSeek V3.1免费上线官网和App:回答更快” 的相关文章

HMD 巴萨联名版 3210 功能机上市:支持 Deepseek AI 助手、预

HMD 巴萨联名版 3210 功能机上市:支持 Deepseek AI 助手、预

  IT之家 7 月 29 日消息,HMD 今天上架了巴塞罗那足球队联名版 3210 功能手机,深度定制外壳、壁纸、系统界面等,支持支付宝被扫支付、Deepseek AI 助手,预售到手价...

乔丹当年有没有退役巡演?詹姆斯会否学他

乔丹当年有没有退役巡演?詹姆斯会否学他

  你说的是碧昂丝和jayz吧,因为吹牛老爹的事受点舆论牵连,蕾哈娜和ASAP rocky没听说受啥影响啊。   你说的是碧昂丝和jayz吧,因为吹牛老爹的事受点舆论牵连...

DeepSeek崩了,服务突遭全面宕机,今年以来多次因崩了登上热搜,官方深夜回应

DeepSeek崩了,服务突遭全面宕机,今年以来多次因崩了登上热搜,官方深夜回应

  据了解,2025年伊始,来自中国的AI大模型DeepSeek凭借其突破性进展迅速走红,各行各业都在积极拥抱DeepSeek。   1月27日,Deepseek应用登顶...

《财富》:2025年中国科技50强华为DeepSeek入选

《财富》:2025年中国科技50强华为DeepSeek入选

  除上述三家公司,登上榜单的还有阿里巴巴、腾讯科技、比亚迪deepseek、字节跳动、宇树科技、大疆创新、联想等。   关于华为,该榜单评价称,华为是中国最具全球竞争力...

海能达:“情指行一体化实战平台”已深度融合国产大模型DeepSeek

海能达:“情指行一体化实战平台”已深度融合国产大模型DeepSeek

  证券日报网讯 海能达8月8日在互动平台回答投资者提问时表示,公司“情指行一体化实战平台”已深度融合国产大模型DeepSeekdeepseek,进一步强化平台的智能决策能力,为公安实战指...

DeepSeek-V3.1最新8大核心龙头企业,这篇文章帮你梳理清楚

DeepSeek-V3.1最新8大核心龙头企业,这篇文章帮你梳理清楚

  DeepSeek发布了其最新的大语言模型DeepSeek-V3.1,通过引入混合推理架构和显著增强的智能体(Agent)能力,进一步加剧了全球AI市场的技术竞赛。  ...