关闭广告

DeepSeek-V3.1正式发布,一个模型,两种模式

第一财经资讯2025-08-22 00:00:02102人阅读

作者:刘晓洁 责编:彭海斌

8月21日,业界千呼万唤的R2模型没来,但DeepSeek官方正式发布了新模型V3.1。从命名来看这或许不是一次大的版本更新,更像是前一代DeepSeek-V3模型的小版本迭代。

在X上,DeepSeek将V3.1称为“我们迈向智能体时代的第一步”(our first step toward the agent era)。本次升级主要有三大亮点,其中包括更强的Agent能力、混合思考模式和更高的思考效率。

官方表示,通过后训练优化,新模型在工具使用与智能体任务中的表现有较大提升。在编程智能体、搜索智能体测评中, V3.1相比之前的DeepSeek系列模型都有明显提高。


DeepSeek-V3.1是混合推理架构,一个模型同时支持思考模式和非思考模式。目前用户可在官方App与网页端体验新模型,通过“深度思考”按钮,实现思考模式与非思考模式的自由切换。DeepSeek API也已同步升级,deepseek-chat对应非思考模式,deepseek-reasoner对应思考模式,且上下文均已扩展为128K。

“混合推理非常棒。拥有一个能够在深度思考和快速响应之间切换的模型,感觉就像是实用人工智能的未来。”X上有网友表示,“在深度推理和快速反应之间切换真是天才之举。”根据查询调整深度,可以避免在简单任务上过度耗时,同时在需要时进行全面分析。

与之前的版本相比,V3.1也有更高的思考效率。官方表示,DeepSeek-V3.1-Think在保持与 DeepSeek-R1-0528相当的答案质量的同时,响应速度更快。

官方测试结果显示,经过思维链压缩训练后,V3.1-Think 在输出 token 数减少20%-50% 的情况下,各项任务的平均表现与 R1-0528持平。


在各项评测指标得分基本持平的情况下,R1-0528与 V3.1-Think 的 token 消耗量对比图

同时,V3.1在非思考模式下的输出长度也得到了有效控制,相比于 DeepSeek-V3-0324 ,能够在输出长度明显减少的情况下保持相同的模型性能。

同步地,DeepSeek进行了价格调整,模型的API接口调用价格有所上涨。自9月6日凌晨起,取消夜间时段优惠,输入价格上,缓存命中时为0.5元/百万tokens,缓存未命中的价格则为4元/百万tokens(此前V3为2元/百万tokens);输出价格为12元/百万tokens(此前V3为8元/百万tokens)。


官方提到,V3.1的基础模型在V3的基础上重新做了外扩训练,一共增加训练了840B tokens。基础模型与后训练模型均已在Huggingface与魔搭开源。

值得一提的是,DeepSeek此次还宣布增加了对海外模型Anthropic API格式的支持,官方提到这是“为了满足大家对 Anthoripic API 生态的使用需求”,用户可以将 DeepSeek-V3.1的能力接入Claude Code框架。

版权与免责声明:本文内容转载自其他媒体,目的在于传递更多信息,不代表本网观点或立场,不承担此类作品侵权行为的自己责任及连带责任。
猜你喜欢
精彩推荐

亚锦赛带伤13秒07获铜牌!吴艳妮:我觉得不是我的真实水平

直播吧 浏览 3175 08-05

砸1亿元跨界,百亿巨头老板电器杀入机器人赛道

尺度商业 浏览 11 01-21

英国安德鲁王子放弃王室头衔 被指与未成年人发生关系

CCTV国际时讯 浏览 38 10-18

蔚来2025年1季度报出炉 营收120亿元同比增21%

网易汽车 浏览 9099 06-04

重磅!东莞银行(国际)正式开业,系首家在港设立子行的城商行

湘财Plus 浏览 6122 08-12

船长酒驾撞军舰传巨响 美军退役航母被"找茬"

国际在线 浏览 9179 07-21

“官僚主义”缠身的亚马逊,开始被多面夹击

虎嗅APP 浏览 43 11-17

乌官员:泽连斯基准备与普京坐下来讨论"领土问题"

澎湃新闻 浏览 111 08-25

夏天穿衣不用五颜六色!上衣修身、配色清爽,才更适合普通人

静儿时尚达人 浏览 4083 05-27

定价或在 8 万元级,轩逸纯电继承者日产 N6 要来了!

爱范儿 浏览 5024 08-21

泽连斯基宣布:或购买150架"鹰狮"战斗机 已签意向书

环球网资讯 浏览 54 10-26

不足10人的团队,如何撬开华为生态?

虎嗅APP 浏览 447 07-27

从化工到算力,博汇股份开启增长新纪元

览富财经网 浏览 9266 07-23

林志玲夫妇带娃出游,暴露了最真实的夫妻关系

素衣读史 浏览 2695 07-08

蔡磊抗"冻"6年:科研投入超1亿 如今只能用眼控仪交流

红星新闻 浏览 29 12-11

中国联通原副总经理获刑12年 曾搞权色、钱色交易

政知新媒体 浏览 55 10-29

国安逆境下拼出胜利 逆转浙江御林军重燃争冠希望

体坛周报 浏览 8302 08-11

《生万物》:侵犯傻挑的人到底是谁!拨云见日,3人有重大嫌疑

娱乐圈笔娱君 浏览 103 08-23

瓜帅:我认为刘易斯会留队,他唯一的问题就是个子太小了

直播吧 浏览 9894 08-18

特朗普开价10亿美元招募 被指试图用新机构替代联合国

极目新闻 浏览 11 01-18

沃尔沃S60也开始卷价格?最高优惠12.6万

汽车网评 浏览 37 12-14
本站所有信息收集于互联网,如本站收集信息侵权,请联系我们及时删除沪ICP备20017958号-3