8月21日,DeepSeek在其官宣发布DeepSeek-V3.1的文章中提到,DeepSeek-V3.1使用了UE8M0 FP8 Scale的参数精度。另外 ,V3.1对分词器及chat template进行了较大调整,与DeepSeek-V3存在明显差异 。DeepSeek官微在置顶留言里表示,UE8M0 FP8是针对即将发布的下一代国产芯片设计。
相关报道DeepSeek发布新模型V3.1 价格涨了但Agent能力提升了
8月21日 ,业界千呼万唤的R2模型没来,但DeepSeek官方正式发布了新模型V3.1。从命名来看这或许不是一次大的版本更新,更像是前一代DeepSeek-V3模型的小版本迭代 。
在X上 ,DeepSeek将V3.1称为“我们迈向智能体时代的第一步”(our first step toward the agent era)。本次升级主要有三大亮点,其中包括更强的 Agent能力、混合思考模式和更高的思考效率。
官方表示,通过后训练优化 ,新模型在工具使用与智能体任务中的表现有较大提升 。在编程智能体、搜索智能体测评中, V3.1 相比之前的 DeepSeek 系列模型都有明显提高。
DeepSeek-V3.1 是混合推理架构,一个模型同时支持思考模式和非思考模式。目前用户可在官方 App与网页端体验新模型 ,通过“深度思考 ”按钮,实现思考模式与非思考模式的自由切换 。DeepSeek API 也已同步升级,deepseek-chat对应非思考模式,deepseek-reasoner对应思考模式 ,且上下文均已扩展为 128K。
“混合推理非常棒。拥有一个能够在深度思考和快速响应之间切换的模型,感觉就像是实用人工智能的未来 。”X上有网友表示,“在深度推理和快速反应之间切换真是天才之举。”根据查询调整深度 ,可以避免在简单任务上过度耗时,同时在需要时进行全面分析。
与之前的版本相比,V3.1也有更高的思考效率。官方表示 ,DeepSeek-V3.1-Think 在保持与 DeepSeek-R1-0528 相当的答案质量的同时,响应速度更快 。
官方测试结果显示,经过思维链压缩训练后 ,V3.1-Think 在输出 token 数减少 20%-50% 的情况下,各项任务的平均表现与 R1-0528 持平。
同时,V3.1 在非思考模式下的输出长度也得到了有效控制 ,相比于 DeepSeek-V3-0324 ,能够在输出长度明显减少的情况下保持相同的模型性能。
同步地,DeepSeek进行了价格调整,模型的API接口调用价格有所上涨 。自 9 月 6 日凌晨起 ,取消夜间时段优惠,输入价格上,缓存命中时为0.5元/百万tokens ,缓存未命中的价格则为4元/百万tokens(此前V3为2元/百万tokens);输出价格为12元/百万tokens(此前V3为8元/百万tokens)。
官方提到,V3.1的基础模型在V3的基础上重新做了外扩训练,一共增加训练了840B tokens。基础模型与后训练模型均已在Huggingface与魔搭开源 。
值得一提的是 ,DeepSeek此次还宣布增加了对海外模型Anthropic API格式的支持,官方提到这是“为了满足大家对 Anthropic API 生态的使用需求 ”,用户可以将 DeepSeek-V3.1 的能力接入Claude Code框架。
手机股票开户用哪个app好:在线炒股配资选择配资-美国消费者信心跌至历史低位 财务悲观与就业担忧同步加剧
杠杆炒股开户:国内炒股怎么加杠杆-国产芯片再迎利好!智谱发布新一代大模型 全面适配寒武纪和摩尔线程芯片!
炒股指杠杆平台:炒股开户在线股票配资平台-接连出手!中国移动继续增持浦发银行!
股票杠杆炒股平台:想买股票怎么开户入门啊-智谱发布首个手机智能体:一句话点外卖订机票 手表、眼镜、家电等均能接入
查查看股票配资:炒股开户在线股票配资平台-吴清挂帅!资本市场“超级智囊团”来了 名单曝光
企业开户购买股票收益纳税:选择股票的技巧-2991亿元!京东发布三季报 收入同比增长14.9% 超出预期
金鼎配资-在线配资炒股-炒股配资公司-证券配资网提示:文章来自网络,不代表本站观点。
华金证券迎来新任研究所所长。3月20日,中证协官网已更新相关执业注册信息,华金证券已聘任杨烨辉担任公司总裁助理以...
在今年的两会上,政府工作报告12次提到“医疗”、13次提到“健康”、16次提到“养老。医疗健康关乎亿万百姓福祉,...
3月7日下午,亚振家具(603389.SH)发布公告称,预计2024年度归母净利润将为负值,且扣除与主营业务无关的收入后...
界面新闻记者|杨志锦界面新闻编辑|王姝建设银行3月末披露的2024年年报显示,2024年该行利润总额下降...
记者辛圆海关总署周五公布数据称,以美元计,1-2月出口金额同比增长2.3%,增速较2024年12月回落...
记者辛圆3月25日,博鳌亚洲论坛旗舰报告《亚洲经济前景及一体化进程2025年度报告》(以下简称《报告》...
界面新闻记者|杜萌春节后的AI热潮吹暖了基金市场。随着首批上证科创综指ETF的发行并上市,二级市场迎来久违的...
记者王珍中国国际经济交流中心副理事长、国务院发展研究中心原副主任王一鸣周一在“中国发展高层论坛2025...
3月24日,易方达国证自由现金流ETF公开发售。该产品跟踪国证自由现金流指数,这个指数是什么?有哪些优势?投资价值如何?...
近日,一则关于A股市场估值测算的PPT内容在网络平台流传,其标题出现的“牛市10000点”引发市场关注。 《每日经...
若审计结果最终确认这一数据,*ST富润(600070.SH)或将成为2025年首家因财务指标触发退市的A股公司。...
2025年3月7日,Wind数据显示,A股三大指数今日集体回调,截止收盘,沪指跌0.25%;深证成指跌0.50%;创业板...
实习记者|王颖记者|张一诺九部门联合印发重磅文件,明确养老金融发展的阶段性目标12月13...
3月24日,海洋王照明科技股份有限公司(以下简称“海洋王”,002724.SZ)早盘一字跌停,此后股价拉涨,尾盘封涨停板...
2025年3月25日,倍轻松(688793.SH)公告称,公司股东宁波倍松投资有限公司(简称“宁波倍松”)拟通过大宗交易...