8月21日,DeepSeek在其官宣发布DeepSeek-V3.1的文章中提到,DeepSeek-V3.1使用了UE8M0 FP8 Scale的参数精度。另外 ,V3.1对分词器及chat template进行了较大调整,与DeepSeek-V3存在明显差异 。DeepSeek官微在置顶留言里表示,UE8M0 FP8是针对即将发布的下一代国产芯片设计。
相关报道DeepSeek发布新模型V3.1 价格涨了但Agent能力提升了
8月21日 ,业界千呼万唤的R2模型没来,但DeepSeek官方正式发布了新模型V3.1。从命名来看这或许不是一次大的版本更新,更像是前一代DeepSeek-V3模型的小版本迭代 。
在X上 ,DeepSeek将V3.1称为“我们迈向智能体时代的第一步”(our first step toward the agent era)。本次升级主要有三大亮点,其中包括更强的 Agent能力、混合思考模式和更高的思考效率。
官方表示,通过后训练优化 ,新模型在工具使用与智能体任务中的表现有较大提升 。在编程智能体、搜索智能体测评中, V3.1 相比之前的 DeepSeek 系列模型都有明显提高。
DeepSeek-V3.1 是混合推理架构,一个模型同时支持思考模式和非思考模式。目前用户可在官方 App与网页端体验新模型 ,通过“深度思考 ”按钮,实现思考模式与非思考模式的自由切换 。DeepSeek API 也已同步升级,deepseek-chat对应非思考模式,deepseek-reasoner对应思考模式 ,且上下文均已扩展为 128K。
“混合推理非常棒。拥有一个能够在深度思考和快速响应之间切换的模型,感觉就像是实用人工智能的未来 。”X上有网友表示,“在深度推理和快速反应之间切换真是天才之举。”根据查询调整深度 ,可以避免在简单任务上过度耗时,同时在需要时进行全面分析。
与之前的版本相比,V3.1也有更高的思考效率。官方表示 ,DeepSeek-V3.1-Think 在保持与 DeepSeek-R1-0528 相当的答案质量的同时,响应速度更快 。
官方测试结果显示,经过思维链压缩训练后 ,V3.1-Think 在输出 token 数减少 20%-50% 的情况下,各项任务的平均表现与 R1-0528 持平。
同时,V3.1 在非思考模式下的输出长度也得到了有效控制 ,相比于 DeepSeek-V3-0324 ,能够在输出长度明显减少的情况下保持相同的模型性能。
同步地,DeepSeek进行了价格调整,模型的API接口调用价格有所上涨 。自 9 月 6 日凌晨起 ,取消夜间时段优惠,输入价格上,缓存命中时为0.5元/百万tokens ,缓存未命中的价格则为4元/百万tokens(此前V3为2元/百万tokens);输出价格为12元/百万tokens(此前V3为8元/百万tokens)。
官方提到,V3.1的基础模型在V3的基础上重新做了外扩训练,一共增加训练了840B tokens。基础模型与后训练模型均已在Huggingface与魔搭开源 。
值得一提的是 ,DeepSeek此次还宣布增加了对海外模型Anthropic API格式的支持,官方提到这是“为了满足大家对 Anthropic API 生态的使用需求 ”,用户可以将 DeepSeek-V3.1 的能力接入Claude Code框架。
股票交易软件前十名排行榜:股票杠杆十倍-国产创新药火了!行业是否迎来了“DeepSeek时刻”?
手机股票软件交割单:正规的股票交易软件-2家科创板公司披露业绩快报
手机看股票哪个软件好:炒股票哪个券商开户好-国常会:听取实施大规模设备更新和消费品以旧换新政策情况汇报
股票专业交易软件:指南针股票软件app-特朗普发布“奥巴马被逮捕”AI视频 配文:没人能凌驾于法律之上!
怎样手机交易股票:股票开户哪个证券公司比较好-“新美联储通讯社”锐评议息日:白宫“威压” 联储三分
智慧优配最新消息官网:股票交易软件app哪个好-王兴兴:宇树科技年度营收已超10亿元!未来1~2年机器人有望实现更多家用功能
按天配资-正规配资平台提供配资开户及资讯服务提示:文章来自网络,不代表本站观点。
2025年4月10日,高华科技(688539.SH)发布了限售股份上市流通公告。本次股份上市类型为A股发行法人配售上市,...
Wind数据显示,由民营物流企业顺丰控股发起的公募REITs——南方顺丰物流REIT(代码:180305)今日正式上市。...
3月25日消息,离岸人民币(CNH)兑美元北京时间04:59报7.2639元,较上周五纽约尾盘跌68点,日内整体交投于7...
春意盎然之际,国际劳动妇女节即将蹁跹而至。过去的一年,浦发银行上海宝山支行荣获“上海市巾帼文明岗”称号,上海分行...
截至2025年4月11日 13:54,恒生科技HKETF(513890)上涨2.88%, 冲击3连涨,盘中换手62.05...
今日A股V型反弹,TMT行业探底回升。芯片50ETF(516920)探底回升,尾盘翻红收涨0.92%,资金连续涌入,近2...
界面新闻记者|邹文榕政策引导叠加企业融资需求旺盛,界面新闻记者关注到,开年以来,产业债一级市场发行量较往年明...
3月21日,曾因高调宣布收购罗永浩直播公司而声名大噪的尚纬股份(603333.SH)发布公告称,股东李广元6500万股被...
纳斯达克中国金龙指数收盘涨1.73%,本周累计下跌5.3%。热门中概股涨多跌少,小鹏汽车涨超11%,蔚来涨超7%,百度、...
3月10日,“连锁火锅第一股”呷哺呷哺开盘再下跌,股价不足一港元,已成“仙股”。此前,呷哺呷哺(0520.HK)...
界面新闻记者|陈靖金融市场充满变数。年初至今,券商研究所分析师“转会”频频。过去三个月,券业并购下的...
2025年3月7日,A500ETF(159339.SZ)收跌0.31%,主力资金(单笔成交额100万元以上...
【隔夜行情】•周五(2025年3月21日),A股三大指数集体下跌,截至收盘,截止收盘,沪指跌1.29%,报收33...
记者辛圆保护知识产权就是保护创新。3月21日,国家知识产权局、教育部等七部门发布《关于进一步优...
2024年,该行实现营业收入124.18亿元,同比增加10.73亿元,增幅9.46%;净利润37.79亿元,同比增加1....