8月21日,DeepSeek在其官宣发布DeepSeek-V3.1的文章中提到 ,DeepSeek-V3.1使用了UE8M0 FP8 Scale的参数精度 。另外,V3.1对分词器及chat template进行了较大调整,与DeepSeek-V3存在明显差异。DeepSeek官微在置顶留言里表示,UE8M0 FP8是针对即将发布的下一代国产芯片设计。
相关报道DeepSeek发布新模型V3.1 价格涨了但Agent能力提升了
8月21日 ,业界千呼万唤的R2模型没来,但DeepSeek官方正式发布了新模型V3.1。从命名来看这或许不是一次大的版本更新,更像是前一代DeepSeek-V3模型的小版本迭代 。
在X上 ,DeepSeek将V3.1称为“我们迈向智能体时代的第一步 ”(our first step toward the agent era)。本次升级主要有三大亮点,其中包括更强的 Agent能力、混合思考模式和更高的思考效率。
官方表示,通过后训练优化 ,新模型在工具使用与智能体任务中的表现有较大提升 。在编程智能体 、搜索智能体测评中, V3.1 相比之前的 DeepSeek 系列模型都有明显提高。
DeepSeek-V3.1 是混合推理架构,一个模型同时支持思考模式和非思考模式。目前用户可在官方 App与网页端体验新模型 ,通过“深度思考”按钮,实现思考模式与非思考模式的自由切换 。DeepSeek API 也已同步升级,deepseek-chat对应非思考模式 ,deepseek-reasoner对应思考模式,且上下文均已扩展为 128K。
“混合推理非常棒。拥有一个能够在深度思考和快速响应之间切换的模型,感觉就像是实用人工智能的未来 。”X上有网友表示,“在深度推理和快速反应之间切换真是天才之举。”根据查询调整深度 ,可以避免在简单任务上过度耗时,同时在需要时进行全面分析。
与之前的版本相比,V3.1也有更高的思考效率 。官方表示 ,DeepSeek-V3.1-Think 在保持与 DeepSeek-R1-0528 相当的答案质量的同时,响应速度更快。
官方测试结果显示,经过思维链压缩训练后 ,V3.1-Think 在输出 token 数减少 20%-50% 的情况下,各项任务的平均表现与 R1-0528 持平。
同时,V3.1 在非思考模式下的输出长度也得到了有效控制 ,相比于 DeepSeek-V3-0324 ,能够在输出长度明显减少的情况下保持相同的模型性能。
同步地,DeepSeek进行了价格调整 ,模型的API接口调用价格有所上涨 。自 9 月 6 日凌晨起,取消夜间时段优惠,输入价格上,缓存命中时为0.5元/百万tokens ,缓存未命中的价格则为4元/百万tokens(此前V3为2元/百万tokens);输出价格为12元/百万tokens(此前V3为8元/百万tokens)。
官方提到,V3.1的基础模型在V3的基础上重新做了外扩训练,一共增加训练了840B tokens。基础模型与后训练模型均已在Huggingface与魔搭开源 。
值得一提的是 ,DeepSeek此次还宣布增加了对海外模型Anthropic API格式的支持,官方提到这是“为了满足大家对 Anthoripic API 生态的使用需求 ”,用户可以将 DeepSeek-V3.1 的能力接入Claude Code框架。
手机炒股票用什么软件最好:融资的股票停牌了怎么算利息-涨爆了!股市集体拉升!日本股市再创新高 韩国股市大幅拉升
融资买入股票的利息和手续费:网上开户股票帐户怎么消户-12月降息预期骤降?白宫哈塞特:这时候“收手” 时机非常糟!
炒股指加杠杆怎么弄:融资的股票停牌了怎么算利息-以伊冲突搅动资本市场!分析师:黄金涨势重启 美元避险属性遭挑战
炒股怎么杠杆:什么平台买股票收费低-国产芯片重磅!中芯国际、华虹公司同日公布业绩
配资门户网网站:买创业板股票怎么开户-十五五规划建议发布:全链条推动集成电路、工业母机、高端仪器、基础软件、先进材料、生物制造等重点领域关键核心技术攻关取得决定性突破
网上怎么开户购买股票:怎么在手机玩股票-华为Mate80系列发布在即 新款麒麟芯片或将亮相
恒正网配资-网络配资-正规配资平台官网-股票配资app下载提示:文章来自网络,不代表本站观点。
恒正网配资-网络配资-正规配资平台官网-股票配资app下载⑯我们拥有完善的客户服务体系,确保客户在投资过程中享受到全方位的支持和服务。
国务院新闻办公室9日发布《关于中美经贸关系若干问题的中方立场》白皮书,澄清中美经贸关系事实,阐明中方对相关问题的政策立场...
3月21日,中药板块表现活跃。截至界面发稿,华森制药、康惠制药涨停,恩威医药涨超10%,大唐药业、新光药业、葫芦娃等多股...
界面新闻记者|陈慧东水晶光电(002273.SZ)抛出一则3亿元现金买董事长等联合实控公司的预案。...
2025年3月22日,建发合诚(603909.SH)发布2024年年报。 公司营业总收入为66...
2025年3月24日下午三点A股收盘后,港股科技板块持续走强至四点十分收盘。消息面上,一方面美元相对于人民币连续3个交易...
文丨财联社本周以来,市场主要指数继续调整,截至今日(8月25日)收盘,上证指数周内累计下跌近2.2%,此...
文丨财联社知名指数公司明晟指数公司周五早间宣布季度指数调整结果,其中MSCI中国指数的季度调整将在8月3...
今天(3月23日),中国发展高层论坛2025年年会在北京举行,在此次年会上,中央财经委员会办公室分管日常工作的副主任、中...
记者|赵阳戈年初,证监会就修改《证券发行与承销管理办法》部分条款向社会公开征求意见,市场也将注意力投向了...
界面新闻记者|郭净净新冠特效药生产商苏州旺山旺水生物医药股份有限公司(简称“苏州旺山旺水”或“公司”)赴港上...
记者辛圆3月25日,博鳌亚洲论坛旗舰报告《亚洲经济前景及一体化进程2025年度报告》(以下简称《报告》...
3月25日消息,离岸人民币(CNH)兑美元北京时间04:59报7.2639元,较上周五纽约尾盘跌68点,日内整体交投于7...
实习记者|章宇璠记者|张一诺保险业再迎3项资金运用内部控制应用指引国家金融监督管...
3月24日,业内权威专家表示,MLF(中期借贷便利)不再有统一的中标利率,标志着MLF利率的政策属性完全退出。3月24日...
2025年3月25日,倍轻松(688793.SH)公告称,公司股东宁波倍松投资有限公司(简称“宁波倍松”)拟通过大宗交易...