VASTOCE
RSS
行情
正在读取公开行情
人工智能

DeepSeek-V4.1-Flash 上线:官方把 Pro 流量改道到更小的新架构

九月十日 DeepSeek 正式上线 V4.1-Flash,官网与接口文档同步换上新架构说明,并把模型名改成 deepseek-flash。更要紧的是日历:九月十四日起,仍写着 deepseek-v4-pro 的请求会改道到 Flash 并按 Flash 计费。这篇对着官方页写清集成方这几天必须核对的边界。

4 分钟阅读 Vastoce

打开 DeepSeek 英文新闻页,日期写着 2026 年 9 月 10 日。标题不绕弯:介绍 DeepSeek-V4.1-Flash。API 文档同日有一条新闻稿,第一句也是同一型号。集成方这几天真正要改的,都在这两页上。

本站 9 月初写过 DeepSeek-V4 价格战横评,也写过 Harness 代理运行时。这次不是「再降一档 Flash」,而是官方明确说:这是新架构家族里最小的一款,并把旧 Pro 名字改成过渡别名。读完你会发现,真正催人改代码的不一定是新基准分数,而是一张写死的改道日历。

官方页上能抄下来的规格

新闻页把架构压成几行,我按原文结构转述:

  • 五千五百二十亿参数的混合专家模型;
  • 新的因果编码—解码架构:输入侧大约八十亿激活参数,输出侧大约一百六十亿;
  • 官方称新的预训练方法与更大规模强化学习后训练,使基准结果超过包括 DeepSeek-V4-Pro 在内的旗舰型号——这是厂商自报,不是本站复测;
  • 相对上一代,键值缓存只要大约四分之一的显存带宽占用、八分之一的固态硬盘存储。

API 侧要求把模型名设为 deepseek-flash。旧名 deepseek-v4-flash 与 deepseek-v4-flash-vision-exp 仍可调用,但对应旧模型已退役,请求会落到 V4.1-Flash,并按 Flash 计费。官方「第一次调用」页在 9 月 11 日抓取时,示例模型字段已是 deepseek-flash,脚注把退役与改道写得很直白。

合作伙伴名单官方点了 WorkBuddy(含 CodeBuddy)与 OpenCode。消费端 App 是否全量切到同一后端,新闻页没有逐条写死,集成以 API 文档为准。若你只在网页聊天框里试,看到的产品名可能和接口模型名不完全同字,不要用界面文案覆盖文档。

九月十四日改道:名字还在,账单会变

比「新模型上线」更值得写进值班笔记的是这一句(新闻稿与入门页一致):

从 2026 年 9 月 14 日协调世界时四点(北京时间中午十二点)起,所有 deepseek-v4-pro 请求将路由到 V4.1-Flash,并按 V4.1-Flash 费率计费;直到未来的 V4.1-Pro 发布。

意思很具体:你代码里如果硬编码了 deepseek-v4-pro,十四日之后请求多半不会直接报错,但背后的模型与单价都会换。官方理由是多方测试显示 V4.1-Flash 在性能、成本、速度与总耗时上全面超过 V4-Pro,因此有序淘汰 Pro。未点名「多方」是谁,应视为厂商主张。

对我们的看法是:这比「悄悄换权」更干净——至少给了日历。风险在于,任何按「Pro 能力档」做服务等级或评测基线的系统,若不在十四日前自己跑一遍对照,会把账单下降误读成「同模型打折」。另一种风险更隐蔽:监控面板仍显示旧模型名,值班同学会以为 Pro 还在,实际延迟曲线已经换成另一套。

价格:官方确认分时,具体美元价看价目页与平台公告

新闻页确认三件事。第一,继续高峰与非高峰分时。第二,非高峰价是高峰价的一半。第三,新价自 2026 年 9 月 10 日协调世界时四点生效。

美元单价不在新闻页正文里展开。交叉核对平台公告被讨论区全文粘贴的 Flash 调价说明、以及多家对官方价目的转述:非高峰档大约是缓存命中输入百万分之三美元、缓存未命中输入零点一五美元、输出零点六零美元;高峰约为两倍。截至 9 月 11 日,仍以官方「模型与定价」页实时显示为准;本站不把第三方表格当成不可改的定论。

缓存命中价远低于未命中,和官方强调「压缩键值缓存能砍掉代理任务成本」是同一条逻辑线。能调度的批任务,错到非高峰仍是直接省钱的开关。若你的链路大量重复系统提示词,先确认缓存是否真的命中,再谈换模型。

第一次够用的核对清单

第一,把新请求的模型字段写成 deepseek-flash,别继续赌旧别名。第二,在 9 月 14 日前,用同一组生产提示词对 deepseek-v4-pro 与 deepseek-flash 做输出与延迟对照,至少覆盖工具调用与长上下文两类。第三,打开价目页,确认高峰窗口(官方以协调世界时标注的工作日时段为准)是否撞上你的批处理。第四,有视觉输入的链路,按文档确认原生多模态参数,不要假设旧视觉实验别名行为不变。第五,自托管权重若走开源路径,以官方后续开源说明为准;新闻页只写「会与开源社区合作推理支持」,没有在这篇里展开硬件门槛。

厂商基准表是他们自己报的,不是本站复测,更不是「已经赢过所有闭源旗舰」。V4.1-Pro 什么时候回来,新闻页没写日期。官方明确说 Pro 会回来,中间用 Flash 顶着,所以改道也不等于放弃高端。代理怎么挂插件,是 Harness 那条线,别和底层模型搅在一起。

9 月 10 日换的是架构与默认模型名;9 月 14 日换的是仍叫 Pro 的那条请求管线。把十四日写进日历提醒,比再读一篇评测有用。

常见问题

模型名应该写什么?

官方要求使用 deepseek-flash。旧名 deepseek-v4-flash 与视觉实验旧名仍可用,但已退役并由 V4.1-Flash 承接。

九月十四日会发生什么?

自协调世界时四点起,deepseek-v4-pro 请求改道到 V4.1-Flash,并按 Flash 价计费,直到未来 V4.1-Pro。

架构数字哪来的?

官方新闻页:五千五百二十亿参数混合专家;输入约八十亿、输出约一百六十亿激活;键值缓存约为上一代四分之一显存、八分之一固态存储。

价格写死了吗?

新闻页确认分时与「非高峰等于高峰一半」、新价自九月十日协调世界时四点生效。具体美元数字以官方价目页与平台公告为准。

这和 Harness 一篇什么关系?

Harness 讲代理运行时;这篇讲底层模型与接口改道。可分开读。

参考资料

  1. DeepSeek 官方新闻 — Introducing DeepSeek-V4.1-Flash
  2. DeepSeek API Docs — news260910
  3. DeepSeek API Docs — Your First API Call(模型名与 Pro 改道脚注)
  4. Hacker News 讨论串(含平台调价公告全文粘贴)