# DeepSeek 的 Pro 接口即将“名不副实”？

**Summary:** DeepSeek 宣布所有 V4 Pro 请求将暂时路由到 V4.1 Flash 模型，并按 Flash 价格计费。价格更便宜固然好，但 API 名称与实际模型脱钩，会给审计、评估和回滚带来隐患。

- Canonical: https://markhuang.ai/zh/news/deepseek-pro-endpoint-will-serve-flash
- Language: zh-CN
- Author: [Mark Huang](https://markhuang.ai/about)
- Published: 2026-09-09
- Section: News
- Tags: DeepSeek V4.1 Flash, DeepSeek V4 Pro, 模型路由, API 版本控制, AI 评估
- Source: [Hacker News](https://news.ycombinator.com/item?id=49624603)
- License: https://creativecommons.org/licenses/by-nc/4.0/

---

![一束蓝色数据流穿过一个隐藏的机械节点，从一个大型计算核心流向一个较小的核心](https://cdn.markhuang.ai/news/deepseek-pro-endpoint-will-serve-flash/hero.webp)

*固定的 API 接口背后藏着模型切换。要复现昨天的结果，你得知道请求走了哪条路。*

一篇[Hacker News 帖子](https://news.ycombinator.com/item?id=49624603)转述了 DeepSeek 平台的一则公告，该公告改变了现有 API 名称的实际含义。DeepSeek 计划在 2026 年 9 月 10 日左右发布 V4.1 Flash，然后在 V4.1 Pro 到来前，将所有发往 V4 Pro 的请求都路由到这个新的 Flash 模型上，并按 Flash 的价格计费。

公告还列出了新的非高峰时段费率：每百万缓存输入 Token 0.003 美元，每百万非缓存输入 Token 0.15 美元，每百万输出 Token 0.60 美元。高峰时段价格是其两倍。价格更低、速度更快，这当然受欢迎。但问题出在名字上：切换之后，当你请求 `deepseek-v4-pro` 时，DeepSeek 提供的就不再是 V4 Pro 了。

即使 DeepSeek 声称 V4.1 Flash 在性能、成本、速度和总任务时间上全面优于 V4 Pro，我也倾向于将其视为一次迁移。厂商的笼统说法无法告诉我，我的解析器或编码智能体的行为是否会保持一致。账单可能会下降，但追踪记录却会变得模糊。

## 折扣的背后是另一个模型

这里确实有实实在在的客户利益。DeepSeek 并没有在将流量导向更便宜模型的同时收取 Pro 费用。[IT之家也报道了同一份平台公告](https://www.ithome.com/1/000/222.htm)，并给出了以人民币计价的新非高峰价格：每百万缓存输入 Token ¥0.02，非缓存输入 Token ¥1，输出 Token ¥4。高峰价格翻倍。这些数字与帖子中提到的美元价格相符。

DeepSeek 还表示，经过内部和外部测试，V4.1 Flash 在所有公布的维度上都已超越 V4 Pro。这很吸引人，但公告并未公布测试集、评测框架、分数明细、供应商条件或失败案例。“产品层面更好”因此只是一个进行评估的理由，而非保证每个现有的 Pro 工作负载都会得到改善。

对我的谨慎，有人可能会反驳：如果 Flash 更便宜、更快、能力更强，为什么还要让用户选择一个更差的模型？因为整体提升和行为兼容性是两个不同的问题。一个模型可以在更多任务上胜出，同时在某个特定团队赖以盈利的狭窄提示、输出格式或工具序列上出现退步。

> **Info:**
>
> 在 9 月 10 日之前，我会保存一小批有代表性的 Pro 请求及其预期输出。路由变更后，我会重放这些请求，如果 DeepSeek 提供了实际服务的模型版本，就记录下来，并比较失败模式和延迟，同时通过另一个固定的端点或提供商保留回滚路径。

## 稳定的别名也会毁掉对比

DeepSeek 的[官方定价页面](https://api-docs.deepseek.com/quick_start/pricing/)目前将 `deepseek-v4-flash` 映射到 DeepSeek-V4-Flash-0731，将 `deepseek-v4-pro` 映射到 DeepSeek-V4-Pro-0813。两者都支持 100 万 Token 的上下文，并宣称最大输出为 38.4 万 Token。这些友好的 API 名称背后已经是过时的版本了。

[官方更新日志](https://api-docs.deepseek.com/updates/)明确说明了这种安排。8 月 13 日，DeepSeek 表示调用者可以继续使用相同的 Pro 模型名称来接收新的 GA 版本。7 月 31 日的 Flash 更新也同样保留了 Flash 名称，只是更改了其背后的版本。别名让升级变得简单，但新计划走得更远：一个 Pro 别名将临时解析到一个不同层级的模型上。

每当需要复现结果时，这一点就至关重要。一份说“我们用了 V4 Pro”的回归报告，在切换前后就变得模棱两可了。评估的趋势线也是如此，除非测试记录保存了实际服务的版本。如果 API 响应只回显了请求的别名，DeepSeek 就应该添加不可变的版本元数据。如果它已经提供了该元数据，团队就需要存储它，而不是只记录请求体和端点。

我不会把切换后收集的 V4.1 Flash 结果与旧的 Pro 结果进行比较，并称之为公平的重新测试。模型变了，周围的服务也可能随之改变。这个别名恰恰隐藏了实验需要保持的那个变量。

## 公开测试仍为时过早

公众的反应热情但单薄。在 HN 的讨论中，一位评论者将公告追溯到 DeepSeek 使用页面上的一个横幅，而其他人则关注 Flash 版本首次超越 Pro 这件新鲜事。一个[同日的 Reddit 帖子](https://www.reddit.com/r/DeepSeek/comments/1wan8tr/is_deepseek_v41_flash_avaiable_on_web_thanks/)包含了早期的 API 体验报告，并提到该测试版仅通过官方 API 提供。这些都是有用的线索，但不能替代已发布的评估。

发布通知要求用户报告在对比测试中发现的问题。这个要求合情合理，但也告诉我，客户的工作负载本身就是验证过程的一部分。DeepSeek 在这些客户还有充足时间发布测试结果之前，就做出了路由决定。

当[V4 Pro 0813 在缺乏详细技术差异说明的情况下达到正式发布状态](/news/deepseek-v4-pro-0813-ga-missing-diff)时，我就得出了类似的结论：固定能固定的部分，让新版本在真正重要的工作负载上赢得流量。V4.1 Flash 很可能能够胜任，但强制路由只是剥夺了用户按自己的节奏进行测试的选择权。

## 我对 DeepSeek 的期望

DeepSeek 应该公布“在所有关键指标上全面超越”这一说法背后的对比数据。它不需要证明全面领先。一份任务清单、评测框架配置、延迟定义和已知的性能下降案例，就能让客户判断证据是否适用于自己的场景。

我也希望在每个响应和用量导出中都能看到不可变的模型版本。计费仍然可以遵循更便宜的 Flash 费率。请求的别名和实际服务的版本应该放在不同的字段里，因为它们回答的是不同的问题。

生产环境的用户应该有一个临时的退出选项或一个带版本号的 Pro 端点。有些人会立即接受新路由。另一些人则有合同约定的测试、受监管的记录或敏感的集成，对他们来说，可控的迁移比 Token 折扣更有价值。

我很喜欢这次降价，一旦 V4.1 Flash 可用，我就会把它放入影子测试中。但我不会假装这个端点没变。DeepSeek 在保留名称的同时更换了模型，这给用户带来了优惠的价格，却也留下了一个脆弱的版本契约。
