DeepSeek V4.1 Flash 已上线 BenPay AI API,支持按 Peak Hours(高峰时段)和 Other Time Periods(其他时段)查看价格。
目前,V4.1 Flash 在 BenPay 的非高峰输入价格为每百万 tokens $0.15,输出价格为 $0.60,缓存读取价格为 $0.003,均为对应高峰单价的一半。
对于同时使用 DeepSeek、GPT、Claude 等模型的用户,BenPay 还提供共享余额和集中用量管理,可以在同一个账户下比较模型价格、测试实际任务并查看调用支出。
本文介绍 V4.1 Flash 的最新状态、峰谷价格、与 V4 Pro 的成本差异,以及什么情况下适合通过 BenPay 使用 DeepSeek。
DeepSeek V4.1 Flash 是什么?目前是否已经开放 API?
DeepSeek 于 2026 年 9 月 10 日正式发布 V4.1 Flash。它属于 DeepSeek 新架构系列,具备原生多模态视觉理解能力,已同步开放官方 API。
DeepSeek 最新说明也已明确:2026 年 9 月 14 日之后继续提供 V4 Pro API 服务,计费方式保持不变。此前的停用安排已经调整,应以最新文档为准。
使用 V4.1 Flash 时,需要区分官方与 BenPay 的模型标识:
| 接入方式 | V4.1 Flash Model ID |
|---|---|
| DeepSeek 官方 API | deepseek-flash |
| BenPay AI API | deepseek-v4.1-flash |
通过 BenPay 调用时,应使用 BenPay 提供的接口地址、API Key 和 Model ID。
DeepSeek V4.1 Flash API 在 BenPay 的价格是多少?
下表为 BenPay AI API 页面展示的价格,单位均为 USD / 1M tokens,即美元/每百万 tokens。
| 模型 | 计费时段 | Input 输入 | Output 输出 | Cache Read 缓存读取 |
|---|---|---|---|---|
| DeepSeek V4.1 Flash | 非高峰时段(Other Time Periods) | $0.15 | $0.60 | $0.00 |
| DeepSeek V4.1 Flash | 高峰时段(Peak Hours) | $0.30 | $1.20 | $0.01 |
| DeepSeek V4 Pro | 非高峰时段(Other Time Periods) | $0.66 | $1.98 | $0.02 |
| DeepSeek V4 Pro | 高峰时段(Peak Hours) | $1.32 | $3.96 | $0.04 |
这些是按 token 用量计算的单价,并非每次请求的固定费用。输入、输出和缓存读取应按各自的计费用量分别核算。
截至本文核对日,表中两款模型的各项单价与 DeepSeek 官方公布的对应美元报价一致。后续价格如有调整,以各平台最新页面为准。

高峰时段与非高峰时段的价格有什么区别?
Peak Hours 指适用高峰价格的时段;Other Time Periods 指高峰之外、适用较低价格的其他时段,本文称为非高峰时段。
BenPay 页面标注的高峰时段为北京时间(UTC+8)周一至周五 09:00–12:00 和 14:00–18:00。其余时间均属于非高峰时段,包括工作日午间 12:00–14:00、上述区间之外的其他时间,以及周末。
这一安排与 DeepSeek 官方公布的高峰时段一致。官方使用 UTC 表示,为周一至周五 01:00–04:00 和 06:00–10:00,换算为北京时间即为上述两个区间。
以 V4.1 Flash 为例,非高峰输入单价为 $0.15,高峰为 $0.30;输出单价分别为 $0.60 和 $1.20。缓存读取以及 V4 Pro 的各项价格也遵循相同的比例。
因此,在模型、各类计费 token 数量及缓存命中情况相同的前提下,非高峰 token 费用为高峰费用的 50%。
对于可以灵活安排时间的任务,例如批量整理文档、生成摘要或处理离线内容,可以评估是否放在非高峰时段执行。实时交互任务则需要同时考虑响应时效。
如遇时段规则调整,或请求跨越高峰与非高峰边界,具体计费归属以 BenPay 最新说明及实际账单为准。

DeepSeek API 调用成本怎么算?
估算费用时,需要分别计算输入、输出和缓存读取用量。缓存命中部分与未命中部分应分开核算,避免将同一批输入 tokens 重复计费。
例如,一组 V4.1 Flash 请求累计产生:
- 100 万个未命中缓存的输入 tokens;
- 20 万个计费输出 tokens;
- 无缓存读取用量。
按 BenPay 当前展示价格计算:
| 计费时段 | 输入费用 | 输出费用 | 合计 |
|---|---|---|---|
| 非高峰时段 | 1 × $0.15 = $0.15 | 0.2 × $0.60 = $0.12 | $0.27 |
| 高峰时段 | 1 × $0.30 = $0.30 | 0.2 × $1.20 = $0.24 | $0.54 |
这里假设全部用量适用同一档价格。示例只计算列出的 token 费用;如涉及充值或外部转账费用,应另行核算。
实际项目的总支出不一定下降 50%。输出长度、重试次数、缓存命中量及不同计费时段的用量占比,都可能影响最终账单。评估成本时,应结合实际调用记录,而不是只比较输入单价。
如果需要进一步了解各类 token 如何影响费用,可阅读 AI API 计费与 Token 成本计算指南。
V4.1 Flash vs V4 Pro:价格和能力有哪些差异?
按照 BenPay 当前价格,在相同时段内,V4.1 Flash 的输入、输出和缓存读取单价均低于 V4 Pro。
| 价格项目 | V4.1 Flash 相比 V4 Pro 的单价降幅 |
|---|---|
| Input 输入 | 约 77.3% |
| Output 输出 | 约 69.7% |
| Cache Read 缓存读取 | 约 86.4% |
以上比例由前述价格表计算得出,适用于高峰和非高峰两档价格。它们描述的是单价差异,不能直接作为完成任意任务的总成本降幅。
能力方面,DeepSeek 官方资料列明:V4.1 Flash 支持视觉输入,V4 Pro 不支持;两者均支持思考与非思考模式、JSON 输出和工具调用。
实际选型时,可以用同一组业务样本比较输出是否达到要求、响应时间、计费 token 用量和重试需求。如果两款模型都能满足任务要求,较低的单价才更容易转化为实际成本优势。
价格与官方一致,为什么通过 BenPay 使用 DeepSeek?
对于本文列出的两款模型,BenPay 当前展示的美元 token 单价及高峰时段与 DeepSeek 官方一致。选择 BenPay 的实际价值,取决于你是否需要同时管理多个模型,以及希望如何为 API 使用充值。
同时使用多个模型,减少分别管理账户和余额的工作
如果一个项目既使用 DeepSeek,也需要 GPT 或 Claude,分别接入多个服务商通常意味着管理多套账号、密钥和余额。通过 BenPay AI API,可以使用同一个 API Key 访问平台支持的多个模型,并从共享的 AI API 余额中支付调用费用。
例如,一个团队可以在同一账户下测试 DeepSeek 和其他模型,并集中查看各自的用量与支出。模型由用户按任务选择,具体功能以平台支持范围为准。有关接入方式,可阅读一个 API Key 如何调用多个主流 AI 模型。
已有 BenPay AI API 账户,可以继续使用现有余额
已经通过 BenPay 调用其他模型的用户,可以在现有账户下使用 V4.1 Flash,无需为这款模型另建一个 DeepSeek 官方账户并单独充值。
对于经常测试新模型的用户,共享余额能减少新增账户和分散余额的管理工作,也便于在同一处查看不同模型的实际支出。
希望使用 USDT、USDC 等资产充值
BenPay 提供外部钱包和 BenPay 钱包充值路径,支持付款页面列出的 USDT、USDC 等资产。对于已经持有这些资产的用户,可以按现有付款习惯为 AI API 余额充值。
具体操作见 USDT/USDC AI API 充值指南,支持资产、网络和相关费用以结账页面为准。
如果你只使用 DeepSeek,且已经能够顺畅使用官方 API,是否切换可以按实际需求决定。对于需要多个模型、共享余额或加密资产充值的用户,BenPay 提供了更集中的接入与费用管理方式。
如何开始使用 BenPay 上的 V4.1 Flash?
- 登录 BenPay,进入 AI API 页面。
- 在 Supported Models 中找到 DeepSeek V4.1 Flash,查看价格并复制 Model ID:
deepseek-v4.1-flash。 - 创建 API Key,并确认 AI API 余额足够;需要时按页面提示充值。
- 在客户端填写 BenPay 提供的接口地址和 API Key,将模型设置为
deepseek-v4.1-flash,发送测试请求。 - 检查返回结果与用量记录,确认实际任务的输出质量和费用。
具体操作可参考 BenPay AI API 入门指南。先用一组实际任务测试,再决定是否扩大调用量,有助于建立更准确的预算。

FAQ
DeepSeek V4.1 Flash API 是免费的吗?
本文列出的是付费 token 单价。每次请求的费用取决于实际计费用量及适用时段,不能把每百万 tokens 的价格理解成单次调用费。
BenPay 的 DeepSeek V4.1 Flash 价格比官方低吗?
截至本文核对日,价格表中的各项单价与官方对应美元报价一致。BenPay 的主要差异在于多模型接入、共享余额、集中用量管理和充值方式。
非高峰价格是否适用于缓存读取?
是。按 BenPay 当前展示,V4.1 Flash 的 Cache Read 非高峰价格为 $0.003/百万 tokens,高峰价格为 $0.006/百万 tokens。V4 Pro 分别为 $0.022 和 $0.044。
非高峰时段就是夜间吗?
不是。北京时间周一至周五 09:00–12:00、14:00–18:00 为高峰时段,其余时间均为非高峰时段,包括工作日午间 12:00–14:00 和周末。
通过 BenPay 调用 V4.1 Flash,应该填写哪个模型名称?
按当前支持模型页面,填写 deepseek-v4.1-flash。DeepSeek 官方 API 使用的 deepseek-flash 是另一接入方式下的模型标识,应与所使用的平台配置对应。
V4.1 Flash 比 V4 Pro 便宜,是否意味着所有任务都应切换?
单价更低并不能证明每个任务都更适合切换。应结合所需能力、输出质量、响应时间和实际 token 用量评估。对现有业务,可以先用小规模样本比较完成同类任务的实际费用。
结合模型价格与任务时间,安排 DeepSeek API 预算
DeepSeek V4.1 Flash 上线后,BenPay 用户有了单价更低的 DeepSeek 模型选择。与 V4 Pro 相比,V4.1 Flash 当前的输入、输出和缓存读取单价均更低;对于能够灵活安排时间的任务,在相同模型和计费用量下,非高峰 token 费用为高峰费用的一半。
对于需要多个模型或加密资产充值的用户,BenPay 还可以将模型接入、余额和用量记录集中在同一处。是否选择 V4.1 Flash,则应结合实际任务结果和账单判断。
进入 BenPay AI API,查看支持模型与最新峰谷价格,并用一组实际任务测试 V4.1 Flash,为后续调用建立更准确的成本预期。

