行业资讯

DeepSeek 发布 V4.1 Flash 并启用全新定价

Heooo 09月10日18时01分 50 阅读

「DeepSeek 正式发布 V4.1 Flash 模型并执行新定价,经内部与外部多方测试,其在性能、费用、速度、总用时等指标上全面超越 V4 Pro。V4 Pro 服务推迟至 9 月 14 日中午 12 点下线,届时请求将路由至 V4.1 Flash 并按新标准计费。」

DeepSeek 官方今日向 API 用户发送通知邮件,宣布正式发布 V4.1 Flash 模型,并同步执行全新的 Flash 定价方案。与此同时,DeepSeek 开放平台也向用户推送了内容类似的通知,标志着这一新模型已完成从测试到正式上线的切换。

与新品发布同步,DeepSeek 对上一代 V4 Pro 服务的下线计划做出了调整。原定下线时间被推迟至 9 月 14 日中午 12 点,届时 V4 Pro 的请求将被自动路由到 V4.1 Flash,并按照 V4.1 Flash 的价格标准计费。这意味着开发者在过渡期内无需重写调用逻辑,接口与调用方式保持不变,但底层模型与账单口径会随之切换。

据官方说明,经过内部与外部多方测试,V4.1 Flash 在性能、费用、速度、总用时等各项指标上已经全面超越 V4 Pro。对于一个主打低延迟与低成本的 Flash 系列模型来说,这种跨代超越意味着它在部分场景下可以直接替代此前的 Pro 级服务,而开发者能够为同等质量的推理结果支付更低的成本。

价格方面,V4.1 Flash 的新定价自 9 月 10 日中午 12 点起生效。空闲时段输入缓存命中单价为 0.02 元,输入缓存未命中单价为 1 元,输出单价为 4 元;高峰时段的价格为空闲时段的两倍。缓存命中与未命中之间的巨大价差,实际上是在引导开发者复用上下文、优化提示词结构,从而在长对话、批量推理等场景中获得更显著的成本优势。

对开发者而言,此次调整带来两个直接变化。其一是模型选型的简化,V4.1 Flash 在各项指标上全面占优,原先为平衡成本与质量而设计的多模型分流策略可以重新评估。其二是成本结构的重新计算,缓存命中率将成为影响账单的关键变量,合理安排调用时段同样能明显压缩开销。随着 V4 Pro 下线时间临近,仍在使用旧模型的团队需要尽快完成迁移与压测,以确认新模型在自身业务中的实际表现。

# DeepSeek # V4.1 Flash # API 定价 # 模型发布

来源:Heooo AI工具导航