行业资讯

DeepSeek V4 Pro登陆硅基流动 百万上下文三档强度

Heooo 08月14日18时34分 49 阅读

「DeepSeek-V4-Pro-0813在硅基流动Day-0首发,支持1M上下文窗口和低、高、最大三档推理强度,聚焦编码、工具调用与智能体工作流,继续采用MIT开源协议。定价方面,每百万输入token收1.32美元,输出收3.96美元,缓存命中仅需0.44美元,大幅降低长上下文场景成本。」

DeepSeek-V4-Pro-0813正式上线硅基流动(SiliconFlow),并实现Day-0首发。此次更新的核心卖点集中在三个数字和一种取向上:1M上下文窗口、低/高/最大三档推理强度,以及明确将产品重心压向编码、工具调用和智能体工作流。开源协议依旧保持MIT不变,延续了DeepSeek系列在开发者社区中的开放策略。

定价结构已经公布,每百万输入token收费1.32美元,每百万输出token收费3.96美元,而缓存命中token仅需0.44美元。最后这个数字值得深究——对于大量依赖反复调用、长期运行长上下文输入的Agent工作流而言,缓存命中价格被压到这一水平,意味着长文本场景下的单位成本测算有了更具体的锚点。开发者无需担心一跑长上下文就烧穿预算,可以更精细地规划推理开销,将更多算力投入到真正复杂的任务环节。

同系列中还有DeepSeek-V4-Flash-0731,其定位截然不同。Flash版本面向追求速度和高性价比的日常生产负载,走的是“快而省”的路线;而V4 Pro则冲着复杂推理、编码和智能体工作流去,要的是“脑子”。两个型号一快一重,将日常生产与重度推理的档位明确分开,用户可以根据实际场景按需选择,避免为用不上的能力额外付费。

从整体布局来看,DeepSeek在硅基流动上同时提供Flash与Pro两条产品线,既覆盖了对延迟敏感、高频调用的轻量任务,也满足了需要深度思考和长上下文支撑的重度应用。这种双轨策略有望进一步提升开发者在智能体、代码助手以及自动化工作流等场景下的生产力。

# DeepSeek # 硅基流动 # 大模型

来源:Heooo AI工具导航