DeepSeek 三模式合一,V4.1 Flash 全面超越 V4 Pro
「DeepSeek 将快速、专家、识图三种模式整合为统一智能模式,模型可自动识别查询复杂度与图片输入。V4.1 Flash 在性能、费用、速度、总用时等指标上全面超越 V4 Pro,V4 Pro 将于 9 月 14 日下线并路由至新模型,Flash 系列定价同步调整。」
DeepSeek 宣布对旗下模型的交互方式做出重要调整,将原有的快速模式、专家模式和识图模式三个入口合而为一,整合为统一的智能模式。这意味着用户在使用过程中不再需要手动切换模式,模型会自行判断该如何处理每一次请求。
按照官方说明,统一后的智能模式具备三项自动能力:自动检测查询复杂度,在检测到图片输入时激活视觉能力,并根据任务难度动态调整处理能力。
这种设计把模式选择权从用户侧转移到模型侧,用户只需要提出需求,由模型决定调用多强的推理能力、是否需要启用视觉理解。对于不熟悉各类模式差异的普通用户而言,使用门槛被明显拉低;对于开发者而言,接口调用也变得更简单一致。
在视觉能力方面,多模态视觉理解模型 DeepSeek-V4-Flash-Vision-Exp 已经上线 DeepSeek API 平台,并支持 Chat Completions、Messages、Responses 三种格式调用,为识图能力与统一模式的落地提供了基础。
更受关注的是新模型 V4.1 Flash。DeepSeek 此前已发布预告,计划于北京时间 2026 年 9 月 10 日前后正式发布该模型。据了解,经过 DeepSeek 内部与外部多方测试,V4.1 Flash 在性能、费用、速度、总用时等各项指标上已全面超越 V4 Pro。
官方同时给出了服务过渡安排:计划于北京时间 2026 年 9 月 14 日中午 12 时下线 V4 Pro 服务,届时 DeepSeek V4 Pro 的请求将会路由到 V4.1 Flash,并按 V4.1 Flash 的标准计费。这一安排意味着旧模型的调用方无需修改代码,即可平滑迁移到新模型之上,同时也让 V4.1 Flash 成为 Flash 系列中的主力产品。
据反馈,DeepSeek 在官方交流群内发布通知称,V4.1 Flash 的中间版本内测采用了新的模型结构,具备原生多模态支持,能力更强、速度更快、成本更低。原生多模态是其中的关键变化,它意味着视觉理解不再是外挂式能力,而是从模型结构层面就具备的处理方式,这也是智能模式能够自动识别图片输入的前提。
与模型升级同步,DeepSeek 宣布自 9 月 10 日中午 12 时起调整 Flash 系列定价:空闲时段输入缓存命中单价为 0.02 元,输入缓存未命中单价为 1 元,输出单价为 4 元;高峰时段价格为空闲时段的两倍。分时段定价与缓存命中优惠的组合,为高频调用场景提供了更灵活的成本控制空间。
从模式合并、原生多模态到价格结构调整,这一系列动作指向同一个方向:让模型能力更强、调用更简单、成本更可控。对于开发者生态而言,统一入口与平滑路由降低了迁移成本,而分时定价则让批量任务可以主动选择空闲时段执行,从而进一步压低整体开销。
来源:Heooo AI工具导航