技术进展

DeepSeek V4 Flash轻量模型挑战Agent任务极限

Heooo 07月31日19时01分 41 阅读

「DeepSeek-V4-Flash正式版API上线,以130亿激活参数在Agent基准测试中逼近V4-Pro。该模型总参数2840亿,仅重新后训练,结构不变,性能显著提升。自研Agent框架DeepSeek Harness首次亮相,原生支持Responses API,开发者可低成本迁移。此举旨在以高性价比切入Agent市场,加速商业化进程。」

DeepSeek-V4-Flash正式版于7月31日悄然上线公测,这一动作标志着DeepSeek在Agent赛道上的关键布局。与以往“Pro强、Flash弱”的常规分层不同,此次Flash正式版在多项Agent基准测试中的表现已逼近甚至超越三个月前的V4-Pro预览版,展现出轻量模型的巨大潜力。

官方数据显示,V4-Flash正式版在Terminal Bench2.1上取得82.7分,Cybergym达76.7分,Toolathlon verified为70.3分。值得注意的是,该模型总参数2840亿,激活参数仅130亿,与V4-Pro的490亿激活参数相比,相差近一个数量级。DeepSeek明确表示,此次更新“仅重新进行了后训练”,模型结构完全不变。这意味着,通过训练方法和数据质量的优化,轻量模型在特定任务上正逐步缩小与旗舰模型的差距。

此次升级的另一大亮点,是自研Agent框架DeepSeek Harness首次以正式命名亮相。同时,V4-Flash原生支持OpenAI力推的Responses API格式,并针对性适配Codex,开发者可以低成本将OpenAI生态的Agent应用迁移至DeepSeek平台。这一策略不仅降低了开发者的迁移门槛,也为DeepSeek生态的快速扩张提供了有力支撑。

从战略层面看,DeepSeek的意图十分清晰:用高性价比的轻量模型切入Agent应用市场。Agent场景对推理速度和成本极度敏感,Flash的低价优势在反复调用工具的多轮任务中将形成显著竞争力。此次发布距离DeepSeek完成超500亿元首轮融资不足两月,公司估值已攀升至约710亿美元。在资本加持下,DeepSeek正加速从“不融资不上市”转向商业化冲刺。

随着Pro正式版即将到来,Agent战争的大幕已然拉开。DeepSeek通过V4-Flash的发布,不仅展示了其在模型优化上的技术实力,也向市场传递了其进军Agent领域的决心。未来,轻量模型与旗舰模型的协同发展,或将成为大模型竞争的新常态。

# DeepSeek # V4-Flash # Agent # 轻量模型 # API

来源:Heooo AI工具导航