DeepSeek Harness公测,全面对标Claude Cowork
「DeepSeek开源代码智能体框架Harness预览版,发布V4-Pro-0813模型,采用“一切皆插件”设计,提供四种运行模式,模型权重MIT许可开放,性能大幅提升,瞄准编程与办公场景。」
DeepSeek正式推出了其开源代码智能体框架Harness的v0.1开发者预览版,并同步发布了DeepSeek-V4-Pro-0813模型。这一组合将模型能力与智能体执行框架深度整合,形成“Model+Harness=Agent”的完整闭环。该框架基于MIT协议开源,并同步开放了配套的插件生态系统,开发者可通过npm或Git源码等方式快速启动。
DeepSeek Harness在产品定位上精准对标OpenAI Codex及Anthropic Claude Cowork,致力于成为一款主打编程与办公场景的AI生产力工具。其设计核心是“一切皆插件”,从模型、工具、技能、会话,到沙箱、存储、循环、调度、UI等所有Agent能力,均可由插件自由替换与重组。该框架基于具有时空可组合性的Cordis插件系统构建,开发者无需改动源码,即可通过插件独立选择或扩展任意能力。
针对不同的使用场景,DeepSeek Harness提供了四种运行模式。标准模式提供完整工具组合;PTC模式支持程序化工具调用,由模型生成代码来组合多轮工具调用;极简模式仅保留一个shell工具与一个文件编辑工具,用于最小环境下的模型基准测试;创造模式则允许开发者检查运行时、在内存中试验Cordis插件,并组合创作新模式。
同步发布的DeepSeek-V4-Pro-0813是一款基于混合专家(MoE)架构的大模型,总参数量高达1.6万亿,但实际推理中每个token仅激活490亿参数。该模型拥有100万token的上下文窗口,支持最大38.4万token的输出长度,并提供“思考模式”与“非思考模式”两种交互选项,其中思考模式为默认设置。V4 Pro全面支持JSON结构化输出、Tool Calls、Responses API及Anthropic API等高级功能。
据DeepSeek内部测评,正式版相比预览版能力大幅提升。在Terminal Bench 2.1测试中得分达到87.9,远超预览版的72.1;DeepSWE从12.8跃升至62.7;DSBench-Hard翻倍至67.2。在多项测试中接近甚至超越Claude Fable 5。此外,DeepSeek-V4-Pro-0813的权重已正式开放,采用MIT许可证,开发者可下载自建,摆脱对特定算力的依赖,降低私有化部署门槛,提升供应链抗风险能力。
来源:Heooo AI工具导航