Writer推新模型Palmyra X6降本50% 封面图
行业资讯

Writer推新模型Palmyra X6降本50%

Heooo 08月14日05时31分 19 阅读

「AI企业Writer发布基于GLM-5.2的旗舰模型Palmyra X6,并同步升级其agentic harness架构,宣称可为用户降低高达50%的token成本。研究显示,优化harness比更换模型更能稳定降低成本,平均节省达40%。」

随着AI部署成本持续攀升,企业对高性价比解决方案的需求日益迫切。在此背景下,专注营销领域AI工具的公司Writer于近日推出全新旗舰模型Palmyra X6,并同步升级其核心的agentic harness基础设施,旨在帮助客户显著降低token使用成本。

Writer推新模型Palmyra X6降本50%

Palmyra X6并非从零训练的模型,而是基于Z.ai开源的GLM-5.2进行后训练优化而来。Writer强调,该模型专为“开箱即用”的企业部署场景设计,在保持高性能的同时大幅压缩推理成本。据公司估算,结合新模型与harness升级,客户在执行基础任务时最高可节省50%的支出。

值得注意的是,Writer并未将降本策略完全寄托于模型本身。公司同步对标准agentic harness进行了重大改进。所谓“harness”,是指连接、调度和管理AI模型的运行框架,负责处理提示工程、上下文管理、多步任务编排等关键环节。Writer认为,优化这一层架构对成本控制具有乘数效应。

这一观点得到了其内部研究的支持。近期一篇由Writer研究人员发表的论文指出,在多个不同模型上测试微小的harness效率调整后,成本平均下降40%。相比之下,单纯更换模型带来的成本波动更大且效果不稳定。“harness是唯一一个其效率能乘以组织当前及未来所有模型的组件,”研究人员写道。

Writer推新模型Palmyra X6降本50%

Writer CEO May Habib在采访中直言,企业已厌倦追逐不断刷新的基准分数,转而追求可预测且扁平化的成本结构。“目前客户的成本爆炸前所未有,CIO们正大规模放弃对主流AI实验室的信任,”她表示,并批评大型AI实验室缺乏帮助企业真正从AI中获益的深层理解。

尽管推出了自有模型,Writer仍坚持其平台的模型无关性(model-agnostic)策略。客户既可使用Palmyra X6,也可继续调用Writer其他模型,或通过Azure、Amazon Bedrock等渠道接入外部模型。新模型与升级后的harness已于发布当日向所有客户开放。

此次发布凸显了AI行业从“性能优先”向“成本效益优先”的战略转向。随着企业级AI应用进入深水区,如何在不牺牲能力的前提下控制运营成本,正成为决定技术落地成败的关键因素。Writer通过“开源模型+深度优化+架构革新”的组合拳,试图在这一赛道建立差异化优势。

# Palmyra X6 # token成本优化 # agentic harness # 企业AI # 模型部署

来源:Heooo AI工具导航