新款AI模型助力企业大幅削减成本
「AI服务商Writer发布旗舰模型Palmyra X6,基于Z.ai开源模型GLM-5.2后训练变体,结合运行框架优化,基础任务成本最高削减50%。研究显示微调运行效率可平均降本40%。CEO强调企业需要可控成本。目前该模型已全面开放。」
随着人工智能技术在企业场景中的广泛渗透,高昂的Token调用费用正成为许多组织难以回避的痛点。针对这一现状,AI服务商Writer在本周推出了全新旗舰模型Palmyra X6,并对底层智能代理运行程序进行了重大升级,试图在性能与成本之间找到更优的平衡点。
根据官方披露,Palmyra X6建立在Z.ai开源模型GLM-5.2的后训练变体基础之上。结合全新的运行框架优化,该系统能够针对基础任务将客户成本大幅削减高达50%。这一数字在当前的AI市场中极具竞争力,也直接回应了企业用户对“越用越贵”的普遍担忧。
Writer首席执行官May Habib在发布时直言,当前的行业现状让许多CIO感到厌倦。企业需要的并不是盲目追逐下一个跑分天花板,而是真正可控的成本。这一表态折射出AI商业化进程中的一个重要转折:随着模型能力逐渐趋同,企业采购AI服务的决策逻辑正在从“参数竞赛”转向“成本效益比”的精细化考量。
除了新模型本身,运行程序的架构优化也是此次升级的核心亮点。Writer近期发布的一项研究显示,相比单纯挑选不同的大模型,微调运行效率往往是更可靠的降本途径。其测试结果指出,相关成本平均下降了40%。这意味着,运行框架作为底层组件,能够成倍提升组织内部运行所有模型的效率,而不仅仅局限于单一模型。
目前,Palmyra X6已经面向企业客户全面开放。用户既可以将其与现有工具结合使用,也可以通过云平台进行调用。这种灵活的交付方式,降低了企业的部署门槛,使得降本方案可以更快地融入既有业务流程。
业内人士认为,这一动作折射出当前市场环境的变化。在AI部署成本持续飙升的背景下,如何通过技术手段遏制支出,正成为各大企业当下的首要考量。Writer的此次发布,或许预示着AI行业将迎来一轮以“降本”为主题的竞争浪潮。
来源:Heooo AI工具导航