Grok 4.7发布:推理速度翻倍,价格砍半
「SpaceXAI发布Grok 4.7模型,官方数据显示其推理速度达到可比同类模型的两倍,调用价格仅为对方的一半。定价方面,输入Token每百万个收费2美元,输出Token每百万个收费6美元。速度与成本同时优化,进一步抬高大模型性价比门槛。」
SpaceXAI正式发布Grok 4.7模型。与常见的参数规模军备竞赛不同,这次官方把宣传重心放在了两个更贴近开发者日常账本的指标上:推理速度与调用价格。按照官方给出的数据,Grok 4.7的推理速度达到可比同类模型的两倍,而价格只有对方的一半,性价比的门槛被再一次抬高。
价格方面,Grok 4.7延续按Token计费的方式:输入Token每百万个收费2美元,输出Token每百万个收费6美元。这两个数字需要分开来看。对于检索增强、长文档分析、代码库理解这类需要大量上下文输入的任务,输入侧的低价尤为关键,因为提示词长度往往远超模型实际生成的文本长度;而在智能体、多轮工具调用、复杂推理链等场景中,输出Token的占比明显更高,输出单价直接决定了单次任务的总体开销。
速度翻倍叠加价格减半,带来的效果并不是两条独立消息的简单相加。推理延迟下降,意味着交互式应用的响应体验得到改善,单位时间内可完成的请求数量上升,同等算力资源能够承载更高的并发;单价下降,则让一些原先因为成本过高而无法规模化的功能变得可行,比如把模型嵌入高频调用的自动化流程、对海量存量数据做批处理式的理解与归类,或是让智能体在更长的推理链上反复自我校验。
从竞争格局看,大模型厂商近期的比拼重点正在从单纯的跑分,转向推理效率与单位成本。对开发者而言,评估一个模型是否值得迁移,不仅要看单价表,还要看自身业务的输入输出比例、平均上下文长度以及可接受的延迟上限。速度与成本同时优化,往往比单项指标的提升更能改变实际的技术选型。
目前官方公布的信息主要集中在Grok 4.7的推理速度与计费价格两项,关于模型规模、上下文窗口、多模态能力等细节尚未在素材中体现。对于正在做模型选型的团队来说,可以结合自身业务的Token结构,对这一速度与价格组合做一次成本测算,判断其在高频调用与长上下文两类典型负载下的实际收益。
来源:Heooo AI工具导航