技术进展

SpaceXAI发布最强编码模型Grok 4.7

Heooo 09月22日09时33分 35 阅读

「SpaceXAI推出新一代AI模型Grok 4.7,专为编程与知识工作优化,支持百万词元长上下文,输入每百万词元仅2美元。新模型在多项专业基准测试中表现优异,并强化了安全防护能力。」

SpaceXAI近日正式发布了其最新一代人工智能模型 Grok 4.7,该模型被定位为公司当前最强的编码与知识处理工具,专为开发者和专业人士打造。


据官方介绍,Grok 4.7 基于更大规模的基础模型架构,并通过更长时间的强化学习训练,显著提升了在复杂、长时间任务中的持续推理与自我验证能力。相较于前代 Grok 4.6,新模型在处理困难任务时更具耐力,并能更有效地检查自身输出结果的准确性。


在性能方面,Grok 4.7 在 CursorBench 4.0 编程基准测试中表现出色,尤其在长时间运行的编程任务中,兼顾高性价比与高效能。尽管性能大幅提升,其定价策略却更为亲民:输入每百万词元仅需 2 美元,输出为 6 美元。此外,SpaceXAI 还提供了高速版本,输出速度翻倍,价格同步翻倍,满足不同场景需求。


除了编程能力,Grok 4.7 在专业领域知识任务上也取得显著进步。在 GDPval 和 AA Briefcase 两项针对律师、护士及金融分析师日常工作的基准测试中,其表现已接近当前前沿模型水平。同时,模型在文档与演示文稿生成方面也进行了针对性优化。


安全性是此次升级的重点之一。Grok 4.7 采用了全新的安全防护体系,在拒答机制和抵抗越狱攻击方面达到 SpaceXAI 内部测试的最高标准。在具有双重用途风险的网络安全与生物领域,模型展现出良好的平衡能力:在 LatchBio 生物安全测试中得分为 62.4%;在 HackerBench v0.3 中,仅允许 3.3% 的高风险提示通过,同时尽量减少对合法安全工作的干扰。目前,部分网络安全合作伙伴已可通过邀请制访问该模型,用于红队演练与防御研究。


Grok 4.7 现已通过 Cursor、Grok Build 及 Grok API 对外开放,并兼容第三方编程工具、模型路由服务和主流云平台,进一步拓展其开发者生态。

# Grok 4.7 # SpaceXAI # 大模型 # 编程AI # AI安全

来源:Heooo AI工具导航