马斯克 xAI 发布 Grok 4.7 主打编程与知识工作

IT时代网9月22日消息,马斯克旗下人工智能公司 xAI(文中品牌名 SpaceXAI)今日宣布推出新一代 Grok 4.7,主打编程和知识工作场景。官方称其采用更大规模基础模型,并通过更长时间强化学习训练提升复杂任务处理能力,是公司目前最强的编码和知识处理模型,速度为同类模型两倍,价格却只有一半。

与 Grok 4.6 相比,新模型能在困难任务上持续更长时间,并加强对自身输出结果的检查能力。在 CursorBench 4.0 测试中,Grok 4.7 面向长时间运行的编程任务,在价格与性能方面处于同类模型前列;官方表示其运行速度和定价与 Grok 4.6 相同。

Grok 4.7 使用比 4.6 更大的基座模型,并接受更长时间强化学习训练,训练数据更侧重需数小时完成的复杂任务,同时针对自我验证和长上下文管理进行优化。xAI 还针对 Grok Bot harness 对模型进行原生训练,提升其在对话与一般知识工作任务中的表现,并改进文档和演示文稿生成能力。

在 GDPval 与 AA Briefcase 两项基准测试中,Grok 4.7 均较 4.6 提升。前者要求 AI 完成律师、护士、金融分析师等专业人士的日常工作任务,官方称其表现已达到与其他前沿模型相近水平。

安全方面,xAI 为 Grok 4.7 采用全新安全防护体系,称其在拒答和抵抗越狱攻击方面达到公司测试最高水平。在具双重用途的网络安全和生物场景中,模型试图兼顾合法任务可用性与危险任务安全拒答:在 LatchBio 生物安全基准中取得 62.4% 成绩;在 HackerBench v0.3 中仅允许 3.3% 的高风险双重用途提示通过,同时较少阻止合法安全工作。xAI 已向部分网络安全合作伙伴提供邀请制访问,用于红队与防御研究。

目前 Grok 4.7 已通过 Cursor 和 Grok Build 提供,并开放 Grok API,支持第三方编程工具、模型路由服务及云平台。价格方面,每百万词元输入起价 2 美元(约合 13.4 元人民币),输出起价 6 美元(约合 40.2 元人民币);高速版本输出速度翻倍,价格也翻倍。

注:本文综合自IT之家等,文中包含AI辅助创作的内容。

编辑:林一舟

THE END