随着大语言模型在工业界落地深入,如何让 AI 在没有人类实时干预的情况下,自主完成跨越数小时的复杂软件工程与深度知识分析,成为了头部大模型厂商角逐的新战场。2026年9月下旬,埃隆·马斯克(Elon Musk)旗下的 AI 研发实体 SpaceXAI 正式对外发布了其最新一代模型——Grok 4.7,宣称这是该公司迄今在编程与专业知识工作领域最强悍的商业化模型。
根据SpaceXAI 官方发布的新模型解读显示,Grok 4.7 在底层技术架构上进行了全面重构。不仅采用了规模更大的基座预训练模型,研发团队还大幅延长了其在强化学习(RL)阶段的训练周期。这种针对长推理链条的特化训练,使得 Grok 4.7 在面对多模块重构、跨系统调试等耗时较长的自动化 Agent 任务时,展现出了极强的韧性与上下文记忆能力。
多项基准测试全面领先:自我验证能力迎质变
对于开发者而言,Grok 4.7 最核心的突破在于其具备了更强的“自我纠错(Self-Verification)”逻辑。当模型生成的代码遇到编译报错或单元测试未通过时,它能够在后台自主排查堆栈信息,并持续调整优化方案,而无需频繁向人类提示求助。
在评估 AI 编程与终端控制能力的多项前沿基准测试中,Grok 4.7 刷新了此前由 Grok 4.6 保持的纪录。根据金融市场快讯在 X 上的实时报道,Grok 4.7 在针对智能代码编辑器的 CursorBench 4.0、评估复杂软件工程能力的 DeepSWE,以及考察命令行交互的 Terminal-Bench 等权威测试集中均斩获高分,综合表现超越了同级别的竞争对手。
加量不加价:与 Grok 4.6 保持同价并推两倍速“快速版”
除了性能的全面跃升,Grok 4.7 此次在商业化落地上的策略也十分具有侵略性。
目前,Grok 4.7 已在知名 AI 编辑器 Cursor、内部工具框架 Grok Build 以及面向开发者的 Grok API 同步上线。在 API 计费模式上,SpaceXAI 选择了“加量不加价”的策略:基础版 API 的定价完全继承了前代 Grok 4.6 的优惠标准,即每 1,000,000 个输入 Token 仅收 2 美元,每 1,000,000 个输出 Token 收费 6 美元。
与此同时,针对对响应延迟有着苛刻要求的高频交易和实时交互场景,官方还推出了全新的“Grok 4.7 快速版(Fast Version)”。该版本通过底层推理引擎的并发优化,将输出 Token 的生成速度提升到了原来的两倍,而 API 单价也相应提升为标准版的两倍(输入 4 美元/M,输出 12 美元/M)。这种差异化的定价组合,极大地丰富了企业级客户在构建自主 Agent 时的成本与性能调优空间。
本报道由 圈小蛙(qxwa.com) 科技资讯站特约撰稿。🐸️