2026 年 8月 13日,SpaceXAI 正式发布新一代旗舰 AI 模型 Grok 4.6。相比 Grok 4.5,新模型进一步将升级重点转向 Long-running Agent(长时间运行智能体),强化软件工程、复杂知识工作以及交互式应用开发等能力。

Grok 4.6 面向需要持续规划、执行和迭代的复杂任务,可用于大型代码库开发、Bug 修复、网络研究、资料分析以及 Web 应用构建等场景。模型支持文本和图像输入,API 上下文窗口达到 50 万 Token,并支持 Function Calling、Structured Outputs 等能力,可作为 Coding Agent 和企业级 Agent 的底层模型。
在软件工程方面,Grok 4.6 针对通用编程、软件工程、Web 开发、内核优化、CAD 等 Agentic 环境进行了训练。相比单轮代码生成,其重点是让模型能够围绕复杂开发目标,持续进行任务拆解、代码修改、测试验证和迭代,提升长时间软件工程任务的完成能力。
与此同时,Grok 4.6 进一步强化了产品原型和交互式应用构建能力,可以从较宽泛的产品需求出发,完成领域研究、应用结构规划、视觉设计以及核心功能实现,让模型从“生成代码”进一步向“完成开发任务”演进。
API 方面,Grok 4.6 标准价格为输入 2 美元/百万 Token、输出 6 美元/百万 Token,与 Grok 4.5 保持一致。目前模型主要通过 Grok 产品、SpaceXAI API 以及已经接入的第三方开发工具提供使用,暂未开放模型权重。
Grok 4.6 的升级方向也体现了当前旗舰模型竞争的一项变化:在基础推理和 Coding Benchmark 之外,模型能否在几十甚至更多步骤中持续保持任务目标、正确调用工具,并最终完成复杂工作,正在成为衡量 Agent 模型实际能力的重要指标。

