剑指 GPT-5.6 Sol,SpaceXAI 发布 Grok 4.6 模型
Grok 4.6发布!与GPT-5.6 Sol持平,强化长流程智能体任务,多步骤复杂任务更高效,首周Cursor/Grok Build双倍额度,输入仅2美元/百万Token。
8 月 12 日消息,北京时间今天(12 日)晚间,Grok 4.6 正式发布。新模型在 Grok 4.5 基础上进一步强化长时间运行的智能体任务,以及复杂的交互和视觉工作。
按照发布信息,Grok 4.6 能够持续处理包含大量步骤的复杂任务,包括资料研究、信息分析、大型代码库处理,以及将产品构想转化为完整应用或工作成果。
基准测试方面,Grok 4.6 在多项智能体编程和知识工作测试中达到前沿水平。在综合 9 项基准测试的 Artificial Analysis Intelligence Index 上,Grok 4.6 与 GPT-5.6 Sol 取得相同成绩。

据了解,Grok 4.6 已在 Cursor 和 Grok Build 上线。首周,两项服务将向用户提供两倍的内含使用额度。
训练方面,Grok 4.6 经历了比 Grok 4.5 更长的补充训练。训练数据包括经过筛选的模型生成推理数据和高级技术概念数据,以及高质量工程数据,并配合改进后的优化器和训练方案,为后续监督微调(SFT)和强化学习(RL)提供基础。
训练团队随后利用 Grok 4.5 重新生成 SFT 轨迹,覆盖不同推理强度、智能体运行框架,以及 STEM、软件工程和知识工作等领域,并使用基于模型的检查剔除存在问题的轨迹。Grok 4.6 还接受了广泛的智能体强化学习训练,任务覆盖知识工作、通用编程、内核优化、Web 开发和计算机辅助设计等领域。
在实际项目测试中,Grok 4.6 重点接受了长流程、多步骤任务的考验。测试结果显示,新模型擅长把宽泛的产品构想转化为可以运行的初版,包括研究陌生领域、规划应用结构、实现核心交互,以及根据多轮反馈持续完善结果。
在更长的任务流程中,Grok 4.6 还表现出更多自主测试和验证行为,会在继续执行任务前检查已经完成的工作。视觉和交互式项目的初版成果也较 Grok 4.5 有所提升,面对明确的产品构想时,可以一次建立应用的基本结构和视觉语言。
安全方面,Grok 4.6 根据扩展后的模型能力调整了安全防护机制。此次安全评估覆盖部署前能力测试、安全防护校准,以及部署后和第三方测试,规模为历来最大。安全体系面向漏洞修补、工程设计和 AI 研究等合法使用场景,在提高实用性的同时控制安全风险。

除 Cursor 和 Grok Build 外,Grok 4.6 也已通过 API 开放,并登陆 OpenRouter、Vercel 和 Cloudflare 等合作平台。价格为每 100 万个输入 Token 2 美元(注:现汇率约合 13.5 元人民币)、每 100 万个输出 Token 6 美元(现汇率约合 40.6 元人民币),速度更快的版本价格为普通版本的两倍。首周,Cursor 和 Grok Build 用户可获得两倍的内含使用额度。
- 1等了快十年!黑沙开发商MMO新作《多可比》公测时间确定!
- 2人均付费第一的网游,碾压DOTA2,15年悄悄赚了70亿美元!
- 3韩国大厂争霸!三款不肝不氪的MMORPG新作将于近期上线
- 4韩国MMORPG《日蚀:觉醒》将于8月19日开启角色预创建
- 5MMO《诡秘之主》:3A动捕团队操刀,海外顶尖大师助阵!
- 6公测不足两年!《天堂》IP衍生MMO《君主之旅》即将停运
- 7从全网喷到国产之光,开服六年,这款老游戏站在命运的拐点
- 8《梦幻西游》系列新作开启预约!无需点卡,PC手机数据互通
- 9都怪D加密吃性能?《红色沙漠》实测:正版体验还不如盗版
- 10《新三国》导演宣称将基于《史记》打造"新《新三国》"

