
8月12 日晚间,SpaceXAI 正式发布新一代大模型 Grok 4.6。该版本在 Grok 4.5 基础上,重点加强了长周期 AI 智能体任务、复杂多轮交互和多模态视觉处理能力。根据官方介绍,Grok 4.6 能够处理更复杂的多步骤工作,包括文献调研、大规模信息判断、大型代码工程处理,也可以将较抽象的产品想法转化为相对完整的程序和落地方案。
目前,Grok 4.6 已经接入 Cursor 和 Grok Build,同时开放 API 接口,并登陆 OpenRouter、Vercel、Cloudflare 等第三方服务平台。普通版本定价为输入 Token 每百万 2 美元,输出 Token 每百万 6 美元;速度更快的版本价格为普通版本的两倍。
在基准测试方面,综合评测榜单 Artificial Analysis Intelligence Index 整合了九项核心基准测试,Grok 4.6 得分与 GPT-5.6 Sol 持平,其中智能体和代码相关专项测试进入行业第一梯队。
为提升模型表现,Grok 4.6 相比前代 Grok 4.5 进行了更长时间的增量训练。训练数据包括经过筛选的模型推理数据、前沿技术文献和高质量工程案例,并配合优化后的训练器与训练流程,为监督微调和强化学习提供基础。研发团队还基于 Grok 4.5 生成了多维度微调样本,覆盖不同推理强度、各类智能体运行框架,以及理工科、软件开发、知识研究等场景,并通过自检机制剔除存在问题的训练轨迹。
Grok 4.6 也完成了较大范围的智能体强化学习,训练任务涉及知识处理、通用编程、系统内核优化、网页开发、CAD 设计等多个领域。实测场景显示,Grok 4.6 在超长链路和多阶段任务中经过了大量验证。面对不够明确的产品需求,模型可以主动调研陌生行业、搭建应用框架、完成交互开发,并根据多轮反馈持续迭代。执行长流程任务时,模型会主动检查已完成内容,降低错误概率。相比前代版本,Grok 4.6 在视觉创作和交互式项目中的初稿完整度也有提升,能够一次性搭建应用基础架构和视觉规范。
安全方面,Grok 4.6 根据扩展后的模型能力调整了安全防护机制,包括上线前能力评估、安全策略校准、上线后持续监测以及第三方交叉测试。整套机制兼顾漏洞修复、工程开发、AI 学术研究等合规使用场景,在提升模型实用性的同时,控制潜在安全风险。
本文由智算芯能前沿网编辑整理,转载请注明出处。
