xAI 发布 Grok 4.5 专攻编程与 Agent
推荐指数 54.0 NO. 018 · 2026.07.09
发布2026/07/08Score193Comments117
为什么值得看
Grok 4.5 是 SpaceXAI 最新旗舰模型,与 Cursor 联合训练,在编码、科学推理和法律 Agent 基准上登顶。对 AI 工程师而言,这意味着又一个可直接接入工作流的高性能模型选择,且其与 Cursor 的绑定暗示了模型即 IDE 的新趋势。
编辑判断
Grok 4.5 与 Cursor 联合训练这件事比模型本身更值得玩味。这意味着 xAI 不再只是卖 API,而是在抢「模型+编辑器」的闭环入口,直接对标 OpenAI 收编 Windsurf 的路线。
Harvey 法律 Agent benchmark 登顶是另一个信号:垂直领域 Agent 正在从 demo 进入可付费的生产环节,法律、金融、医疗这类高客单价场景会成为下一轮模型军备竞赛的主战场。
如果你在选模型做 coding agent,Grok 4.5 的 GB300 训练集群规模暗示其推理成本可能不低,建议先跑 latency 和 pricing 的对比,不要只看 benchmark 分数。
社区反馈
意见分歧 113 条评论
核心争论:Grok 4.5 技术性价比是否足以抵消马斯克政治争议带来的供应链与声誉风险
相关内容
AI 行业动态20260526:xAI发布Grok Build编程Agent xAI于5月14日发布编程Agent Grok Build,支持代码理解、多文件修改与自动化工作流,可并发启动8个子Agent协同处理,上下文窗口256K tokens。 xAI发布Grok 4.5开启内测!马斯克:计划每月发布一个大模型 马斯克宣布xAI最新大模型Grok 4.5已开启内测,并计划每月发布一个大模型,显示xAI快速迭代的产品策略。 xAI joins crowded coding agent race with Grok Build xAI加入编程Agent竞争,Grok Build beta版可直接从终端运行,聚焦开发者审查和协作编码能力。 Grok 4.5 is built on xAI's V9 foundation model with 1.5T parameters Grok 4.5基于xAI V9基础模型,参数规模达1.5万亿,约为当前生产环境v8-small的3倍,预训练已完成。
How popular is Grok compared to other companies models for SWE tasks? I almost never hear it talked about against OpenAI's or Anthropic's products
If they were a frontier lab, you'd know.
You can very roughly proxy popularity of close-sourced models through OpenRouter token throughput. Grok has an order of magnitude less OpenRouter usage than Claude, GPT, even Gemini.