AMAZINGINDEX.COM 日报快照
55.2
VOL. 2026.07
2026.07.09
← 返回 2026.07.09 日报
日报快照 · Daily Snapshot
NO. 018

xAI 发布 Grok 4.5 专攻编程与 Agent

#ARTICLE HackerNews 2026.07.09
推荐指数 54.0 NO. 018 · 2026.07.09
发布2026/07/08Score193Comments117

Grok 4.5 是 SpaceXAI 最新旗舰模型,与 Cursor 联合训练,在编码、科学推理和法律 Agent 基准上登顶。对 AI 工程师而言,这意味着又一个可直接接入工作流的高性能模型选择,且其与 Cursor 的绑定暗示了模型即 IDE 的新趋势。

Grok 4.5 与 Cursor 联合训练这件事比模型本身更值得玩味。这意味着 xAI 不再只是卖 API,而是在抢「模型+编辑器」的闭环入口,直接对标 OpenAI 收编 Windsurf 的路线。

Harvey 法律 Agent benchmark 登顶是另一个信号:垂直领域 Agent 正在从 demo 进入可付费的生产环节,法律、金融、医疗这类高客单价场景会成为下一轮模型军备竞赛的主战场。

如果你在选模型做 coding agent,Grok 4.5 的 GB300 训练集群规模暗示其推理成本可能不低,建议先跑 latency 和 pricing 的对比,不要只看 benchmark 分数。

意见分歧 113 条评论

核心争论:Grok 4.5 技术性价比是否足以抵消马斯克政治争议带来的供应链与声誉风险

tbomb

How popular is Grok compared to other companies models for SWE tasks? I almost never hear it talked about against OpenAI's or Anthropic's products

bigyabai

If they were a frontier lab, you'd know.

minimaxir

You can very roughly proxy popularity of close-sourced models through OpenRouter token throughput. Grok has an order of magnitude less OpenRouter usage than Claude, GPT, even Gemini.

替代方案: ClaudeGPTGeminiCursorOpenAIAnthropicComposer 2.5CodexClaude CodeOpusFable
查看原文 →