Grok Build 与 Claude Code 和 Codex 对比:首批用户对 xAI 工具进行了全面批评
伊隆·马斯克亲自向社区发出请求,希望获得对新工具Grok Build的批评意见。然而,他收到的回应远不止是反馈,而是一场真正的失望浪潮。那些付费使用xAI高级产品的开发者们自行进行了测试,并与竞争对手进行了比较。结果对马斯克的这一项目而言令人沮丧。
什么是Grok Build,为何它未能给人留下深刻印象?
Grok Build是xAI推出的一款代理型CLI工具,于2026年5月进入测试版。它通过终端运行,仅面向SuperGrok和X Premium Plus订阅用户开放,月费高达300美元,这使其与Claude Code和GitHub Copilot处于同一价格区间。该工具基于Grok 4.3测试版模型,采用16个代理的架构,上下文窗口达200万个令牌。然而,实践表明,强大的硬件参数并不能保证高质量的结果。
来自专业社区最强烈的批评是:该工具在任务质量和执行速度上存在灾难性的落后。一位开发者进行了直接实验:Grok Build花了将近两天时间才完成一个项目的实现。而同样的工作量交给OpenAI Codex后,它在六小时内就完成了任务,并且进度翻倍。另一位用户报告称,Grok会陷入长达三十分钟的无限循环,而Anthropic的Opus则一次就解决了同样的问题。
生态系统与定价问题
除了代码质量,开发者们还积极批评该产品的生态系统。主要抱怨是缺乏类似于Claude Cowork的完整桌面应用程序。用户指出,Claude的优势在于它能够融入所有工作流程,而不仅仅是编写代码。此外,用户还提出了以下需求:在测试阶段发布开源版本、引入完整的循环功能(loop skill)、创建用于代理稳定自主工作的/goal命令,以及内置展示所开发软件的能力。
另一波批评集中在价格上。强制绑定昂贵的SuperGrok套餐、严格的令牌限制以及每天仅15分钟的Grok Premium访问时间——这些条件让专业人士感到困惑。许多人担心xAI可能会重蹈Claude的覆辙,退出欧洲市场,从而进一步缩小用户群体。
具有讽刺意味的是,马斯克在请求批评的同时,还转发了一位粉丝的热情评论。这引发了讽刺性的评论,被称为“一种特殊的自信”。不过,部分用户仍保持忠诚,称赞团队的快速迭代,并相信Grok Build将成为市场上最好的工具。
专家观点: 目前,Grok Build看起来像是一个不成熟的产品,试图与成熟的解决方案竞争,却仅拥有理论上的上下文优势。面向开发者的代理工具市场竞争残酷:这里人们不为承诺买单,只为结果付费。如果xAI无法在短期内解决稳定性和推理速度的问题,该项目可能会沦为一个小众实验,尽管其创始人名声显赫。用户的当前反馈并非恶意攻击,而是对营销宣传的一盆现实冷水。