加密新闻

23.07.2026
15:55

Grok 4.5 成为浏览器端AI代理的领导者:自主性新标准

能够自主与网页交互的AI代理市场正在飞速发展。这不仅仅是聊天机器人,而是能够打开网站、点击按钮、填写表单并收集数据的全能助手——从预订机票到复杂的网页抓取。最新测试显示,xAI的Grok模型在这一领域脱颖而出,超越了OpenAI和Anthropic等巨头。

Browser Use服务创始人格雷戈尔·祖尼奇对五款工具进行了对比分析,评估其关键指标:在真实网站上成功完成任务且无错误的百分比。在这方面,Grok取得了卓越成绩——76.42%的成功操作率。这使其位居榜首,领先于OpenAI的助手(72.70%)和Anthropic的两款代理(70.75%和67.92%)。排名末尾的是通过OpenClaw插件运行的GPT,成功率为60.38%。

Grok为何更高效?

关键因素在于做出决策的人工智能模型本身。在此次对比中,Grok基于Grok 4.5运行,而竞争对手则使用GPT 5.5和Opus 4.8。正是AI的“大脑”决定了代理能否正确解读任务、响应动态内容并实时纠正错误。值得注意的是,即使是同一开发者(如Anthropic),连接到浏览器的方式也可能影响结果——差异接近三个百分点。

这项测试清楚地表明,AI代理的竞赛才刚刚开始,随着每个新版本模型的推出,领先地位可能发生变化。对用户而言,这意味着用于自动化互联网日常操作的可靠工具将不断涌现。

专家评论:AI代理市场本质上是一场围绕用户“外围”的新争夺战。Grok 4.5证明,xAI不仅能追赶,还能在AI的实际应用中引领趋势。这对加密社区尤为重要:自主代理可能成为新一代DeFi界面和分析工具的基础,而命令执行的速度与准确性在其中至关重要。