你买了一台新电脑,想让 AI 帮你卸掉多余软件。普通聊天机器人只能给出一份操作指南;电脑控制 Agent 则会检查系统、移动鼠标、调用终端,再替你执行获准的步骤。Grok Build 瞄准的正是后者:xAI 正把 Grok 从“回答问题的模型”,推向一个能拆任务、操作软件并持续工作的 Agent 工作台。
目前信息主要来自 x.ai/build 页面及 Elon Musk 转发的用户演示,缺少独立评测。所以下文能确认的是产品形态,而不是它完成任务的成功率或安全性。
不只写代码,也开始动鼠标
据 x.ai/build 页面文案,Grok Build 已经上线,可通过 x.ai/build 获取,现由 xAI 最新模型 Grok 4.6 驱动。它加入了原生子 Agent 视图、Plan Mode、鼠标支持和全屏终端文字界面。
这里的变化不只是一串功能更新。
子 Agent 是主 Agent 临时分派出去的辅助执行单元。一个复杂任务可以拆成几份:有人搜索资料,有人写代码,有人检查结果。原生子 Agent 视图,则让用户能看到这些任务如何分工和推进。
Plan Mode 是“先列步骤,再动手”。在普通问答里,计划写得不好,最多是答案不理想;一旦 AI 能操作电脑,计划就成了重要的检查点。比如清理 Windows 时,用户可以先确认它准备删除什么,再允许执行。
鼠标支持则把 Grok Build 的活动范围从终端扩大到图形软件。终端擅长执行命令,但 Blender 等应用并非所有操作都适合用命令完成。鼠标、终端和模型结合后,Agent 才更接近一个坐在电脑前的操作者。
全屏 TUI 负责把这些动作集中展示。TUI 是运行在终端里的文字界面:比一行行输入命令更直观,又不像传统桌面软件那样依赖多个图形窗口。它可以用来呈现 Agent、任务和终端状态。
从一次任务,走向常驻工作台
现有材料展示了两类使用场景:辅助用户在 Blender 中创作,以及审查并清理 Windows 里的预装软件、后台程序和临时文件。但这些都来自用户案例或转发内容,只能说明产品试图覆盖哪些任务,不能证明普通用户也能稳定复现,更不能证明系统清理不会误删关键组件。
更值得注意的是 Grok Bot 与 Grok Build 的组合。据另一账号发布、后由 Elon Musk 转发的材料,Grok Bot 可以与 Grok Build 原生交互,并持续向其中发送更新和内容。两者的分工可以粗略理解为:Bot 负责长期盯住任务,Build 负责在电脑环境里执行。
据 Elon Musk 转发的比较材料,Grok Bot 使用由“SpaceXAI”配置和运营的远程电脑。用户关闭或重启本地电脑后,任务仍能继续。这里的远程电脑,就是放在服务方机房、通过网络访问的机器。它让 Agent 不必依附用户眼前这台笔记本,也把一次聊天变成了可能跨越多次会话的持续工作。
同一材料称,同一账户下的 Grok Bot 共用一台电脑、文件和浏览器登录状态。这样,一个 Bot 留下的文件可以直接交给另一个 Bot,不必重新登录或搬运资料。用户还可以录制一次最长 10 分钟的操作流程,让 Grok Bot 把它整理成可复用的 skill——也就是一套以后能够重复调用的操作说明。
xAI争的是“执行入口”
我们在 8 月 13 日的报道中提到,编程竞争已经从模型本身延伸到 Harness 工程。Harness 可以理解为模型外面的整套工作装置:它怎样调用工具、保存状态、拆分任务,以及让用户检查过程。Claude Code 是当时的重要参照。
Grok Build 延续了这条路线,但把边界推得更远。子 Agent 负责分工,Plan Mode 负责先规划,鼠标和终端负责执行,远程电脑负责让任务持续运行。单看任何一项都不新鲜;组合起来,它们指向的是一个完整工作台,而不只是更强的聊天窗口。
这也是“电脑控制权”值得关注的原因。谁掌握执行入口,谁就不只回答用户“应该怎么做”,还有机会替用户完成搜索、整理、制作和维护。不过目前更准确的说法是:xAI 已经加入这场竞争,而不是已经赢下它。
局限与未知
- 材料没有公布基准测试、任务成功率、价格、发布日期或系统兼容范围,也没有独立评测,无法判断 Grok Build 是否优于同类产品。
- Grok Bot 的隔离方式存在冲突:一则材料称每个 Agent 都有独立的持久电脑、浏览器和文件系统;另一则称每个账户共用一台电脑。现阶段不能确认准确架构。
- “SpaceXAI”究竟是正式运营主体、基础设施称谓,还是社交账号标签,现有材料没有说清。