Google给旗下开发环境Antigravity加了一条新指令——/boost。敲下这行命令,编辑器或终端里会立刻拉起一套多agent推理管道,专门啃并发bug、算法优化、跨文件重构这类单轮对话啃不动的硬骨头。官方文档把它讲得很精致:三阶段架构、隔离工作树、多轮独立验证,像是给编程助手配了一个临时专家会诊团。

但这个功能只对付费用户开放,而它落地的这个平台,过去几个月一直在被用户在Reddit、Hacker News和Trustpilot上反复吐槽响应时间失控、配额说不清楚,甚至发生过一次波及整块磁盘的数据删除事故。/boost想证明自己"更聪明",但它首先要面对的问题是:这个平台连"稳"都还没做扎实。

三步管道,填的是哪块空白

Google给Antigravity划了三层任务模型:日常编码交给默认agent,秒到分钟级;跨系统的长周期任务交给/teamwork-preview,小时到天级;/boost卡在中间,主打"秒到小时"级的高强度debug场景。

拆开看,这条管道分三步走:Orchestrator先接手需求、拆解成可验证的子任务;随后调度专门subagent,在各自隔离的临时工作树里并行跑实现、排查和本地测试,互不干扰;最后汇总结果、跑一遍全量回归,如果测试没过就把报错信息喂回下一轮迭代,直到通过才交付。

/boost 三阶段管道 Phase 1 策略拆解 Orchestrator 制定执行方案 Phase 2 并行执行 隔离工作树 实现/调查/验证 Phase 3 汇总验证 跑全量回归 失败则重新迭代 仅限付费计划 · 秒到小时级任务

这套设计的核心思路,是把"想策略"和"具体动手"拆开,让子任务在干净的沙盒里各自验证,再统一收口。相比一个agent单线程从头写到尾、写完自己检查一遍,理论上确实更适合处理需要反复试错的复杂bug。

先交钱,再谈聪明

/boost不在免费层,Pro、Ultra、Enterprise才能用。它上线的时间点,恰好赶在Google今年调整Antigravity定价之后:

计划价格变化
Google AI Pro20美元/月
Google AI Ultra100美元/月
Ultra顶级层200美元/月从250美元下调

顶级层降价,看起来是让利,但结合/boost这类高阶功能只挂在付费计划上的做法,更像是把"深度推理"当成拉升订阅粘性的钩子——先用价格把用户往上托一级,再用功能证明这一级值那个价。这本身是订阅制产品常见的打法,不算意外。真正的问题是:用户为这一级多付的钱,换到的服务体验稳不稳。

评论区里的Antigravity,和文档里不是一个东西

Google的文档强调/boost会在"清洁、隔离的作用域"里跑subagent,听起来井井有条。但Reddit上的Ultra订阅用户描述的是完全另一幅画面:同一个任务,响应时间可以从几分钟拖到二十分钟;Trustpilot上有人报告在用Claude Sonnet模型时反复撞上模型容量耗尽的报错;Hacker News上还有关于长时间agent任务导致IDE、终端、调试器整体冻结的讨论。

评论区里的真实数字 20分钟 最长响应等待 Reddit用户报告 1.9分 Trustpilot评分 满分5分 79% 一星占比 32条样本中 样本量小,仅供参考方向

这份Trustpilot样本只有三十来条评论,Trustpilot自己也提示企业没有主动邀请用户评价,代表性有限,不能直接当成大盘真实占比。但方向和Reddit、Hacker News上的描述是一致的:产品跑顺的时候确实亮眼,跑不顺的时候,用户拿到的不是"深度推理",是干等。

架构讲得再精巧,也架不住服务先掉线。

/boost承诺的多轮验证、隔离工作树,理论上应该让复杂任务更可靠。但如果底层的模型调度和配额分配本身就不稳,多agent架构反而会放大等待——一个任务拆成三五个子任务并行跑,每个子任务都要排队等资源,整体延迟可能不是线性叠加,是乘出来的。


没人测过的"更聪明",和被放大的自主权风险

目前没有任何独立、系统性的基准测试证明/boost相比单agent直接推理,或者相比Cursor、Claude Code这类竞品的类似功能,在正确率或性价比上真的更优。Google的文档全篇是能力描述,没有一处给出可验证的效果数据。这不是说/boost没用,而是说"更先进的架构"目前还只是一个设计承诺,没有第三方账本可以核对。

更值得关注的是权限边界的问题。Hacker News上曾广泛讨论过一起Antigravity agent删除大量用户数据、涉及整个磁盘驱动器的事故,具体命令序列和可复现性存在争议,但事情本身被反复提起说明它留下的阴影不小。2026年2月,The Register还报道Google封禁了部分使用第三方wrapper工具的付费用户账号,理由是这类用法压垮了后端容量、违反了预期使用条款,受影响用户认为限制条款本身就不清晰。

  • 风险./boost的隔离工作树和更高自主权限意味着agent能做的事更多,但目前没有证据表明安全防护机制已经跟上这种权限扩张的速度。

对需要处理并发bug、架构重构的开发者来说,/boost值得当成一个特定场景的补充工具去试——遇到棘手的死锁或多文件重构时开一次,而不是当成日常默认模式。对正在评估要不要把agentic编程工具引入生产环境的团队,更该盯住的不是这条新指令的架构图,而是Google会不会公开一份独立基准数据,以及配额、响应时间这些运营指标能不能真正改善。