摘要:Anthropic 为 Claude Cowork 与 Claude Code 加入后台操作电脑能力,用户交付任务后,Claude 像人一样点击、输入、开关应用,用户可同时忙别的。

"把活儿交给它,然后去干别的"——Claude 这次的功能更新,把电脑操作这件事从"看着它做"变成了"让它后台做"。Anthropic 在 Cowork 和 Claude Code 两个产品里加入了后台操作能力。逻辑不复杂:你把任务交给 Claude,它会像人一样去点鼠标、敲键盘、开应用;区别是它跑在后台,你不用一直盯着屏幕,可以同时在旁边做别的事。等它干完或者需要你拍板时再回来。这背后是智能体从"对话助手"向"桌面劳动力"的又一步。

此前 Claude 已经能读文件、跑命令、改代码,但"操作图形界面"这个动作一旦常态化,它覆盖的任务面就宽了很多——那些没有 API、只能靠界面交互的老系统、内部工具,都成了可自动化对象。举个更具体的例子:公司里那套二十年没改过、连内部文档都查不到的报销系统,过去只能靠人肉点点点;现在一个能看屏幕、能点按钮的 Agent,就可以把这类"脏活"接过去。这类长尾场景的总量,其实远大于所有人都在谈论的"AI 写代码",因为它们数量多、自动化程度低、又离不开人。

11.jpg

当然,后台操作也把"权限与可信"的问题推到台前。一个能自己点来点去的智能体,万一误触了不该碰的按钮怎么办?比如它本该在测试环境提交,却跑去了生产后台点了"发布"。这类产品真正能不能落地,取决于它的操作可观测性:每一步动作能不能回放、能不能暂停、出错能不能撤、以及会不会在关键操作前停下来问一句人。建议真要用的团队,先在隔离环境里跑两周,把"它会点哪些东西"摸清楚,再谈效率。把 Agent 接进真实桌面之前,最好先给它划一个 sandbox:限定它能打开哪些应用、能访问哪些目录,超出范围的动作一律先征求确认。

从更长的尺度看,这类"电脑操作智能体"会重塑"自动化"的边界。过去 RPA(机器人流程自动化)要雇一队工程师把每个界面流程写成脚本,维护成本极高;而 GUI Agent 用"理解界面"代替"写死脚本",理论上能覆盖 RPA 够不着的那些不规则、常变动的流程。但这个梦做了好几年,真正卡住它的从来不是"能不能点",而是"点错了怎么办"。Claude 这次把能力放出,真正要验证的是配套的安全与可观测机制,而不只是演示视频里那几下滑顺的点击。

放到同类产品的坐标系里,Claude 这次的更新并不孤单。过去一年里,Computer Use、Operator 这类"让模型操作界面"的能力陆续从 Demo 走向可用,大家拼的不再是"能不能点",而是"点错了能不能兜住"。Claude 的差异点在于它把这套能力同时铺到了 Cowork 和 Claude Code 两个场景——一个是知识工作者的日常桌面,一个是开发者的工程环境,覆盖面比单纯的"浏览器 Agent"更宽。但真正决定它能不能从"酷"变成"每天用"的,是那层可观测与可撤销机制是否够扎实:用户愿不愿意把一个能碰自己电脑的 Agent 长期开着,取决于它出错时的代价是否可控。演示视频里永远看不到的,恰恰是这些"兜底"工程。对用户来说,判断要不要用,先问一句:它出错时最坏的后果我能不能承受?能,就让它后台跑;不能,就先关在沙箱里慢慢观察。等你在隔离环境里看清楚了它的行为边界,再决定要不要放开到真实桌面,这比任何发布会上的滑顺演示都重要。