Claude 生产级 Agent 新栈:Computer Use、Skills 与 Files

Anthropic 将 Computer Use、Browser Use、Skills API 和 Files API 推向 GA。本文解释它们如何组合,以及生产风险仍在哪里。

Claude 生产级 Agent 新栈:Computer Use、Skills 与 Files

Anthropic 四项 Agent API 的官方发布页面

生产价值来自材料、流程、动作和证据的组合。

Anthropic 8 月 20 日的发布看似是四项独立功能,更准确的理解是一套 Agent 栈:Files 保存材料,Skills 保存流程,Computer/Browser Use 负责行动。Claude 因而能处理没有 API 的软件,但 GA 并不意味着网页操作突然变得确定可靠。

先说结论

  • Computer Use、Skills API 与 Files API 已在 Claude Platform GA。
  • 新 Browser Use 同时利用视觉与页面结构,不再只依赖像素坐标。
  • Skill 是可版本化的指令、脚本和模板包,在 Anthropic 代码 Sandbox 中执行。
  • Files 可跨请求引用;Anthropic 宣布组织存储上限提升至 1 TB。
  • 仍应优先使用 API,并在提交、付款、发消息等外部影响点要求审批。

一条工作流里的三种状态

Anthropic 官方文章用保险理赔举例:Agent 从 Files 读取材料,按 Skill 中的理赔流程操作保险网站,再把确认文件保存回来。

这可以拆成四层:

持久对象失败时检查什么
知识文件与源材料输入缺失、过期或拿错
流程固定版本 Skill规则、模板或校验错误
行动Browser/Computer Use字段、导航或提交错误
证据返回文件与行动轨迹是否真正完成、能否审计

如果全部塞在一个 Prompt 中,失败后很难判断问题在哪。分层后可以明确:是文档理解错了、流程版本错了,还是点错了按钮。

Browser Use 不只是“点得更快”

传统 Computer Use 主要依据截图和坐标。新 Browser Use 还能读取页面结构,定位具体字段或按钮;单个 Turn 可执行多步动作,减少模型往返。

这会提高稳定性,但不会消除网页的不确定性。DOM 标签可能含糊,虚拟列表可能隐藏内容,恶意网页还可能把提示注入混在可信数据旁。页面结构只是更好的传感器,不是安全边界。

合理优先级仍是:直接 API/强类型 Connector,其次受控的确定性自动化,再到结构感知 Browser Use,最后才是纯像素操作。

Skill 应按代码依赖管理

Skill 包含指令、脚本与模板,并在代码 Sandbox 中执行,因此不能只把它当成长 Prompt。每个版本至少应记录源码 commit、负责人、输入输出、允许的网络目标、正常与对抗测试,以及回滚方式。

生产 Trace 还必须保存实际 Skill 版本。“用了理赔 Skill”不足以支持事故复盘。

Files 降低重复传输,也带来权限问题

Claude Platform Files API 官方文档

文档明确了 Workspace Scope 与文件生命周期,它们是应用权限设计的一部分。

Files API 避免每次请求都重复上传 PDF 或表格,但新的问题是:谁可以把已有 file ID 附到另一条任务?文件授权应绑定租户和工作流,生成文件也应继承保留策略。一个不透明 ID 不是访问控制。

生产架构应该长什么样

请求 -> 校验用户与业务对象
     -> 绑定获准文件
     -> 固定 Skill 版本
     -> 隔离浏览器会话
     -> 最终提交前暂停审批
     -> 导出确认结果与 Trace
     -> 回写业务系统并对账

Agent 可以决定怎样导航,但不应自己决定有权打开哪位客户的记录,也不应自行取消付款审批。Sandbox 负责执行隔离,身份、政策和不可逆决定应留在模型之外。

GA 不代表什么

GA 表示 Anthropic 把这些能力作为正式平台产品提供,不代表任意网站、文档和长流程都有统一成功率。官方客户数据来自具体流程,不能外推到所有场景。

上线前必须测试登录过期、弹窗、部分保存、限流、重复提交和页面改版。浏览器 Agent 和 API 一样需要幂等性设计。

结论

Claude 工具之外仍需要应用自己的控制层,可结合生产级 Agent Guardrails安全 Sandbox 选型补齐政策和执行边界。

这次发布最有价值的不是“Claude 会点网页”,而是材料、流程、行动和产物被明确拆开。每一层因此可以版本化、测试与审计。

只有当关键工作确实横跨文档和缺少 API 的软件时,才值得采用这套栈。已有稳定 API 的系统继续走 API。观看 Agent 自动填表很酷,处理重复理赔则一点也不酷。

FAQ

这些 API 都 GA 了吗?

Anthropic 表示 Computer Use、Skills API 与 Files API 已于 2026 年 8 月 20 日 GA,Browser Use 随新版 Computer Use 推出。

Browser Use 会取代 Playwright 或业务 API 吗?

不会。适应性操作是其优势,但受控界面仍优先使用确定性自动化与直接 API。

每次点击都要审批吗?

不需要。审批应放在提交、付款、发消息、权限变化和删除数据等后果边界。