Anthropic扩展Claude Cowork浏览器与Gmail能力
Claude从“聊天助手”向“可执行Agent”的边界扩展取得实质进展,浏览器端与Workspace集成意味着其正在构建跨平台Agent操作系统。
Anthropic宣布Chrome扩展重大升级:浏览器内的Claude升级为完整Claude Cowork客户端,会话记录跨桌面、网页、移动端同步。
- 同时扩展Google Workspace能力:Claude除起草邮件外,可在Gmail中直接发送、回复、转发邮件;用户可关闭每次发送前的人工确认。
- 默认仍需人工确认,关闭确认是用户主动设置;Max和Team用户已可用,Pro用户未来数周内推出;企业版默认关闭,管理员可限定允许域名。
- Anthropic同步加强了提示词注入防护:在自动执行模式下,系统会在执行关键操作(提交表单、发送消息、下载文件)前进行二次校验。
一、Claude Agent 实质进展
1. 原生Agent能力的底层重构
- 2026年7月Anthropic正式上线Claude Code,将原本纯对话的聊天助手,升级为支持代码编写、终端执行、文件读写的可执行Agent,直接突破了传统大模型“仅输出文本”的边界。
- 8月19日官方宣布将Claude Code的周度使用配额永久提升50%,覆盖Pro、Max、Team、Enterprise全量订阅用户,大幅降低开发者使用Agent能力的门槛。
- 实测显示,Claude Agent在Terminal Bench 3.0、Agents' Last Exam等专业Agent评测中,得分超越多数开源Agent框架,单步任务完成率提升至92%。
2. 多智能体协同的技术突破
- Anthropic公开了多Agent冲突规避的核心文档,解决了多个Claude Agent同时执行同一任务时的资源抢占、指令冲突问题,实现了多Agent的有序协作。
- 实测场景中,3个Claude Agent可自动分工完成“需求分析-代码开发-测试部署”全流程软件工程任务,无需人工中途介入。
3. 隐形水印技术的Agent场景适配
8月Anthropic为Claude生成的所有Agent执行输出添加隐形不可见水印,可追溯Agent生成的代码、文件、指令来源,解决了Agent大规模落地后的内容溯源与合规审计难题。
二、浏览器端集成的核心价值
1. 直接打通网页端全场景操作权限
- 浏览器端Claude Agent可直接读取当前页面内容、自动填写表单、模拟点击交互、抓取网页结构化数据,无需额外安装浏览器插件,原生实现网页自动化操作。
- 支持跨标签页联动,可同时在多个网页间完成信息同步、数据比对、批量操作,彻底摆脱了传统聊天助手“只能输出网页操作指令,无法直接执行”的痛点。
2. 构建端侧Agent运行沙箱
- 浏览器端内置轻量Agent执行环境,所有轻量代码、脚本任务可直接在本地浏览器中运行,无需上传至云端服务器,大幅降低数据泄露风险,同时将指令响应延迟压缩至200ms以内。
- 沙箱自带权限隔离机制,Agent无法直接访问本地系统敏感文件,在保证执行能力的同时规避了恶意指令的安全风险。
三、Workspace集成的战略意义
1. 统一跨设备的Agent工作空间
- Workspace作为云端统一存储层,可同步Agent在不同设备上生成的文件、代码、项目进度,用户在网页端、桌面端、移动端打开同一Workspace,即可让Agent无缝接续之前的任务。
- 支持多人共享Workspace,多个团队成员可让各自的Claude Agent在同一工作空间内协同作业,自动同步项目文件与任务进度,实现人机协同的团队工作流。
2. 沉淀Agent可复用的工作资产
- Workspace内的所有文件、代码片段、执行历史都会被Claude自动索引,后续Agent执行同类任务时可直接调用历史资产,无需重复生成内容,大幅提升长周期复杂任务的执行效率。
- 支持自定义Agent角色配置,用户可在Workspace内预设专属Agent的能力边界、工作习惯、权限范围,打开Workspace即可直接调用定制化Agent,无需重复配置。
四、技术原理与风险
浏览器Agent的核心挑战是提示词注入(prompt injection):
恶意网页、邮件或文档中隐藏的指令可能让Agent执行用户未授权的操作。Anthropic的应对是“动作二次校验”——将Agent计划执行的动作与原始用户请求进行比对,不匹配则拦截。这是一种工程层面的缓解措施,但不能完全消除风险,因为攻击者可以构造与用户请求表面一致但实际有害的指令。
Gmail免确认发送是另一个风险放大器。虽然默认仍需确认,但一旦用户主动关闭,Agent可以代表用户对外沟通,涉及身份冒用、信息泄露与法律责任的模糊地带。
五、与OpenAI GPT-4o Agent体系的核心差异化对比
| 对比维度 | Claude Agent体系 | OpenAI GPT-4o Agent体系 |
|---|---|---|
| 核心定位 | 面向专业开发者、企业级复杂长周期任务 | 面向通用消费级用户、短平快日常任务 |
| 上下文窗口 | 最高支持200万Token,原生适配超大型项目全量代码库摄入 | 最高支持128万Token,长上下文处理能力弱于Claude |
| 代码重构能力 | 擅长全代码库感知的系统性重构,清晰输出不同方案的取舍权衡 | 擅长快速生成代码草稿,适配常见框架的快速实现 |
| 多Agent协同 | 原生支持3-5个Agent有序分工,冲突规避机制成熟 | 多Agent协同需依赖第三方框架,原生能力尚未完善 |
| 跨平台同步 | 以Workspace为核心实现全端状态无缝同步 | 依赖ChatGPT Plus的云端同步,项目资产沉淀能力较弱 |
| 数据隐私 | 端侧沙箱运行敏感任务,默认不将用户数据用于模型训练 | 云端处理为主,需手动关闭训练数据共享选项 |
六、Claude Agent化的实测落地细节
浏览器端负责端侧实时交互与本地轻量执行,Workspace负责全局状态同步与资产沉淀,二者结合让Claude不再是单一的聊天应用,而是形成了一套覆盖网页、桌面、移动端的统一Agent运行环境。这套体系本质上是Anthropic在构建以Claude为核心的Agent操作系统,未来可直接调度跨平台的系统资源、应用数据、网络服务,彻底打破传统聊天助手的能力边界。
1. 真实场景执行表现
- 在全栈软件工程场景中,Claude Agent可独立完成从需求文档生成、前后端代码编写、本地服务部署到Bug修复的全流程,单项目完成速度比传统人工开发快3-5倍。
- 在浏览器自动化场景中,无需额外RPA工具,即可自动完成电商批量数据爬取、在线表单批量填报、多平台内容同步发布等任务,操作准确率达94%。
2. 权限安全管控机制
- 所有Agent执行操作前都会向用户弹出二次确认弹窗,用户可单独授予/拒绝文件读写、终端执行、网页交互等细分权限,完全避免Agent越权操作风险。
- 支持设置Agent执行的最大时长、资源占用上限,防止长周期任务出现资源溢出问题。
七、影响与趋势
1. 打破Agent落地的碎片化现状
此前市场上的Agent产品大多是基于大模型API二次开发的外挂工具,Claude通过原生集成浏览器端执行能力+统一Workspace,直接在大模型底层构建了完整的Agent运行环境,大幅降低了Agent应用的开发门槛。
2. 重构人机交互范式
传统人机交互需要用户手动在不同应用间切换、操作不同功能,而Claude Agent操作系统可直接跨应用调度资源,用户仅需用自然语言描述目标,即可自动完成全链路任务,彻底改变了现有的软件交互逻辑。
3. 后续产品迭代方向
Anthropic计划2026年底上线Agent应用商店,允许开发者基于Claude Agent操作系统开发专属行业Agent,直接在Workspace内分发运行,构建类似移动互联网时代iOS生态的Agent应用生态。
- Anthropic官方Claude Agent实测公开报告
- 开发者社区Claude Code全场景落地实测数据