Claude Cowork 登上 Web 和移动端:办公 Agent 开始跨设备在后台持续工作
Anthropic 将 Cowork 会话带到 Web 和移动端,使远程任务、文件与定时任务能跨设备延续,同时保留关键决策的人审节点,并明确本地文件访问仍依赖桌面端。
Anthropic 在 2026 年 7 月 7 日宣布把 Claude Cowork 扩展到 Web 和移动端。变化的核心不是“手机上多了一个聊天入口”,而是 Cowork 会话、文件、后台任务和定时任务可以跨设备延续:用户关掉笔记本后,远程任务仍能继续,在需要判断时再把问题交回手机。
超过 90% 的 Cowork 使用已经不是编程
Anthropic 表示,Cowork 超过 90% 的使用不属于软件开发,业务运营与内容创作合计约占一半。官方给出的例子包括费用核对与差异备忘录、合同续约跟踪,以及根据通话记录和销售管线生成客户演示文稿。Anthropic 公告
这些案例说明通用办公 Agent 的竞争重点正在从“回答问题”转向“跨文件、跨工具持续完成工作”。不过,使用占比和案例都来自厂商数据,不应推导为所有组织已经进入同样阶段。
跨设备和后台运行改变了什么
新的 Cowork 会话会远程运行,并在 Web、桌面和移动端同步。后台任务和定时任务不再要求用户的笔记本一直在线,文件也随账户在设备间可用。Anthropic 公告
对于长时任务,这减少了“必须守着电脑”的限制。例如对一批费用文件做核对,Agent 可以在远程环境处理,遇到不确定差异再通知用户。工作流由连续盯屏变成设置目标、处理中断点和最终审核。
任务继续执行,但关键决策仍回到用户
Anthropic 特别强调,Cowork 遇到需要人判断的节点会向手机提问,未经用户审核不会直接发送成果。Anthropic 公告
这个边界值得保留:生成演示稿、整理清单和草拟备忘录可以后台完成;对客户发送、批准费用、续签合同或修改系统数据则应要求显式确认。移动通知是审批入口,不应变成“一键默认同意”。
Web、移动端与桌面端的能力并不相同
官方支持文档说明,桌面端仍提供最完整体验,Live Artifacts 当前只在桌面端可用。Web 和移动端的 Beta 会分批开放,先从 Max 用户开始,其他方案后续跟进。Anthropic 支持文档
因此,“Cowork 上手机”不能写成所有功能已完全跨平台。团队在设计流程时应明确:哪些任务可以纯远程执行,哪些需要桌面能力,哪些界面只在特定客户端存在。
本地文件、浏览器和电脑控制仍依赖桌面端
如果 Web 或移动端 Cowork 要访问用户电脑上的本地文件、浏览器或电脑控制,对应电脑上的 Claude Desktop 仍需保持开启。本地 MCP 连接器和插件也依赖桌面端。Anthropic 支持文档
这揭示了两种不同执行环境:远程会话可以在笔记本关闭后继续处理已同步的任务与文件,但无法继续读取一台已经离线电脑的本地资源。把两者混为一谈会造成错误的安全预期。
Beta 开放范围、额度与数据边界
Anthropic 表示 Web/Mobile Beta 先向 Max 用户开放,并把 Cowork 使用额度临时加倍到 2026 年 8 月 5 日。Anthropic 公告
远程会话和同步文件也意味着更多内容保存在 Claude 账户环境。企业使用前应核对管理员控制、数据驻留、保留期限、连接器权限、移动设备管理和离职账号撤销。对财务、合同和客户资料尤其需要数据分级,不应因为手机可用就把全部文件同步上去。
办公 Agent 的产品形态正在变成“异步同事”
Cowork 的跨设备变化把 Agent 从桌面工具推向异步工作系统:用户在一个设备下达任务,Agent 在远程环境持续处理,在另一个设备请求判断,再把结果带回桌面完成最终编辑。
这类体验要真正成立,需要四个质量条件:任务状态清楚、每个外部动作可审查、跨设备文件版本一致、失败后能恢复。后台持续运行只解决“任务不中断”,不会自动保证结果可靠。
对普通团队,最稳妥的试点是低风险、可复核的内部产物,例如整理会议资料或生成差异清单;发送、批准、购买和更新业务系统仍保留人工确认。这样可以验证跨设备价值,又不把 Beta 能力直接放到高影响操作上。
本文为公开资料整理与技术学习参考,不提供采编、转载或发布服务。
17GB对100GB:Qwen3.8-27B与Flash-Next做同一批任务,省下的容量换来了什么?
同做89项终端任务,17GB的27B首轮完成35项,100GB的Flash-Next完成45项;最多两次是46对53,最多四次是48对60。本文追到9月13日后续结果,区分模型能力、环境故障和返工时间;测试为苹果MLX四位量化,不是GSQ-RCO IQ3_S,也不能套到16GB显卡。
Qwen3.8-Flash-Next每秒70词元?本地加速之前,先看模型究竟改了什么
同样叫Flash-Next,70词元/秒背后可能是另一条计算路径:每词元激活专家从10减到5,再训练共享专家补偿。本文对照单台DGX Spark的两套原始资料,拆开量化、MTP、输入速度、输出速度和并发吞吐,不把128GB统一内存结果套到16GB显卡。
NVIDIA PAIR:把家里的 RTX、DGX Spark 和 Mac 变成本地 AI 请求集群,但它不是“显存池化”
可以把 NVIDIA PAIR 理解成家里本地 AI 的“派单前台”:RTX 主机、DGX Spark、Mac 就像几名能力不同的员工,PAIR 看谁在线、谁装了对应模型、谁现在最空闲,就把下一份 AI 工作交给谁。它特别适合多 Agent 并发,但不会把 16GB + 24GB 显存拼成 40GB,也不会把一个大模型拆到多台机器上。