Manus
在云端沙箱里独立拆解、执行并交付任务的通用自主智能体。
它是什么
想象一种 AI:你给它一句话——"调研这个市场"、"把这个想法变成一个网站"、"帮我做一份能给投资人看的 PPT"——然后关掉浏览器,几小时后回来,一份成品已经躺在你的收件箱里。
这不是自动化工作流。工作流需要你事先画好每一步;Manus 不需要,它自己画。这也不是聊天机器人。聊天机器人靠你一句一句推动;Manus 不靠,它自己持续推进。这是一种全新的存在:通用自主智能体(General-Purpose Autonomous Agent)。
智能是怎么发生的
一句话进去,成品出来——这中间发生了什么?Manus 内部并不是"一个大模型在思考",而是五个彼此咬合的子系统在协作:
① 规划者(Planner):把你的模糊目标拆成可执行的步骤,判断依赖关系。
② 工具路由(Tool Router):每一步该用浏览器、写代码、还是读文件,由它分发。
③ 执行者(Executor):跑在一台隔离的云端 Linux 虚拟机里——有浏览器、终端、文件系统、代码运行时。它像一个独立员工一样真实地干活。
④ 校验者(Verifier):每一步产出都会被检查,发现幻觉或错误就自我纠正,必要时触发重新规划。
⑤ 记忆层(Memory):短期(当前任务上下文)、中期(项目进展)、长期(关于你的偏好)、经验(Project Skills——可复用的成功模式)。
关键设计选择:思考与动手分离。模型负责判断,虚拟机负责真实地打开网页、敲命令、存文件。这让"幻觉"被限制在思考阶段,而不会立刻造成真实世界的后果。
还有一对特殊的机制:Branch 允许同一上下文分叉出多条并行路径,各自独立探索,互不污染;Project Skills 则把过去任务里的成功经验沉淀为可复用资产——它不是自我进化,但它是"经验复用"。
一个真实任务的全过程:调研家用储能市场,做一份交互式报告
- 你说:"调研过去 6 个月家用储能赛道,列出最值得关注的 5 家公司,做成一个交互式网页给我的投研团队。"
- ① Planner 立刻拆成 4 个阶段:信息采集 → 筛选排名 → 叙事组织 → 可视化构建。
- ② 多台 Executor 并行启动——各自打开浏览器、读取公司官网、抓取融资新闻、下载行业报告。
- ③ Memory 自动注入:"这个用户偏好数据驱动、带来源标注的报告,不要空话。"
- ④ 其中一个 Executor 发现某公司的市场份额数据和另一来源矛盾 → Verifier 介入,再跑一轮交叉验证。
- ⑤ Branch 同时尝试两种可视化方案(表格 vs 交互图表),让用户最后选。
- ⑥ 40 分钟后,你收到:一份带引用的 6000 字报告、一个已部署的交互式网页、一份干净的可编辑表格。全程无需你点击任何按钮。
这是一个典型、而非理想的任务还原——基于 Manus 官方博客与第三方评测综合。真实使用中,复杂任务的失败率比演示视频暗示的要高(见"局限"一节)。
什么时候会失败
- 记忆与上下文管理:任务时长超过一定阈值,早期上下文会衰减,导致前后决策不一致。
- 真实世界的不确定性:网页改版、验证码、登录墙、反爬策略——任何一项都可能让任务卡住。
- 创造性判断:它擅长"调研 + 整理 + 呈现",但在"观点是否站得住脚"这类需要深度洞察的环节,仍需人类把关。
- 成本与时间:一次 40 分钟的长任务,token 消耗不低,不是所有问题都值得交给它。
- 失败模式:最典型的不是"完全做不出",而是"看起来像做完了,但某个关键细节是错的"。这种半完成态比显性失败更危险。
公开争议
Manus 几乎从诞生之日起就伴随着争议。
① 2025 年 3 月"演示争议":发布视频展示复杂任务一气呵成,技术圈很快发现其中有人工干预痕迹。Manus 团队随后承认个别演示不够严谨。这件事的真正意义不是 Manus 一家的问题,而是整个 Agent 行业的公开演示与真实能力之间的落差——至今没有一个行业公认的"Agent 演示标准"。
② "套壳"之争:Manus 没有自研大模型,核心能力基于 Anthropic Claude 加开源框架组合而成。开源社区 3 小时就复刻出功能相近的 OpenManus。批评者说它不值高估值;支持者反驳:AI 时代,产品工程与体验本身就是壁垒,正如苹果不必自研所有零件。
③ Meta 收购与监管反转:2025 年底 Meta 以约 20 亿美元收购;2026 年 4 月,中国发改委以"外商投资安全审查"为由禁止交易,要求撤销。2026 年 8-9 月,部分用户数据被迫删除,Manus 恢复独立运营,组建中国团队。这是AI 行业首个因跨境监管而被迫"反收购"的标杆案例。
在物种谱系中的位置
Manus 在通用自主 Agent 的谱系中,占据"端到端任务交付"这个独特生态位。
• vs Claude Code:Claude Code 是"坐在你旁边的代码伙伴",Manus 是"独立完成任务的执行者"。前者强于协作与打磨,后者强于独立交付。
• vs Devin:Devin 专注软件工程,Manus 横跨研究、文档、网页、应用、PPT。Devin 在代码上更深,Manus 在场景上更广。
• vs 豆包工作伙伴 / ChatGPT Agent:前者深度集成国内办公生态(飞书、钉钉),后者模型能力天花板最高;Manus 胜在云端沙箱的隔离与可移植性——任务可在你关闭浏览器后继续。
• vs 讯飞 AStudio:ASTUDIO 专攻音视频创意,Manus 不在同一赛道。
一句话定位:把"一句话目标"变成"可交付成品"的云端通用 Agent。
能自主完成什么
- 一句话目标,自主完成竞品分析、深度调研并产出带引用的报告
- 在云端沙箱里编写、部署全栈网页应用与原生移动应用
- 生成可编辑的 PowerPoint 幻灯片、Word/Excel 文件
- 通过浏览器操作员自主操作网页、填写表单、抓取信息
- 通过定时任务与自动发布持续工作,连接 Slack、Google Workspace、Notion、Stripe 等数十种服务
关键能力
- 异步云端执行:关闭页面后任务继续运行,完成后通知
- Wide Research:并行检索数十个信息源,产出结构化带引用研究
- My Computer 桌面端:经审批后读取本地文件、运行终端命令
- 多智能体架构 + 29 种工具,Plan Mode 与 Branch 并行探索
自主等级评级:L4
Manus 给出一个目标即可自主规划、研究、执行并交付,满足 L2;任务与项目上下文可跨会话延续,满足 L3;Planner/Executor/Knowledge 多智能体架构、Branch 并行路径、Slack 与连接器生态支持与人和其他系统协同,达到 L4。它能从历史任务复用技能(Project Skills),但尚无可靠证据表明其能自主改写并持续改进自身核心策略,故未评 L5。
成长时间线
- 2025-03-05 Manus 发布早期预览,被称为"全球首款通用 AI 智能体",邀请码在二手市场一度炒至 10 万元。
- 2025-06 总部迁往新加坡,大幅裁减中国团队,停止境内服务与运营。
- 2025-10-16 发布 1.5,推出 Wide Research 深度研究能力。
- 2025-12-15 发布 1.6,加入 Max 高性能模式、移动开发与 Design View。
- 2025-12-17 宣布 ARR 突破 1 亿美元,营收运行率约 1.25 亿美元——从零到一亿美元最快的 AI 初创之一。
- 2025-12-29 Meta 宣布以约 20 亿美元收购 Manus。
- 2026-01-27 拥抱开放标准,推出 Agent Skills 集成。
- 2026-02-12 推出 Project Skills——把团队经验沉淀为可复用资产。
- 2026-03-16 推出 My Computer 桌面应用,智能体可在用户授权下操作本地电脑。
- 2026-04-27 中国发改委以"外商投资安全审查"禁止 Meta 收购,要求撤销交易。
- 2026-07-09 推出 Branch——一份上下文可并行探索多条路径。
- 2026-07-24 推出 Plan Mode——先写计划,经用户确认后再执行。
- 2026-08-11 宣布将恢复独立运营;8 月 23-24 日部分受影响用户数据删除与恢复。
- 2026-09-01 正式恢复独立运营,创始团队继续主导。
- 2026-09-28 发布 Manus 2.0:全新 Cascade Agent 框架、云电脑与自动化触发、Manus Studio 专业创作环境、个人 Agent 应用 Cue。
- 2026-09-29 同步宣布组建中国团队,招聘产品、工程、运营、算法等 11 类岗位。