9月28日,通用智能体产品Manus正式发布2.0版本。此次更新中,Manus为每个Agent配备了独立的电脑、邮箱、电话号码和可支配预算的钱包,并推出独立新产品Cue,允许用户将多个Agent拉入同一群聊进行分工协作与任务交接。Manus创始人肖弘于次日发布长文,解释产品设计逻辑:当一个系统拥有独立的通信方式、支付能力、计算设备和足够的智能时,可以将其视为一个独立的“人”来对待。
Manus 2.0首先更换了底层Agent框架,新架构名为Cascade。该框架在项目初期保持轻量,仅在涉及视频、自动化或网页任务时调用对应专业能力。据Manus公布的测试数据,相比上一代系统,Cascade的Token消耗减少23.2%,任务完成时间缩短28.2%,运行成本下降32%。
在应用层,原桌面App升级为Manus Studio,支持对Agent生成的文档、表格、PDF、Slides、网页和代码进行二次编辑。针对视频和游戏两类高门槛任务,Manus分别构建了专用工作区。视频编辑器面向一分钟以内的产品广告、AI UGC、数据动态图表、教程及Vlog等场景,提供可编辑时间线,视频片段、图片、字幕、动态图形和音频均可独立调整。其中Alchemy模式可同时调用视频生成与代码生成能力,处理复杂运动效果和剪辑组合。游戏开发模块则将画面、素材、代码、角色和场景拆解为可单独修改的对象,并支持通过Cloud Computer接入长期在线云电脑,实现多人联机游戏的持续运行。
基础设施方面,Manus新增云电脑购买选项,用户开通后即使本地设备关机,云端任务、服务器和自动化流程仍可继续运行。自动化触发条件从定时扩展至新邮件、Slack消息、日历事件、Notion更新及数据变化等事件。同时新增远程操作功能,用户可通过手机语音调动家中电脑,由Manus执行文件查找、应用操作并返回结果。
本次更新中最值得关注的是独立产品Cue。Cue与Manus共用底层基础设施,支持手机和桌面端,其核心设计是将每个Agent视为独立个体:每个Agent拥有自己的邮箱、电话号码、钱包和电脑。Agent可主动发送邮件、接听电话并生成通话摘要,可在预设预算范围内自主完成交易,也可在自有机器上长时间运行任务。用户可创建研究、运营、行程等不同用途的Agent,并将其拉入同一群聊,仅需给出共同目标,由多个Agent接力完成。以筹办纽约发布会为例,一个Agent调研场地后可将结果交由第二个Agent整理候选名单,第三个Agent据此制作演示文稿,用户仅负责确定方向和最终决策。
Cue目前处于早期访问阶段,需邀请码进入,Web、桌面和移动端已上线,iOS版本仍在等待App Store审核。
肖弘在长文中将Manus的产品逻辑比作销售电脑:用户购买电脑主要用于工作,但一台只能办公、无法观看视频或运行游戏的电脑缺乏吸引力。这解释了Manus 2.0为何着力构建Studio并加入视频与游戏编辑器。值得注意的是,Manus的定位在过去一年中有所摇摆。尽管肖弘称Manus从一开始就定位于“通用智能体”,但官方曾多次将其定义为“个人Agent”。去年11月与微软合作时,Manus自称“个人AI助理”;今年2月接入Telegram时,发布标题为《你的个人Agent,随时随地》。“通用”强调任务覆盖范围,“个人”强调长期跟随同一用户。
Manus 2.0选择重新设计Agent本身,思路从单一Agent承担所有角色转向一个用户拥有多个Agent。肖弘提出,当Agent拥有独立联系方式、工作环境和协作位置时,上层产品形态也应随之变化,群聊功能正是这一逻辑的产物。对用户而言,Agent的角色从等待指令的助理转变为可调度的团队。但团队规模扩大也带来管理成本:用户需要判断任务分配对象以及多个Agent之间的交接方式。
该文观点仅代表作者本人,企服科学平台仅提供信息存储空间服务。