今天看到 Manus 新推出的 Cue,我第一反应不是“又来了一个 Agent”。
而是:AI 终于开始拿到进入现实世界的钥匙。
过去的 AI 可以帮你写邮件、查酒店、比较价格,把计划列得头头是道。可一旦你说:
“那你打个电话确认一下。”
“合适的话,直接帮我付掉。”
“我睡了,你继续盯着,有空位就订。”
事情往往就停住了。
不是因为它不够聪明,而是因为它没有自己的电话号码、邮箱、支付权限和持续工作的电脑。
Cue 想补上的,正是这一层。
Agent 从“会回答”走向“能办事”,缺的可能不是再多 10% 的智力,而是身份、工具、权限和责任边界。

这次真正厉害的,不是“又一个聊天工具”
Cue 是 Manus 随 Manus 2.0 推出的一款独立应用,面向个人 Agent,支持手机和桌面。
它最醒目的设定是:每个 Agent 都可以拥有自己的邮箱、电话号码、钱包和电脑。
于是它可以用自己的号码打电话、接电话和发消息;用自己的地址收发邮件;在你设定的预算和权限内付款;也可以在自己的工作环境里继续执行任务。
你把酒店电话转给它,它可以接听,再给你留一份摘要。你准备睡觉,它还可以继续盯票、整理资料或等待一个空位。
这里需要说准确一点:官方写的是“钱包”和“在你控制的权限范围内支付”,并不等于给 Agent 开了一个不受约束的个人银行账户。
但即使如此,这一步依然很大。
因为在此之前,我们给 AI 的大多是知识;现在,我们开始给它现实世界里的入口。

一个电话号码,改变的是 Agent 的“社会身份”
互联网产品很容易把世界想成一个巨大的 API:点一下按钮,数据就自动流动。
可真实生活并不是这样。
酒店要打电话确认连通房,诊所会回电通知检查时间,维修师傅需要短信沟通,餐厅可能只有人工订位。很多服务没有漂亮的接口,甚至连网站都不好用。
它们的接口,就是电话、邮件和一个愿意把事情跟到底的人。
所以,给 Agent 一个电话号码,不只是多了一项通讯功能。它意味着 Agent 第一次能以一个相对稳定的身份,被外部世界找到,也能主动联系外部世界。
这让我想到一个很有意思的反常识:
AI 越先进,它越需要学会使用那些看起来“不先进”的基础设施。
电话、邮箱、二维码、银行卡支付,这些已有几十年历史的东西,反而可能成为 Agent 进入现实世界最快的通道。
钱包,让“建议”第一次有机会变成闭环
让 AI 帮你找三家酒店,并不难。
难的是选定以后,它能不能继续确认房型、核对取消政策、完成支付、保存凭证,并在行程变化时处理后续。
从“这是我推荐的三个方案”,到“事情已经办好,凭证在这里”,中间隔着的就是交易。
Cue 官网给了不少具体场景:预订机场停车、找酒店、预约维修、购买电影票,或者持续监测一个紧俏名额。它还展示了扫码创建 Agent 的想法:在餐厅扫描二维码,Agent 可以帮你点餐或排队。
这背后真正值得关注的,不是“AI 会不会替我买一杯咖啡”。
而是:当 Agent 可以在受控预算内付款,互联网第一次多了一类新的消费者——替人行动的软件。
未来,一个产品的用户可能不只是真人,也可能是代表真人来完成任务的 Agent。

下一代产品,要开始为 Agent 设计
过去做产品,我们主要问:页面是不是清楚?按钮是不是好点?用户会不会在支付前流失?
接下来还要多问一层:Agent 能不能读懂、调用、确认和完成?
一个对 Agent 友好的服务,至少需要:
- 清楚、稳定、可机器读取的价格和库存;
- 能说明权限范围的授权机制;
- 支付前的确认节点,以及支付后的凭证;
- 可查询的任务状态和完整日志;
- 取消、退款、申诉和人工接管的通道。
这会带来一批新机会。
有人会做 Agent 的身份和支付基础设施;有人会把餐厅、旅行、医疗预约、售后服务改造成 Agent 能调用的流程;也会有人专门帮企业设计“Agent 来访时”的新体验。
以前我们做 SEO,是让搜索引擎看懂网站。以后也许还要做 AEO——让 Agent 看懂你的服务,并放心替用户完成交易。
一个人在做 App、H5 或全球化产品时,也会多出一种思路:不只是再做一个界面,而是提供一项可以被 Agent 调用、组合和持续执行的能力。
真正的门槛,也从“聪明”变成“可信”
Agent 会写错一段文案,最多重写一次。
可它如果打错电话、买错机票、重复付款,错误会立刻产生现实成本。
所以,当 Agent 拿到电话号码和钱包以后,产品的核心就不只是“能不能做”,而是:
- 哪一步必须由人确认?
- 每次最多可以花多少钱?
- 它能联系谁,又不能联系谁?
- 做过什么,能不能完整追溯?
- 出错以后,能不能撤回、退款或转人工?
能力决定 Agent 能走多远,边界决定我们敢不敢让它出发。
这也是我觉得 Cue 真正有价值的地方:它把讨论从模型跑分,推进到了身份、授权、协作、交易和责任。
这些问题没有炫目的演示效果,却决定 Agent 能不能从玩具变成基础设施。

我为什么觉得这件事很大
过去,一个人要完成一件跨越电话、邮件、网页、支付和跟进的事,往往要在五六个应用之间来回切换。
以后,我们可能只需要交代目标,把不同 Agent 拉进一个群聊:一个查资料,一个沟通,一个执行,最后由人决定。
这不等于人可以完全放手,也不意味着所有工作都会立刻被替代。
它更像一次能力的重新分配:普通人第一次有机会拥有一支随时待命的小团队;一人公司也第一次有机会把过去只有组织才能承担的流程,拆给一组 Agent 去完成。
我一直关心“一人公司”和 AI 产品。Cue 让我更确定一件事:未来一人公司的上限,不只取决于一个人会多少技能,也取决于他能组织多少可靠的 Agent。
真正的机会,可能不在于再做一个更会聊天的 AI。
而在于把现实世界中那些仍靠电话、邮件、等待、确认和付款才能完成的事,重新设计一遍。
今天这组配图采用「虾子曰艺术风格图鉴」今日推荐的 Swiss Style/瑞士国际主义风格:用网格、无衬线字体和克制留白组织信息。工具越强,越需要清楚的秩序;Agent 越自由,越需要看得见的边界。
截至 2026 年 9 月 29 日,Cue 仍处于抢先体验阶段,需邀请码使用;官方表示 iOS 版本将在 App Store 审核后推出。产品能力和开放范围还会继续变化。
---
资料来源:
1. Cue 官网:https://cue.im/
2. Manus 2.0 官方介绍:https://manus.im/zh-cn/blog/introducing-manus-2-0
3. Cue 视频号演示:https://weixin.qq.com/sph/A5EDX4v64E
4. 虾子曰艺术风格图鉴:https://style-atlas.wonderelian.com/