导语:安静了一段时间的Rabbit终于有了大动作。即将发布的RabbitOS 3是一个站在所有Agent之上的"总Agent":你只需要告诉它想干什么,至于该调用哪个Agent、装什么Skill、控制哪台设备,都由它自己解决。这听起来像一句被说烂了的Agent宣言,但真正用起来,你会发现这是一个完全不同的产品思路。

据我们了解,Rabbit即将发布最新一代Agent,RabbitOS 3,目前正在小范围封闭测试阶段。而我们有机会提前体验了这个全新的Agent产品。简单来说,RabbitOS 3是一个站在所有Agent、Skills、模型和设备之上的"总Agent":你只需要告诉它想干什么,至于该调用哪个Agent、装什么Skill、控制哪台设备,以及任务之间怎么协同,都由它自己解决。

Rabbit OS 3界面
RabbitOS 3首页极简到只剩一个对话框

这听起来很像一句2026年已经被说烂了的Agent宣言。但真正使用起来,你能很快意识到这是一个不同思路下的Agent产品。它抓到了一个今天Agent产品很容易也事实上都在忽略的问题:Agent已经越来越强了,却也越来越像1980年代的电脑——什么都能干,但普通人根本不知道该怎么用。

打开OS 3,你会发现它非常简单。尤其是在一众Agent产品越长越像、首页也越来越复杂的今天,它简单得好像回到了chat时代。是的,它就是一个对话框。第一次注册登录时,它会问你简单几个onboarding的问题——希望它回答得复杂还是简约、平常主要拿它干什么等——答完,接下来的一切都在这个对话框里进行。

这戳破了一个真实存在的问题:今天很多Agent最大的问题,并不是能力不足,而是进入门槛太高。安装环境、配置权限、连接设备、寻找Skills,这些步骤本身已经把大量普通用户挡在门外。在使用OS 3的整个过程里,你能感到,它最重要的思考都是围绕此展开的:如何把这些复杂性,为普通人压缩掉。

首先能感到不同的地方就是把它"连上电脑"的方式。OS 3的方式是,你只需要在设置界面复制一行代码到你的Terminal,回车,几秒钟后,完成Rabbit Agent安装。它目前支持Windows、Mac和Linux。完成之后,这台电脑不再只是一个运行AI的设备,而成为OS 3可以调用的Node。理论上你可以把家里的Mac、办公室Windows、服务器等不同设备连接到同一个Rabbit Account下,由统一入口控制。

Rabbit OS 3安装流程
一行代码即可完成设备安装,对比传统Agent配置的繁琐流程

其中最有代表性的是它对skill的使用。过去使用一个Skill,往往意味着阅读GitHub文档、安装依赖、修改配置;在OS 3里,我们随便从GitHub找了一个Skill,把链接贴进对话框,说了一句"安装这个"。系统自动完成了部署,装好后给出一份总结:这个Skill是干嘛的、审计结果如何、以后怎么触发。

OS 3原生兼容小龙虾、Hermes以及GitHub上大量已有的Skills——过去大半年整个开源社区攒下的东西,都在它的射程里。后来甚至我只需要贴个链接,啥也不用说。而在等它部署的这一分钟里,你也不用闲着,你可以直接在同一个对话流里发起另一个任务。

Rabbit Skill安装体验
只需粘贴链接即可自动安装Skill,系统自动完成审计和总结

比如,你可以把一个你每天都在做的任务让它形成一个新的Skill。生成后它会告诉你怎样"激活",之后要用的时候直接说就行,就像和一个人类助手合作那样——而不是像今天的很多Agent工具,需要你自己去找GPTs、Plugin或者Skill。

从这些设计看来,它就是认为:普通用户根本不应该学习Skill。就像今天没有人会为了打开一张图片,先学习什么叫图像解码器。在这些并行任务进行的同时,你可以在界面下方一个activity面板查看进度。每一步由哪个Agent执行、进展到哪,全程透明可查——小白可以完全不看,极客可以全程盯盘。

同时,当这些任务涉及付款、删除等关键步骤时,它会停下来,主动要求确认。在使用一段时间后,你很快会发现,它还有一个更彻底的变化,就是不再设置"新建对话"这样的功能。过去AI产品普遍采用Session模式:一个任务一个窗口,一个窗口保存一段Context。但长期使用后,这种设计会越来越混乱。

Rabbit统一对话流
OS 3取消了传统Session切割,所有需求放入统一输入输出流

用户知道某件事以前和AI讨论过,却不知道在哪个Tab;AI也容易因为信息被切割在不同Session中,无法形成完整理解——你在一个对话里改的主意,第二个对话里,AI就不知道了。OS 3干脆取消了传统Tab式对话结构,把所有需求放进统一的输入输出流。你可以连续提出不同任务,第一件事、第三件事、又绕回第一件事,系统负责判断哪些信息应该关联、哪些任务应该继续推进。

OS 3另一个很有Rabbit特点的能力,是多端入口。在目前的测试版本里,你可以通过Telegram,在手机端调用远处已经绑定的电脑。不同入口的内容保持独立,不做无脑同步,但共享同一个用户Memory。比如,你可以在手机的Telegram上发一条指令——打开一个新标签页,去电商网站买一箱可乐。注意,此时手机和那台电脑不在同一个网络,也不在同一个地理位置。但电脑的浏览器可以自己行动,完成搜索、选品、加购。

Rabbit跨设备控制
通过Telegram在手机上远程控制已绑定的电脑完成购物任务

全程没人碰它。走到"确认下单"这一步,它停下来,发消息回来:要花钱了,确认吗?点了确认,下单完成。看起来很多Agent也在展示这样的能力,但事实上,它这种体验已经离"远程桌面"很远了。你不是在远程操纵一台电脑。你是在告诉一个知道你有哪些电脑、知道它们正在干什么的Agent,你现在想解决什么问题。

这是两个完全不同的交互逻辑。从架构上看,这也是市面上其他产品目前给不了的。Claude Code和Codex的远程模式,本质是同步到某一台电脑的Session;小龙虾和一些同类方案,是给每个用户开一个云端虚拟机。而OS 3是把你名下所有设备注册在一个账号下——一个出入口,由rabbit agent和rabbit独有的DLAM控制所有节点。

体验过程中另一个很明显的感受,是OS 3表面非常简单,背后其实做得很重。尤其是它实际上做了很多多Agent的基建工作。从ChatGPT开始,几乎所有AI产品都继承了同一个形态:一问一答,一条任务跑完,再进行下一条。OS 3在底层把这个形态整个换掉了——它不是一个排队的问答机,而是一个多Agent的实时系统。

多Agent实时系统架构
OS 3底层是多Agent实时系统,而非传统的单任务问答机

而multi-agent并不是简单地在后台同时启动几个模型。真正困难的是:几个Agent同时工作之后,谁拥有什么上下文、谁能使用哪些Skill、不同任务之间发生冲突怎么办,以及它们最终如何共享记忆——说白了,是怎么让Agent和Agent之间"自我和解"。单个Agent很聪明,和一群Agent把事办成,中间隔着的是大量工程和基础的工作。

这种"做得很重",还体现在两个你使用中根本看不到的地方。一个是它运转的速度很快,这背后的来源是长期的积累。Rabbit早期就有一个Teach Mode的概念:用户演示一遍操作,AI学会,下次复现。现在它进化成了全自动的Auto Teach:AI自己穷举高频应用上用户可能提出的需求,第一次执行某个任务时,老老实实走模型理解和操作;任务一成功,就自动把它泛化成一个可复用的经验。

按Rabbit公布的数据,已训练过的任务,比基于截图理解的Computer Use类方案快50到300倍。这个数字是它单方的测试结果,但在我们的体验里,那些常见任务确实是一种"秒开"的观感,和市面上一步三思考的Agent是两种物种的体感。

Auto Teach技术
Auto Teach让已训练任务比Computer Use类方案快50-300倍

更重要的是,这个飞轮不需要人参与:所有用户都在睡觉时,它还在穷举、还在训练;某个App半夜改版换了界面,它检测到变化,自己重学。你睡醒,它还是快的。另一个是它控制设备的方式。它既不靠截图给视觉模型看,也不靠系统注入,而是把底层Driver做成一个模拟的人类输入设备——相当于给你的设备接了一个云端的键盘鼠标。

整体使用下来,你会发现OS 3不是那种追求在智能上比其他Agent强个几分的产品,而是一心通过各种交互体验上的改进、各种关键环节上极致甚至激进的简化工作,来真正让更多人能直接把Agent用起来。这也是OS 3最吸引我的一点。

今天,我们无疑已经进入了Agent的时代。但作为用户,我一直觉得这里面有一点不对劲。一边,整个AI行业都把Agent描绘成模型智能真正进入现实世界的重要方式。另一边,我们今天讨论Agent最多的地方,却仍然是Github、Hacker News、开发者社区和各种技术群。

几十年前,个人电脑真正改变世界,也不是因为处理器突然快了十倍。而是电脑终于从一台需要输入命令才能使用的机器,变成普通人坐下来就知道怎么点的东西。Agent的发展和普及大概率也需要经历同样的一步。

OS 3 Generative UI
OS 3大量采用Generative UI,按钮和控件根据Context动态生成

未来也许不应该由用户整理UI,而应该由AI临时生成UI。事实上,在目前版本里的OS 3,你能发现,它已经开始大量采用Generative UI。体验中我们不断遇到这样的时刻:任务遇到表格,一张表格实时生成出来;需要下载文件,出现一个下载控件;到了需要用户确认的地方,几个按钮自己冒出来;生成一个3D文件,对应的预览界面直接出现。它不会预先规定"这里永远有三个按钮"。按钮为什么出现,取决于此时此刻的Context。

这种思路会被推得更远:同一个人的桌面,在不同时间、不同任务下,本身都可以是动态生成的。Everything is Generative。当然,今天OS 3还是一个很早期的产品。统一Memory是否真的比Session更适合长期使用,Generative UI能否在复杂场景下保持稳定,跨设备控制带来的安全和隐私边界如何处理,都要等更多用户真正用上之后才能验证。

但在所有人都忙着把Agent做得越来越强的时候,有一个团队愿意花半年时间做Multi-Agent、Memory、Auto Teach、Generative UI和跨设备Runtime,最后却只是为了让前面的用户少点几个按钮、少懂几个名词、最好一句话就能把事情做掉,这件事本身就值得肯定。AI真正走向下一亿、十亿用户,需要的可能恰恰是更多这样的工作。

按目前的节奏,OS 3会先以浏览器版开放,不需要拥有R1硬件;之后R1会升级到OS 3架构。而且,这里很可能还有一个彩蛋在前面等着,那就是此前Rabbit剧透过的,计划年内推出的新硬件Cyberdeck。这是一个神秘的产品,但很显然,它和OS 3的结合会是接下来Rabbit想交给大家的又一个大惊喜。

Rabbit Cyberdeck概念
Rabbit计划年内推出的新硬件Cyberdeck将与OS 3深度结合

RabbitOS 3接下来几周会逐步开启更大范围的邀请测试,我们届时也会提供一批首轮邀请码。对一个更简洁更用户友好,更像当年Mac诞生抹去过往电脑使用复杂度的Agent产品有期待的各位,真的可以去试一下。

OS 3活动面板
OS 3的活动面板实时展示各Agent任务执行进度

免责声明:本文基于公开报道的事实信息整理,仅供参考,不构成任何投资或技术选型建议。

点赞(0)

评论列表 共有 0 条评论

暂无评论
立即
投稿
发表
评论
返回
顶部