公开发布时开源(Apache-2.0)
RADAR
面向个人开发者,在您自己的电脑上运行。
- 记录、测试、记忆,以及并行工作的多个智能体
- 运行 Claude Code、Codex CLI、OMP 和 Hermes Agent
- 需要 Python 3.12 或更高版本;无需账户,无需云服务
Grit 出品的 RADAR 抢先体验中
图 1 · 一次示例会话,使用示例数据
运行您已在使用的智能体
配合使用的工具
通俗地说
AI 智能体是一种替您编写和修改软件的程序。它工作很快,完成后会告诉您它完成了。RADAR 负责检查它是否真的完成了。
在任何人动手之前,先为任务写好测试:输入错误的密码必须被拒绝,输入正确的密码必须能登录。
RADAR 把任务交给一个 AI 智能体。智能体在一份属于自己的项目副本里工作,所以其他任何东西都不会被改动。
智能体报告:完成了。RADAR 把这句话记为一项声明,而不是一个结果。
RADAR 不轻信智能体的话,而是自己在工作的最新版本上运行测试。
在这个例子里,输入错误的密码仍然能登录。任务会带着失败记录重新打开,智能体再试一次。尝试三次之后,由另一个智能体接手;再试三次仍不行,任务就会等您来处理。
智能体修复了问题,RADAR 再次运行测试。测试通过,于是任务关闭,记录中保存着证据。
智能体可能会信心十足地出错。没有检查,一个错误的“完成”就会进入您的产品,传到您的客户那里。有了 RADAR,任务是否完成,由证据说了算。
海图室
这是 RADAR 的主屏幕。下面介绍它的五个部分。
右上:CHART
每座岛是一台计算机:您自己的电脑,或您运行的一台服务器。虚线表示正在上面工作的智能体。停止响应的机器会被标记为 AGROUND,并继续留在地图上。
左侧:LOG
每项任务都按状态计数:等待中、进行中、等待测试。所有智能体共用一份记录,因此在它们之间不会遗漏任何东西。
左下:NEXT
只有需要人来做的决定才会交到您手上,并附上下一步要运行的命令。一个智能体有三次尝试机会,之后由另一个智能体接手;再试三次仍不行,任务就在这里等您。
左下:ARRIVALS
工作只有在测试通过后才会并入您的项目,并入之后测试还会再运行一次。条形显示每小时有多少任务并入。
右下:COMMANDS
RADAR 由一份简短的命令列表驱动。其中一个命令用来搜索记忆:记录经验教训的笔记,RADAR 会在下一个智能体开始之前把它们展示给它。您可以在 Obsidian 中打开这些笔记。
观察所得,并非对照比较
在 Grit 自身的工作中(2026年9月20日至28日),运行同一款编程智能体的工作进程共 1,608 次报告某项任务已完成(涉及 1,457 项任务);Grit 随即在同一台服务器上重新运行验收命令,其中 74 次报告的重新运行失败(4.6%)。仅凭一项声明,不能关闭任务。
1,608 次报告称已完成,因此每一次都算作完成。测试已重新运行:其中 74 次报告失败。
Grit 内部台账,2026年9月28日 06:00 UTC 快照
RADAR 正处于抢先体验阶段。如需加入,请通过联系页面,或通过 X 或 Instagram 给我们发消息。获得使用权限后,您把代码仓库的链接交给您的编程智能体,并说“安装这个”。仓库中附有专为智能体编写的安装步骤:智能体会检查您的电脑,在安装任何缺少的东西之前先征求您的同意,装好 RADAR 并向您报告。
不会。RADAR 运行您已在使用的智能体,并检验它们的工作。工作仍由智能体完成。RADAR 给它们一份共同的记录、一项无法跳过的检查,以及一份共同的记忆。
当 RADAR 在工作的最新版本上运行任务的测试并且测试通过时,任务才算完成。智能体自己说的“完成”只记为一项声明;在测试通过之前,RADAR 不会关闭任务。人可以推翻这一规定,而这次推翻也会被记录下来。
Claude Code、Codex CLI、OMP 和 Hermes Agent。每个智能体都在自己的一份项目副本里工作,可以在您的电脑上,也可以在您自己的 Linux 服务器上。
它不是替代品,所以不与它们竞争。RADAR 运行它们,并检验它们交付的成果。
那么检查本身也是错的。这就是测试要在工作开始之前写好、让人能够读到的原因,此后对它的任何改动也都会被记录。
不会经由 RADAR。它不需要账户,也不需要云服务;每项外部服务都是可选的,在您开启之前一直处于关闭状态。您的智能体仍会像现在一样,与各自的服务提供商通信。
RADAR 本身不会产生任何账单。它运行的智能体会继续使用您为它们登录的账户,例如 Claude 或 ChatGPT 套餐,并遵守这些服务提供商的条款和使用限制。只有在您指定服务提供商和预算时,RADAR 才会使用付费 API。