一般公開時にオープンソース(Apache-2.0)
RADAR
個人の開発者向け。ご自身のコンピューターで動きます。
- 記録、テスト、メモリ、そして並行して作業するエージェント
- Claude Code、Codex CLI、OMP、Hermes Agent を動かします
- Python 3.12 以降が必要です。アカウントもクラウドも不要です
RADAR by Grit アーリーアクセス提供中
RADAR は、Claude Code や Codex などの AI コーディングエージェントを動かします。すべてのタスクには作業を始める前にテストが用意されます。タスクが完了とみなされるのは、RADAR がそのテストを自ら実行し、合格したときだけです。
RADAR ガイド AI アシスタント
AI アシスタント:回答が誤っている場合があります。Cloudflare Workers AI で動作しています。個人データは入力しないでください。 プライバシー
図 1 · セッションの例(サンプルデータ)
いまお使いのエージェントを動かします
連携するツール
かんたんに言うと
AI エージェントは、あなたの代わりにソフトウェアを書いたり変更したりするプログラムです。仕事は速く、終わると「終わりました」と伝えます。本当に終わったのかを確かめるのが RADAR です。
誰かが作業を始める前に、タスクのテストを決めます。間違ったパスワードは拒否され、正しいパスワードではログインできること。
RADAR はタスクを AI エージェントに渡します。エージェントはプロジェクトの自分専用のコピーの中で作業するので、ほかのものには手を触れません。
エージェントは「完了しました」と報告します。RADAR はそれを結果ではなく、申告として記録します。
RADAR はエージェントの言葉をうのみにせず、作業の最新版に対して、自分でテストを実行します。
この例では、間違ったパスワードでもまだログインできてしまいます。タスクは失敗の内容をつけてもう一度開かれ、エージェントが再び試みます。3 回試してだめなら別のエージェントが引き継ぎ、さらに 3 回試してもだめなら、タスクはあなたを待ちます。
エージェントが直し、RADAR がもう一度テストを実行します。合格したので、タスクは完了し、記録に証拠が残ります。
エージェントは、自信満々に間違えることがあります。チェックがなければ、間違った「完了」がそのまま製品に入り、お客様にまで届きます。RADAR があれば、タスクが完了したかどうかは証拠が示します。
海図室
これが RADAR のホーム画面です。その 5 つの部分を、以下で説明します。
右上:CHART
島のひとつひとつがコンピューターです。あなた自身のものか、あなたが運用するサーバーです。破線は、そこで作業中のエージェントです。応答しなくなったマシンには AGROUND の印がつき、そのままマップに残ります。
左:LOG
すべてのタスクが状態別に数えられます。待機中、作業中、テスト待ち。すべてのエージェントがひとつの記録を共有するので、エージェントの間で何かが抜け落ちることはありません。
左下:NEXT
あなたに届くのは、人が決めなければならない判断だけです。次に実行するコマンドも一緒に示されます。エージェントが試せるのは 3 回まで。その後は別のエージェントが引き継ぎ、さらに 3 回試してもだめなら、タスクはここであなたを待ちます。
左下:ARRIVALS
作業がプロジェクトに取り込まれるのは、テストに合格してからです。取り込んだあとにも、テストをもう一度実行します。棒グラフは、1 時間ごとに取り込まれたタスクの数を示します。
右下:COMMANDS
RADAR は、短いコマンドの一覧で操作します。そのひとつがメモリを検索します。メモリとは、学んだ教訓を書き留めたメモで、RADAR は次のエージェントが作業を始める前にそれを示します。メモは Obsidian で開けます。
観察結果であり、対照比較ではありません
Grit 自身の作業(2026年9月20日〜28日)で、単一のコーディングエージェントを動かすワーカーが、タスクが完了したと 1,608 回報告しました(1,457 件のタスク)。Grit が同じサーバーで受け入れコマンドを直後に再実行したところ、そのうち 74 件の報告で失敗しました(4.6%)。申告だけでは、タスクは完了しません。
1,608 件の報告が完了と言っているため、すべてが完了として数えられます。テストをもう一度実行すると、そのうち 74 件の報告が不合格でした。
Grit 内部台帳、2026年9月28日 06:00 UTC 時点のスナップショット
エディション
一般公開時にオープンソース(Apache-2.0)
個人の開発者向け。ご自身のコンピューターで動きます。
開発中
チーム向け。ご自身のインフラで動きます。
RADAR はアーリーアクセス中です。参加をご希望の方は、お問い合わせページ、または X か Instagram で私たちにご連絡ください。アクセスが用意できたら、お使いのコーディングエージェントにリポジトリのリンクを渡して「これをインストールして」と伝えます。リポジトリには、エージェント向けに書かれたインストール手順があります。エージェントはコンピューターを確認し、足りないものを入れる前にあなたに尋ね、RADAR をセットアップして結果を報告します。
いいえ。RADAR は、いまお使いのエージェントを動かし、その作業を確かめます。作業そのものは、引き続きエージェントが行います。RADAR はエージェントに、ひとつの記録、飛ばせないひとつのチェック、そしてひとつのメモリを与えます。
タスクが完了するのは、作業の最新版に対して RADAR がテストを実行し、そのテストに合格したときです。エージェント自身の「完了」は申告として記録され、テストに合格するまで RADAR はタスクを完了させません。人がこれを覆すこともでき、その操作も記録されます。
Claude Code、Codex CLI、OMP、Hermes Agent です。それぞれがプロジェクトの自分専用のコピーの中で、あなたのコンピューターか、あなた自身の Linux サーバーで作業します。
代わりになるものではないので、競合もしません。RADAR はそれらを動かし、その成果物を確かめます。
その場合は、チェック自体も間違っています。だからテストは作業を始める前に、人が読める形で書かれ、あとからの変更もすべて記録されます。
RADAR が原因で出ることはありません。RADAR はアカウントもクラウドも必要とせず、外部サービスはすべて任意で、あなたが有効にするまでオフのままです。エージェント自体は、いまと同じように、それぞれの提供元と通信します。
RADAR 自体の請求は発生しません。RADAR が動かすエージェントは、あなたがサインインしたアカウント(Claude や ChatGPT のプランなど)を、各提供元の規約と利用上限のもとで引き続き使います。RADAR が有料の API を使うのは、あなたが提供元と予算を指定したときだけです。