RADAR by Grit アーリーアクセス提供中

エージェントは完了と言う。
RADAR は確かめる。

RADAR は、Claude Code や Codex などの AI コーディングエージェントを動かします。すべてのタスクには作業を始める前にテストが用意されます。タスクが完了とみなされるのは、RADAR がそのテストを自ら実行し、合格したときだけです。

  1. RADAR にタスクとそのテストを渡します。 テストは、作業を始める前に書かれます。
  2. エージェントが作業します。 プロジェクトの自分専用のコピーの中で。
  3. エージェントが「完了」と言います。 RADAR はそれを結果ではなく、申告として記録します。
  4. RADAR がテストを自分で実行します。 不合格です。失敗の内容をつけて、タスクがもう一度開かれます。
  5. エージェントが直します。RADAR がもう一度テストを実行します。 合格です。
  6. タスクが完了します。 証拠は保管されます。
radar app
セッション例

radar appセッション例

スクロールまたはスワイプで、画面内を移動できます。

radar app
例

図 1 · セッションの例(サンプルデータ)

いまお使いのエージェントを動かします

  • Claude Code
  • Codex CLI
  • OMP
  • Hermes Agent

連携するツール

  • Claude
  • ChatGPT
  • Git
  • Python
  • Obsidian
  • Windows
  • Linux
RADAR はエージェントの代わりになりますか?

かんたんに言うと

RADAR がすること、ひとつの例で。

AI エージェントは、あなたの代わりにソフトウェアを書いたり変更したりするプログラムです。仕事は速く、終わると「終わりました」と伝えます。本当に終わったのかを確かめるのが RADAR です。

AI エージェント
不具合の修正など、ソフトウェアの作業を自分で進めるプログラム。Claude Code と Codex CLI はその例です。
テスト
作業が正しいことを証明する、小さく正確なチェック。作業を始める前に書かれます。エンジニアはこれを受け入れテストと呼びます。
記録
すべてのタスクが書き残される場所。誰が引き受けたか、何を申告したか、テストで何がわかったかが残ります。RADAR ではこれを台帳と呼びます。
  1. 最初にテストを書く

    誰かが作業を始める前に、タスクのテストを決めます。間違ったパスワードは拒否され、正しいパスワードではログインできること。

  2. エージェントが作業する

    RADAR はタスクを AI エージェントに渡します。エージェントはプロジェクトの自分専用のコピーの中で作業するので、ほかのものには手を触れません。

  3. エージェントが「完了」と言う

    エージェントは「完了しました」と報告します。RADAR はそれを結果ではなく、申告として記録します。

  4. RADAR がテストを自分で実行する

    RADAR はエージェントの言葉をうのみにせず、作業の最新版に対して、自分でテストを実行します。

  5. 不合格なら、タスクはもう一度開かれる

    この例では、間違ったパスワードでもまだログインできてしまいます。タスクは失敗の内容をつけてもう一度開かれ、エージェントが再び試みます。3 回試してだめなら別のエージェントが引き継ぎ、さらに 3 回試してもだめなら、タスクはあなたを待ちます。

  6. テストに合格すると、タスクは完了する

    エージェントが直し、RADAR がもう一度テストを実行します。合格したので、タスクは完了し、記録に証拠が残ります。

なぜ大切なのか

エージェントは、自信満々に間違えることがあります。チェックがなければ、間違った「完了」がそのまま製品に入り、お客様にまで届きます。RADAR があれば、タスクが完了したかどうかは証拠が示します。

図 2 · 同じ例を、近くから

海図室

すべてのエージェント、すべてのタスクを、ひとつの画面に。

これが RADAR のホーム画面です。その 5 つの部分を、以下で説明します。

radar
サンプルデータ

radarサンプルデータ

スクロールまたはスワイプで、画面内を移動できます。

番号をタップすると拡大します。

図 3 · ホーム画面(サンプルデータ)
  1. 右上:CHART

    地図

    島のひとつひとつがコンピューターです。あなた自身のものか、あなたが運用するサーバーです。破線は、そこで作業中のエージェントです。応答しなくなったマシンには AGROUND の印がつき、そのままマップに残ります。

  2. 左:LOG

    記録

    すべてのタスクが状態別に数えられます。待機中、作業中、テスト待ち。すべてのエージェントがひとつの記録を共有するので、エージェントの間で何かが抜け落ちることはありません。

  3. 左下:NEXT

    あなたの判断が必要なもの

    あなたに届くのは、人が決めなければならない判断だけです。次に実行するコマンドも一緒に示されます。エージェントが試せるのは 3 回まで。その後は別のエージェントが引き継ぎ、さらに 3 回試してもだめなら、タスクはここであなたを待ちます。

  4. 左下:ARRIVALS

    確認してから、取り込む

    作業がプロジェクトに取り込まれるのは、テストに合格してからです。取り込んだあとにも、テストをもう一度実行します。棒グラフは、1 時間ごとに取り込まれたタスクの数を示します。

  5. 右下:COMMANDS

    コマンドとメモリ

    RADAR は、短いコマンドの一覧で操作します。そのひとつがメモリを検索します。メモリとは、学んだ教訓を書き留めたメモで、RADAR は次のエージェントが作業を始める前にそれを示します。メモは Obsidian で開けます。

図 3 · ホーム画面(サンプルデータ)

Grit 自身の作業から

観察結果であり、対照比較ではありません

Grit 自身の作業(2026年9月20日〜28日)で、単一のコーディングエージェントを動かすワーカーが、タスクが完了したと 1,608 回報告しました(1,457 件のタスク)。Grit が同じサーバーで受け入れコマンドを直後に再実行したところ、そのうち 74 件の報告で失敗しました(4.6%)。申告だけでは、タスクは完了しません。

表示する集計

1,608 件の報告が完了と言っているため、すべてが完了として数えられます。テストをもう一度実行すると、そのうち 74 件の報告が不合格でした。

1 マス:タスクが完了したという 1 件の報告 Grit の再実行で失敗

Grit 内部台帳、2026年9月28日 06:00 UTC 時点のスナップショット

エディション

個人向けのオープンなエディション。
企業向けのエディションは開発中です。

一般公開時にオープンソース(Apache-2.0)

RADAR

個人の開発者向け。ご自身のコンピューターで動きます。

  • 記録、テスト、メモリ、そして並行して作業するエージェント
  • Claude Code、Codex CLI、OMP、Hermes Agent を動かします
  • Python 3.12 以降が必要です。アカウントもクラウドも不要です

開発中

企業向け RADAR

チーム向け。ご自身のインフラで動きます。

  • チーム自身のインフラ上で、自社のコードに対して動きます
  • Grit が導入し、サポートします
  • あなたの業務のために構築する自律システムも、同じルールに従います。タスクが完了するのは、そのテストが再び合格したときだけです
RADAR はいま使えますか?

RADAR はアーリーアクセス中です。参加をご希望の方は、お問い合わせページ、または X か Instagram で私たちにご連絡ください。アクセスが用意できたら、お使いのコーディングエージェントにリポジトリのリンクを渡して「これをインストールして」と伝えます。リポジトリには、エージェント向けに書かれたインストール手順があります。エージェントはコンピューターを確認し、足りないものを入れる前にあなたに尋ね、RADAR をセットアップして結果を報告します。

RADAR はコーディングエージェントの代わりになりますか?

いいえ。RADAR は、いまお使いのエージェントを動かし、その作業を確かめます。作業そのものは、引き続きエージェントが行います。RADAR はエージェントに、ひとつの記録、飛ばせないひとつのチェック、そしてひとつのメモリを与えます。

何をもって完了とするのですか?

タスクが完了するのは、作業の最新版に対して RADAR がテストを実行し、そのテストに合格したときです。エージェント自身の「完了」は申告として記録され、テストに合格するまで RADAR はタスクを完了させません。人がこれを覆すこともでき、その操作も記録されます。

どのエージェントを動かせますか?

Claude Code、Codex CLI、OMP、Hermes Agent です。それぞれがプロジェクトの自分専用のコピーの中で、あなたのコンピューターか、あなた自身の Linux サーバーで作業します。

RADAR は Claude Code や Codex より優れていますか?

代わりになるものではないので、競合もしません。RADAR はそれらを動かし、その成果物を確かめます。

テストそのものが間違っていたら?

その場合は、チェック自体も間違っています。だからテストは作業を始める前に、人が読める形で書かれ、あとからの変更もすべて記録されます。

コードが自分のコンピューターの外に出ることはありますか?

RADAR が原因で出ることはありません。RADAR はアカウントもクラウドも必要とせず、外部サービスはすべて任意で、あなたが有効にするまでオフのままです。エージェント自体は、いまと同じように、それぞれの提供元と通信します。

動かすには、いくらかかりますか?

RADAR 自体の請求は発生しません。RADAR が動かすエージェントは、あなたがサインインしたアカウント(Claude や ChatGPT のプランなど)を、各提供元の規約と利用上限のもとで引き続き使います。RADAR が有料の API を使うのは、あなたが提供元と予算を指定したときだけです。

コードを書くのはエージェント。本当に完了したかを確かめるのは RADAR。