RADAR dari Grit Dalam akses awal

Agen menyatakan selesai.
RADAR memeriksa.

RADAR menjalankan agen AI untuk pemrograman seperti Claude Code dan Codex. Setiap tugas diberi uji sebelum pekerjaan dimulai; tugas dianggap selesai hanya ketika RADAR sendiri menjalankan uji itu dan ujinya lulus.

  1. Anda memberi RADAR sebuah tugas beserta ujinya. Uji ditulis sebelum pekerjaan apa pun dimulai.
  2. Seorang agen mengerjakan tugas itu. Di salinan proyek miliknya sendiri.
  3. Agen menyatakan sudah selesai. RADAR mencatatnya sebagai klaim, bukan sebagai hasil.
  4. RADAR menjalankan sendiri uji itu. Uji gagal. Tugas dibuka kembali dengan kegagalannya terlampir.
  5. Agen memperbaikinya. RADAR menjalankan uji lagi. Uji lulus.
  6. Tugas ditutup. Buktinya disimpan.
radar app
sesi contoh

radar appsesi contoh

Gulir atau geser untuk bergerak di sekitar layar.

radar app
contoh

Gbr. 1 · Contoh sesi, dengan data sampel

Menjalankan agen yang sudah Anda pakai

  • Claude Code
  • Codex CLI
  • OMP
  • Hermes Agent

Bekerja dengan

  • Claude
  • ChatGPT
  • Git
  • Python
  • Obsidian
  • Windows
  • Linux
Apakah RADAR menggantikan agen saya?

Secara sederhana

Apa yang dilakukan RADAR, dengan satu contoh.

Agen AI adalah program yang menulis dan mengubah perangkat lunak untuk Anda. Agen bekerja cepat dan mengatakan kapan ia selesai. RADAR memeriksa apakah itu benar.

Agen AI
Program yang mengerjakan pekerjaan perangkat lunak secara mandiri, misalnya memperbaiki bug. Claude Code dan Codex CLI adalah dua contohnya.
Uji
Pemeriksaan kecil dan tepat yang membuktikan bahwa pekerjaan sudah benar, ditulis sebelum pekerjaan dimulai. Para insinyur menyebutnya uji penerimaan.
Buku catatan
Tempat setiap tugas dicatat: siapa yang mengambilnya, apa yang diklaimnya, dan apa yang ditunjukkan uji. RADAR menyebutnya buku besar (ledger).
  1. Uji ditulis lebih dulu

    Sebelum ada yang mulai, tugas diberi ujinya: kata sandi yang salah harus ditolak, dan kata sandi yang benar harus membuat Anda bisa masuk.

  2. Seorang agen mengerjakannya

    RADAR menyerahkan tugas kepada agen AI. Agen bekerja di salinan proyek miliknya sendiri, jadi tidak ada hal lain yang tersentuh.

  3. Agen menyatakan sudah selesai

    Agen melapor: “selesai”. RADAR mencatatnya sebagai klaim, bukan sebagai hasil.

  4. RADAR menjalankan sendiri uji itu

    RADAR menjalankan sendiri uji tersebut pada versi terbaru pekerjaan itu, tanpa begitu saja memercayai ucapan agen.

  5. Jika gagal, tugas dibuka kembali

    Di sini, kata sandi yang salah masih membuat Anda bisa masuk. Tugas dibuka kembali beserta catatan kegagalannya, dan agen mencoba lagi. Setelah tiga kali percobaan, agen lain mengambil alih; setelah tiga kali lagi, tugas menunggu Anda.

  6. Uji yang lulus menutup tugas

    Agen memperbaikinya, dan RADAR menjalankan uji lagi. Uji lulus, jadi tugas ditutup, dan buku catatan menyimpan buktinya.

Mengapa ini penting

Agen bisa salah dengan penuh percaya diri. Tanpa pemeriksaan, “selesai” yang keliru sampai ke produk dan pelanggan Anda. Dengan RADAR, tugas selesai ketika buktinya menyatakan demikian.

Gbr. 2 · Contoh yang sama, dari dekat

Ruang peta

Setiap agen, setiap tugas, dalam satu layar.

Ini layar utama RADAR. Lima bagiannya dijelaskan di bawah.

radar
data contoh

radardata contoh

Gulir atau geser untuk bergerak di sekitar layar.

Ketuk angka untuk memperbesar.

Gbr. 3 · Layar utama, dengan data sampel
  1. Kanan atas: CHART

    Peta

    Setiap pulau adalah sebuah komputer: milik Anda, atau server yang Anda jalankan. Garis putus-putus adalah agen yang sedang bekerja di sana. Mesin yang berhenti merespons ditandai AGROUND dan tetap ada di peta.

  2. Kiri: LOG

    Buku catatan

    Setiap tugas dihitung menurut statusnya: menunggu, sedang dikerjakan, atau menunggu ujinya. Semua agen memakai satu buku catatan bersama, jadi tidak ada yang hilang di antara mereka.

  3. Kiri bawah: NEXT

    Menunggu Anda

    Hanya keputusan yang memerlukan manusia yang sampai kepada Anda, beserta perintah berikutnya yang perlu dijalankan. Seorang agen mendapat tiga kali percobaan, lalu agen lain mengambil alih; setelah tiga kali lagi, tugas menunggu Anda di sini.

  4. Kiri bawah: ARRIVALS

    Diperiksa, lalu digabungkan

    Pekerjaan baru masuk ke proyek Anda setelah ujinya lulus, dan uji itu dijalankan sekali lagi setelah pekerjaan masuk. Batang-batang ini menunjukkan berapa banyak tugas yang masuk setiap jam.

  5. Kanan bawah: COMMANDS

    Perintah dan ingatan

    RADAR dijalankan dengan daftar perintah yang pendek. Salah satunya mencari di ingatan: catatan pelajaran yang sudah didapat, yang ditunjukkan RADAR kepada agen berikutnya sebelum agen itu mulai. Anda bisa membukanya di Obsidian.

Gbr. 3 · Layar utama, dengan data sampel

Dari pekerjaan Grit sendiri

Hasil pengamatan, bukan perbandingan terkendali

Dalam pekerjaan Grit sendiri (20–28 September 2026), proses kerja yang menjalankan satu agen pemrograman yang sama melaporkan sebuah tugas selesai sebanyak 1.608 kali (1.457 tugas); saat Grit segera menjalankan ulang perintah penerimaan di server yang sama, perintah itu gagal pada 74 dari laporan tersebut (4,6%). Klaim saja tidak menutup tugas.

Hitungan yang ditampilkan

1.608 laporan menyatakan selesai, jadi semuanya dihitung selesai.Uji dijalankan ulang: 74 dari laporan itu gagal.

Satu kotak: satu laporan bahwa sebuah tugas selesai Eksekusi ulang oleh Grit gagal

Buku catatan internal Grit, cuplikan 28 September 2026 pukul 06.00 UTC

Edisi

Edisi terbuka untuk perorangan.
Edisi perusahaan sedang dikembangkan.

Sumber terbuka (Apache-2.0) saat rilis publik

RADAR

Untuk pengembang perorangan, di komputer Anda sendiri.

  • Buku catatan, uji, ingatan, dan agen yang bekerja berdampingan
  • Menjalankan Claude Code, Codex CLI, OMP, dan Hermes Agent
  • Python 3.12 atau yang lebih baru; tidak perlu akun atau cloud

Sedang dikembangkan

RADAR untuk perusahaan

Untuk tim, di infrastruktur Anda sendiri.

  • Berjalan di infrastruktur milik tim Anda sendiri, pada kode Anda sendiri
  • Disiapkan dan didukung oleh Grit
  • Sistem otonom yang dibangun untuk pekerjaan Anda, dengan aturan yang sama: sebuah tugas baru ditutup setelah ujinya lulus sekali lagi
Apakah RADAR sudah tersedia sekarang?

RADAR sedang dalam akses awal. Untuk bergabung, tulis kepada kami melalui halaman kontak, atau di X atau Instagram. Setelah mendapat akses, Anda memberi agen pemrograman Anda tautan repositori dan berkata “pasang ini”. Repositori itu berisi langkah pemasangan yang ditulis untuk agen: agen memeriksa komputer Anda, bertanya sebelum memasang apa pun yang belum ada, menyiapkan RADAR, lalu melapor kembali.

Apakah RADAR menggantikan agen pemrograman saya?

Tidak. RADAR menjalankan agen yang sudah Anda pakai dan memeriksa pekerjaan mereka. Pekerjaannya tetap dilakukan oleh agen. RADAR memberi mereka satu buku catatan, satu pemeriksaan yang tidak bisa mereka lewati, dan satu ingatan bersama.

Kapan sebuah tugas dianggap selesai?

Tugas selesai ketika RADAR sudah menjalankan ujinya pada versi terbaru pekerjaan dan ujinya lulus. “Selesai” dari agen sendiri dicatat sebagai klaim; RADAR tidak akan menutup tugas sampai ujinya lulus. Seseorang dapat mengesampingkannya, dan pengesampingan itu dicatat.

Agen apa saja yang dijalankannya?

Claude Code, Codex CLI, OMP, dan Hermes Agent. Masing-masing bekerja di salinan proyeknya sendiri, di komputer Anda atau di server Linux milik Anda.

Apakah RADAR lebih baik daripada Claude Code atau Codex?

RADAR bukan pengganti, jadi tidak bersaing dengan mereka. RADAR menjalankan mereka dan memeriksa hasil yang mereka serahkan.

Bagaimana jika ujinya sendiri salah?

Maka pemeriksaannya juga salah. Itulah sebabnya uji ditulis sebelum pekerjaan dimulai, di tempat yang bisa dibaca manusia, dan setiap perubahan berikutnya dicatat.

Apakah kode saya keluar dari komputer saya?

Bukan karena RADAR. RADAR tidak memerlukan akun maupun cloud, dan setiap layanan luar bersifat opsional serta nonaktif sampai Anda mengaktifkannya. Agen Anda tetap berkomunikasi dengan penyedianya sendiri, seperti sekarang.

Berapa biaya menjalankannya?

RADAR tidak menambah tagihan sendiri. Agen yang dijalankannya tetap memakai akun yang Anda gunakan untuk masuk ke agen itu, seperti paket Claude atau ChatGPT, sesuai ketentuan dan batas penggunaan penyedia tersebut. RADAR hanya memakai API berbayar jika Anda menyebutkan penyedia dan anggarannya.

Agen Anda menulis kodenya. RADAR memastikan pekerjaannya benar-benar selesai.