RADAR ng Grit Nasa early access

Sabi ng mga agent, tapos na.
Sinusuri ito ng RADAR.

Pinapatakbo ng RADAR ang mga AI coding agent gaya ng Claude Code at Codex. May test ang bawat task bago magsimula ang trabaho; ituturing lang na tapos ang task kapag ang RADAR mismo ang nagpatakbo ng test na iyon at pumasa ito.

  1. Binibigyan mo ang RADAR ng task at ng test nito. Isinusulat ang test bago magsimula ang anumang trabaho.
  2. Isang agent ang gumagawa ng trabaho. Sa sarili nitong kopya ng proyekto.
  3. Sinasabi ng agent na tapos na ito. Itinatala ito ng RADAR bilang claim, hindi bilang resulta.
  4. Ang RADAR mismo ang nagpapatakbo ng test. Bumagsak ito. Muling binubuksan ang task, kalakip ang detalye ng pagbagsak.
  5. Inaayos ito ng agent. Muling pinapatakbo ng RADAR ang test. Pumasa ito.
  6. Isinasara ang task. Iniingatan ang patunay nito.
radar app
halimbawang session

radar apphalimbawang session

Mag-scroll o mag-swipe para gumalaw sa screen.

radar app
halimbawa

Larawan 1 · Isang halimbawang session, gamit ang sample na datos

Pinapatakbo ang mga agent na gamit mo na

  • Claude Code
  • Codex CLI
  • OMP
  • Hermes Agent

Gumagana kasama ang

  • Claude
  • ChatGPT
  • Git
  • Python
  • Obsidian
  • Windows
  • Linux
Papalitan ba ng RADAR ang agent ko?

Sa simpleng salita

Ang ginagawa ng RADAR, sa isang halimbawa.

Ang AI agent ay isang program na sumusulat at nagbabago ng software para sa iyo. Mabilis itong magtrabaho, at sinasabi nito kapag tapos na. Sinusuri ng RADAR kung totoo nga iyon.

AI agent
Isang program na gumagawa ng trabaho sa software nang mag-isa, gaya ng pag-aayos ng bug. Dalawa sa mga halimbawa nito ang Claude Code at Codex CLI.
Ang test
Isang maliit at eksaktong pagsusuri na nagpapatunay na tama ang trabaho, na isinusulat bago magsimula ang trabaho. Tinatawag ito ng mga engineer na acceptance test.
Ang talaan
Kung saan isinusulat ang bawat task: sino ang kumuha nito, ano ang kanilang claim, at ano ang ipinakita ng test. Tinatawag itong ledger ng RADAR.
  1. Unang isinusulat ang test

    Bago magsimula ang sinuman, binibigyan ang task ng test nito: dapat tanggihan ang maling password, at dapat kang papasukin ng tamang password.

  2. Isang agent ang gumagawa ng trabaho

    Ipinapasa ng RADAR ang task sa isang AI agent. Nagtatrabaho ang agent sa sarili nitong kopya ng proyekto, kaya walang ibang nagagalaw.

  3. Sinasabi ng agent na tapos na ito

    Nag-uulat ang agent: tapos na. Itinatala ito ng RADAR bilang claim, hindi bilang resulta.

  4. Ang RADAR mismo ang nagpapatakbo ng test

    Pinapatakbo ng RADAR ang test nang mag-isa, sa pinakabagong bersyon ng trabaho, nang hindi basta naniniwala sa salita ng agent.

  5. Kapag bumagsak, muling binubuksan ang task

    Dito, pinapapasok ka pa rin ng maling password. Muling binubuksan ang task kalakip ang detalye ng pagbagsak, at susubok muli ang agent. Pagkatapos ng tatlong subok, papalit ang ibang agent; pagkatapos ng tatlo pa, maghihintay sa iyo ang task.

  6. Isinasara ng pumasang test ang task

    Inaayos ito ng agent, at muling pinapatakbo ng RADAR ang test. Pumasa ito, kaya nagsasara ang task, at iniingatan ng talaan ang patunay.

Bakit ito mahalaga

Maaaring magkamali ang mga agent kahit sigurado sila. Kapag walang pagsusuri, ang maling “tapos na” ay aabot sa produkto mo at sa mga customer mo. Sa RADAR, tapos ang isang task kapag sinabi ito ng patunay.

Larawan 2 · Ang parehong halimbawa, nang malapitan

Ang silid ng mapa

Bawat agent, bawat task, sa iisang screen.

Ito ang home screen ng RADAR. Ipinaliliwanag sa ibaba ang limang bahagi nito.

radar
sample na datos

radarsample na datos

Mag-scroll o mag-swipe para gumalaw sa screen.

I-tap ang isang numero para mag-zoom in.

Larawan 3 · Ang home screen, gamit ang sample na datos
  1. Kanang itaas: CHART

    Ang mapa

    Bawat isla ay isang computer: ang sa iyo, o isang server na pinapatakbo mo. Ang mga putol-putol na linya ay mga agent na nagtatrabaho rito. Ang makinang huminto sa pagsagot ay minamarkahang AGROUND at nananatili sa mapa.

  2. Kaliwa: LOG

    Ang talaan

    Binibilang ang bawat task ayon sa estado: naghihintay, ginagawa o naghihintay sa test nito. Iisang talaan ang gamit ng lahat ng agent, kaya walang nawawala sa pagitan nila.

  3. Kaliwang ibaba: NEXT

    Kailangan ka

    Ang mga desisyong kailangan ng tao lang ang umaabot sa iyo, kasama ang susunod na command na patatakbuhin. Tatlong subok ang isang agent, saka papalit ang ibang agent; pagkatapos ng tatlo pa, maghihintay rito sa iyo ang task.

  4. Kaliwang ibaba: ARRIVALS

    Sinuri, saka isinama

    Naisasama lang ang trabaho sa proyekto mo pagkatapos pumasa ang test nito, at pinapatakbo pa muli ang test pagkatapos itong maisama. Ipinapakita ng mga bar kung ilang task ang naisama kada oras.

  5. Kanang ibaba: COMMANDS

    Mga command at memory

    Pinapatakbo ang RADAR gamit ang isang maikling listahan ng mga command. Hinahanap ng isa sa mga ito ang memory: mga tala ng mga natutunan, na ipinapakita ng RADAR sa susunod na agent bago ito magsimula. Mabubuksan mo ang mga ito sa Obsidian.

Larawan 3 · Ang home screen, gamit ang sample na datos

Mula sa sariling trabaho ng Grit

Obserbasyon, hindi kontroladong paghahambing

Sa sariling trabaho ng Grit (Setyembre 20–28, 2026), iniulat ng mga worker na nagpapatakbo ng iisang coding agent na tapos na ang isang task nang 1,608 beses (1,457 task); sa agarang muling pagpapatakbo ng Grit sa mga acceptance command sa parehong server, bumagsak ang 74 sa mga ulat na iyon (4.6%). Hindi naisasara ng claim lang ang isang task.

Aling bilang ang ipapakita

1,608 ulat ang nagsabing tapos na, kaya bawat isa ay binibilang na tapos.Muling pinatakbo ang mga test: bumagsak ang 74 sa mga ulat na iyon.

Isang parisukat: isang ulat na tapos na ang isang task Bumagsak ang muling pagpapatakbo ng Grit

Internal ledger ng Grit, snapshot noong Setyembre 28, 2026, 06:00 UTC

Mga edisyon

Isang bukas na edisyon para sa mga indibidwal.
Isang edisyon para sa mga kumpanya na binubuo pa.

Open source (Apache-2.0) pagdating ng pampublikong release

RADAR

Para sa mga indibidwal na developer, sa sarili mong computer.

  • Ang talaan, ang mga test, ang memory, at mga agent na magkakatabing nagtatrabaho
  • Pinapatakbo ang Claude Code, Codex CLI, OMP at Hermes Agent
  • Kailangan ng Python 3.12 o mas bago; hindi kailangan ng account o cloud

Binubuo pa

RADAR para sa mga kumpanya

Para sa mga team, sa sarili ninyong infrastructure.

  • Tumatakbo sa sariling infrastructure ng inyong team, sa sarili ninyong code
  • Ise-set up at susuportahan ng Grit
  • Mga autonomous na sistemang binuo para sa inyong trabaho, sa ilalim ng iisang tuntunin: naisasara lang ang isang task kapag muling pumasa ang test nito
Available na ba ang RADAR ngayon?

Nasa early access ang RADAR. Para sumali, sumulat sa amin sa pahina ng contact, o sa X o Instagram. Kapag may access ka na, ibibigay mo sa iyong coding agent ang link ng repository at sasabihin mong “i-install ito”. May kasamang mga hakbang sa pag-install ang repository na isinulat para sa mga agent: sinusuri ng agent ang computer mo, nagtatanong muna sa iyo bago mag-install ng anumang kulang, sine-set up ang RADAR at nag-uulat pabalik.

Papalitan ba ng RADAR ang aking coding agent?

Hindi. Pinapatakbo ng RADAR ang mga agent na gamit mo na at sinusuri ang kanilang trabaho. Ang mga agent pa rin ang gumagawa ng trabaho. Binibigyan sila ng RADAR ng iisang talaan, iisang pagsusuring hindi nila malalaktawan, at iisang memory.

Ano ang itinuturing na tapos?

Tapos ang isang task kapag napatakbo na ng RADAR ang test nito sa pinakabagong bersyon ng trabaho at pumasa ang test. Itinatala bilang claim ang sariling “tapos na” ng agent; hindi isinasara ng RADAR ang task hangga't hindi pumapasa ang test. Maaari itong i-override ng isang tao, at itinatala ang override.

Aling mga agent ang pinapatakbo nito?

Claude Code, Codex CLI, OMP at Hermes Agent. Nagtatrabaho ang bawat isa sa sarili nitong kopya ng proyekto, sa computer mo o sa sarili mong mga Linux server.

Mas mahusay ba ang RADAR kaysa sa Claude Code o Codex?

Hindi ito pamalit sa kanila, kaya hindi ito nakikipagkumpitensya sa kanila. Pinapatakbo sila ng RADAR at sinusuri ang kanilang inihahatid.

Paano kung mali ang test mismo?

Kung gayon, mali rin ang pagsusuri. Kaya isinusulat ang test bago magsimula ang trabaho, kung saan mababasa ito ng isang tao, at itinatala ang anumang pagbabago rito pagkatapos.

Lumalabas ba sa computer ko ang code ko?

Hindi dahil sa RADAR. Hindi ito nangangailangan ng account o cloud, at opsyonal ang bawat panlabas na serbisyo at nakapatay hangga't hindi mo binubuksan. Nakikipag-usap pa rin ang mga agent mo sa sarili nilang mga provider, gaya ng ginagawa nila ngayon.

Magkano ang gastos para patakbuhin ito?

Walang sariling bayarin ang RADAR. Patuloy na ginagamit ng mga agent na pinapatakbo nito ang mga account na ginamit mo para mag-sign in sa kanila, gaya ng isang Claude o ChatGPT plan, sa ilalim ng mga tuntunin at usage limit ng mga provider na iyon. Gumagamit lang ang RADAR ng bayad na API kung papangalanan mo ang provider at ang budget.

Ang mga agent mo ang sumusulat ng code. Tinitiyak ng RADAR na tapos na talaga ito.