Os agentes dizem que terminaram. O RADAR verifica.
O RADAR executa agentes de programação com IA, como Claude Code e Codex. Cada tarefa recebe um teste antes de o trabalho começar; a tarefa só é considerada concluída quando o próprio RADAR executa esse teste e ele passa.
Um agente de IA é um programa que escreve e altera software para você. Ele trabalha rápido e avisa quando terminou. O RADAR verifica se ele terminou de verdade.
Agente de IA
Um programa que faz sozinho trabalho de software, como corrigir um erro. Claude Code e Codex CLI são dois exemplos.
O teste
Uma verificação pequena e exata que prova que o trabalho está certo, escrita antes de o trabalho começar. Os engenheiros chamam isso de teste de aceitação.
O registro
Onde cada tarefa é anotada: quem a assumiu, o que declarou e o que o teste mostrou. O RADAR chama isso de livro-razão (ledger).
1
O teste é escrito primeiro
Antes que alguém comece, a tarefa recebe seu teste: uma senha errada deve ser recusada, e a certa deve deixar você entrar.
radar app · t-4821example
○youthe login accepts a wrong password; fix it
◆radartaskt-4821created
┊the test, written before any work:
┊
testwritten before the worknot run yet
…a wrong password→refused
…the right password→signed in
┊the working agent cannot change the test command
2
Um agente faz o trabalho
O RADAR entrega a tarefa a um agente de IA. O agente trabalha em sua própria cópia do projeto, e assim nada mais é afetado.
radar app · t-4821example
○youthe login accepts a wrong password; fix it
◆radartaskt-4821created·test written first
◇agentWorking in my own copy of the project.
·▸ Read login_app/auth.py13 lines
·▸ Grep wrong_password in tests/1 match
·▸ Edit login_app/auth.py+1 −1
┊leaseclaimed attempt1/3
3
O agente diz que terminou
O agente informa: “pronto”. O RADAR registra isso como uma declaração, não como um resultado.
radar app · t-4821example
◇agentWorking in my own copy of the project.
·▸ Read login_app/auth.py13 lines
·▸ Grep wrong_password in tests/1 match
·▸ Edit login_app/auth.py+1 −1
◇agentdone:wrong passwords are refused now
┊radar:claim, not result·it runs the test itself
4
O próprio RADAR executa o teste
O RADAR executa o teste por conta própria, na versão mais recente do trabalho, sem confiar na palavra do agente.
radar app · t-4821example
◇agentdone:wrong passwords are refused now
┊radar:claim, not result·it runs the test itself
◆radarverifyt-4821·running the test itselfunder way
┊
testrun by radarrunning
a wrong password→…
the right password→…
5
Se falhar, a tarefa é reaberta
Aqui, uma senha errada ainda deixa você entrar. A tarefa é reaberta com a falha anexada, e o agente tenta de novo. Após três tentativas, outro agente assume; após mais três, a tarefa espera por você.
radar app · t-4821example
◇agentdone:wrong passwords are refused now
◆radarverifyt-4821·1 failedexit 1
┊
testrun by radar1 failed · exit 1
a wrong password→signed inshould be refused
the right password→signed in
┊check_login("ada", "wrong password") returned True
┊t-4821reopened· failure attached · attempt 2/3
6
Um teste aprovado fecha a tarefa
O agente corrige, e o RADAR executa o teste de novo. O teste passa, então a tarefa é fechada e o registro guarda a prova.
radar app · t-4821example
◇agentThe length check was not the bug: nothing compared the password with the stored hash.
·▸ Edit login_app/auth.py+2 −1
◆radarverifyt-4821·passed·judged by radar2 passed
┊
testrun by radar2 passed
a wrong password→refused
the right password→signed in
■t-4821closed·proof kept in the ledger
Por que isso importa
Agentes podem errar com toda a confiança. Sem uma verificação, um “pronto” errado chega ao seu produto e aos seus clientes. Com o RADAR, uma tarefa está concluída quando a prova diz que está.
radar app · t-4821example
○youthe login accepts a wrong password; fix it
◆radartaskt-4821created
┊the test, written before any work:
┊
testwritten before the worknot run yet
…a wrong password→refused
…the right password→signed in
┊the working agent cannot change the test command
○youthe login accepts a wrong password; fix it
◆radartaskt-4821created·test written first
◇agentWorking in my own copy of the project.
·▸ Read login_app/auth.py13 lines
·▸ Grep wrong_password in tests/1 match
·▸ Edit login_app/auth.py+1 −1
┊leaseclaimed attempt1/3
◇agentWorking in my own copy of the project.
·▸ Read login_app/auth.py13 lines
·▸ Grep wrong_password in tests/1 match
·▸ Edit login_app/auth.py+1 −1
◇agentdone:wrong passwords are refused now
┊radar:claim, not result·it runs the test itself
◇agentdone:wrong passwords are refused now
┊radar:claim, not result·it runs the test itself
◆radarverifyt-4821·running the test itselfunder way
┊
testrun by radarrunning
a wrong password→…
the right password→…
◇agentdone:wrong passwords are refused now
◆radarverifyt-4821·1 failedexit 1
┊
testrun by radar1 failed · exit 1
a wrong password→signed inshould be refused
the right password→signed in
┊check_login("ada", "wrong password") returned True
┊t-4821reopened· failure attached · attempt 2/3
◇agentThe length check was not the bug: nothing compared the password with the stored hash.
·▸ Edit login_app/auth.py+2 −1
◆radarverifyt-4821·passed·judged by radar2 passed
┊
testrun by radar2 passed
a wrong password→refused
the right password→signed in
■t-4821closed·proof kept in the ledger
Fig. 2 · O mesmo exemplo, de perto
A sala de mapas
Todos os agentes, todas as tarefas, em uma só tela.
Esta é a tela inicial do RADAR. Cinco de suas partes são explicadas abaixo.
radardados de exemplo120x36
1Toque em um número para ampliar.
Fig. 3 · A tela inicial, com dados de amostra
01
Canto superior direito: CHART
O mapa
Cada ilha é um computador: o seu ou um servidor que você administra. As linhas tracejadas são os agentes que trabalham nele. Uma máquina que para de responder é marcada como AGROUND e continua no mapa.
02
Esquerda: LOG
O registro
Cada tarefa é contada por estado: aguardando, em andamento ou aguardando o teste. Todos os agentes compartilham um único registro, então nada se perde entre eles.
03
Canto inferior esquerdo: NEXT
Precisa de você
Só chegam até você as decisões que precisam de uma pessoa, com o próximo comando a executar. Um agente tem três tentativas e, depois, outro agente assume; após mais três, a tarefa espera por você aqui.
04
Canto inferior esquerdo: ARRIVALS
Verificado, depois integrado
O trabalho só entra no seu projeto depois que o teste passa, e o teste roda mais uma vez depois que ele entra. As barras mostram quantas tarefas entraram a cada hora.
05
Canto inferior direito: COMMANDS
Comandos e memória
O RADAR é operado por uma lista curta de comandos. Um deles pesquisa a memória: notas das lições aprendidas, que o RADAR mostra ao próximo agente antes de ele começar. Você pode abri-las no Obsidian.
Do próprio trabalho da Grit
Observado, não é uma comparação controlada
No próprio trabalho da Grit (de 20 a 28 de setembro de 2026), os processos de trabalho que executavam um mesmo agente de programação informaram 1.608 vezes que uma tarefa estava concluída (1.457 tarefas); quando a Grit executou de novo, imediatamente, os comandos de aceitação no mesmo servidor, eles falharam em 74 desses relatos (4,6%). Uma declaração sozinha não fecha uma tarefa.
1.608 relatos diziam “concluído”, então cada um conta como terminado.Os testes foram executados de novo: falharam em 74 desses relatos.
Um quadrado: um relato de que uma tarefa estava concluídaA nova execução da Grit falhou
Registro interno da Grit, instantâneo de 28 de setembro de 2026, 06:00 UTC
Edições
Uma edição aberta para uso individual. Uma edição para empresas em desenvolvimento.
Código aberto (Apache-2.0) no lançamento público
RADAR
Para desenvolvedores individuais, no seu próprio computador.
O registro, os testes, a memória e agentes trabalhando lado a lado
Executa Claude Code, Codex CLI, OMP e Hermes Agent
Python 3.12 ou mais recente; não precisa de conta nem de nuvem
O RADAR está em acesso antecipado. Para participar, escreva para nós pela página de contato, no X ou no Instagram. Quando tiver acesso, você dá ao seu agente de programação o link do repositório e diz “instale isto”. O repositório traz passos de instalação escritos para agentes: o agente verifica o seu computador, pergunta antes de instalar qualquer coisa que esteja faltando, configura o RADAR e informa o resultado.
O RADAR substitui o meu agente de programação?
Não. O RADAR executa os agentes que você já usa e verifica o trabalho deles. Os agentes continuam fazendo o trabalho. O RADAR dá a eles um único registro, uma verificação que eles não podem pular e uma única memória.
O que conta como concluído?
Uma tarefa está concluída quando o RADAR executou o teste dela na versão mais recente do trabalho e o teste passou. O “pronto” do próprio agente é registrado como uma declaração; o RADAR não fecha a tarefa até que o teste passe. Uma pessoa pode passar por cima disso, e essa decisão fica registrada.
Quais agentes ele executa?
Claude Code, Codex CLI, OMP e Hermes Agent. Cada um trabalha em sua própria cópia do projeto, no seu computador ou em servidores Linux seus.
O RADAR é melhor que o Claude Code ou o Codex?
Ele não os substitui, então não compete com eles. O RADAR os executa e verifica o que entregam.
E se o próprio teste estiver errado?
Então a verificação também está errada. Por isso o teste é escrito antes de o trabalho começar, onde uma pessoa pode lê-lo, e qualquer alteração posterior fica registrada.
Meu código sai do meu computador?
Não por causa do RADAR. Ele não precisa de conta nem de nuvem, e todo serviço externo é opcional e fica desligado até você ligá-lo. Seus agentes continuam se comunicando com os próprios provedores, como já fazem hoje.
Quanto custa para usar?
O RADAR não gera nenhuma cobrança própria. Os agentes que ele executa continuam usando as contas que você usa para entrar neles, como um plano do Claude ou do ChatGPT, conforme os termos e os limites de uso desses provedores. O RADAR só usa uma API paga se você indicar o provedor e um orçamento.
Seus agentes escrevem o código. O RADAR garante que esteja pronto de verdade.