RADAR da Grit Em acesso antecipado

Os agentes dizem que terminaram.
O RADAR verifica.

O RADAR executa agentes de programação com IA, como Claude Code e Codex. Cada tarefa recebe um teste antes de o trabalho começar; a tarefa só é considerada concluída quando o próprio RADAR executa esse teste e ele passa.

  1. Você dá ao RADAR uma tarefa e o teste dela. O teste é escrito antes de qualquer trabalho começar.
  2. Um agente faz o trabalho. Em sua própria cópia do projeto.
  3. O agente diz que terminou. O RADAR registra isso como uma declaração, não como um resultado.
  4. O próprio RADAR executa o teste. O teste falha. A tarefa é reaberta, com a falha anexada.
  5. O agente corrige. O RADAR executa o teste de novo. O teste passa.
  6. A tarefa é fechada. A prova dela é guardada.
radar app
sessão de exemplo

radar appsessão de exemplo

Role ou deslize para se mover pela tela.

radar app
exemplo

Fig. 1 · Uma sessão de exemplo, com dados de amostra

Executa os agentes que você já usa

  • Claude Code
  • Codex CLI
  • OMP
  • Hermes Agent

Funciona com

  • Claude
  • ChatGPT
  • Git
  • Python
  • Obsidian
  • Windows
  • Linux
O RADAR substitui o meu agente?

Em poucas palavras

O que o RADAR faz, com um único exemplo.

Um agente de IA é um programa que escreve e altera software para você. Ele trabalha rápido e avisa quando terminou. O RADAR verifica se ele terminou de verdade.

Agente de IA
Um programa que faz sozinho trabalho de software, como corrigir um erro. Claude Code e Codex CLI são dois exemplos.
O teste
Uma verificação pequena e exata que prova que o trabalho está certo, escrita antes de o trabalho começar. Os engenheiros chamam isso de teste de aceitação.
O registro
Onde cada tarefa é anotada: quem a assumiu, o que declarou e o que o teste mostrou. O RADAR chama isso de livro-razão (ledger).
  1. O teste é escrito primeiro

    Antes que alguém comece, a tarefa recebe seu teste: uma senha errada deve ser recusada, e a certa deve deixar você entrar.

  2. Um agente faz o trabalho

    O RADAR entrega a tarefa a um agente de IA. O agente trabalha em sua própria cópia do projeto, e assim nada mais é afetado.

  3. O agente diz que terminou

    O agente informa: “pronto”. O RADAR registra isso como uma declaração, não como um resultado.

  4. O próprio RADAR executa o teste

    O RADAR executa o teste por conta própria, na versão mais recente do trabalho, sem confiar na palavra do agente.

  5. Se falhar, a tarefa é reaberta

    Aqui, uma senha errada ainda deixa você entrar. A tarefa é reaberta com a falha anexada, e o agente tenta de novo. Após três tentativas, outro agente assume; após mais três, a tarefa espera por você.

  6. Um teste aprovado fecha a tarefa

    O agente corrige, e o RADAR executa o teste de novo. O teste passa, então a tarefa é fechada e o registro guarda a prova.

Por que isso importa

Agentes podem errar com toda a confiança. Sem uma verificação, um “pronto” errado chega ao seu produto e aos seus clientes. Com o RADAR, uma tarefa está concluída quando a prova diz que está.

Fig. 2 · O mesmo exemplo, de perto

A sala de mapas

Todos os agentes, todas as tarefas, em uma só tela.

Esta é a tela inicial do RADAR. Cinco de suas partes são explicadas abaixo.

radar
dados de exemplo

radardados de exemplo

Role ou deslize para se mover pela tela.

Toque em um número para ampliar.

Fig. 3 · A tela inicial, com dados de amostra
  1. Canto superior direito: CHART

    O mapa

    Cada ilha é um computador: o seu ou um servidor que você administra. As linhas tracejadas são os agentes que trabalham nele. Uma máquina que para de responder é marcada como AGROUND e continua no mapa.

  2. Esquerda: LOG

    O registro

    Cada tarefa é contada por estado: aguardando, em andamento ou aguardando o teste. Todos os agentes compartilham um único registro, então nada se perde entre eles.

  3. Canto inferior esquerdo: NEXT

    Precisa de você

    Só chegam até você as decisões que precisam de uma pessoa, com o próximo comando a executar. Um agente tem três tentativas e, depois, outro agente assume; após mais três, a tarefa espera por você aqui.

  4. Canto inferior esquerdo: ARRIVALS

    Verificado, depois integrado

    O trabalho só entra no seu projeto depois que o teste passa, e o teste roda mais uma vez depois que ele entra. As barras mostram quantas tarefas entraram a cada hora.

  5. Canto inferior direito: COMMANDS

    Comandos e memória

    O RADAR é operado por uma lista curta de comandos. Um deles pesquisa a memória: notas das lições aprendidas, que o RADAR mostra ao próximo agente antes de ele começar. Você pode abri-las no Obsidian.

Fig. 3 · A tela inicial, com dados de amostra

Do próprio trabalho da Grit

Observado, não é uma comparação controlada

No próprio trabalho da Grit (de 20 a 28 de setembro de 2026), os processos de trabalho que executavam um mesmo agente de programação informaram 1.608 vezes que uma tarefa estava concluída (1.457 tarefas); quando a Grit executou de novo, imediatamente, os comandos de aceitação no mesmo servidor, eles falharam em 74 desses relatos (4,6%). Uma declaração sozinha não fecha uma tarefa.

Qual contagem mostrar

1.608 relatos diziam “concluído”, então cada um conta como terminado.Os testes foram executados de novo: falharam em 74 desses relatos.

Um quadrado: um relato de que uma tarefa estava concluída A nova execução da Grit falhou

Registro interno da Grit, instantâneo de 28 de setembro de 2026, 06:00 UTC

Edições

Uma edição aberta para uso individual.
Uma edição para empresas em desenvolvimento.

Código aberto (Apache-2.0) no lançamento público

RADAR

Para desenvolvedores individuais, no seu próprio computador.

  • O registro, os testes, a memória e agentes trabalhando lado a lado
  • Executa Claude Code, Codex CLI, OMP e Hermes Agent
  • Python 3.12 ou mais recente; não precisa de conta nem de nuvem

Em desenvolvimento

RADAR para empresas

Para equipes, na sua própria infraestrutura.

  • Roda na infraestrutura da sua própria equipe, sobre o seu próprio código
  • Implantado e com suporte da Grit
  • Sistemas autônomos construídos para o seu trabalho, com a mesma regra: uma tarefa só é fechada quando o teste dela passa de novo
O RADAR já está disponível?

O RADAR está em acesso antecipado. Para participar, escreva para nós pela página de contato, no X ou no Instagram. Quando tiver acesso, você dá ao seu agente de programação o link do repositório e diz “instale isto”. O repositório traz passos de instalação escritos para agentes: o agente verifica o seu computador, pergunta antes de instalar qualquer coisa que esteja faltando, configura o RADAR e informa o resultado.

O RADAR substitui o meu agente de programação?

Não. O RADAR executa os agentes que você já usa e verifica o trabalho deles. Os agentes continuam fazendo o trabalho. O RADAR dá a eles um único registro, uma verificação que eles não podem pular e uma única memória.

O que conta como concluído?

Uma tarefa está concluída quando o RADAR executou o teste dela na versão mais recente do trabalho e o teste passou. O “pronto” do próprio agente é registrado como uma declaração; o RADAR não fecha a tarefa até que o teste passe. Uma pessoa pode passar por cima disso, e essa decisão fica registrada.

Quais agentes ele executa?

Claude Code, Codex CLI, OMP e Hermes Agent. Cada um trabalha em sua própria cópia do projeto, no seu computador ou em servidores Linux seus.

O RADAR é melhor que o Claude Code ou o Codex?

Ele não os substitui, então não compete com eles. O RADAR os executa e verifica o que entregam.

E se o próprio teste estiver errado?

Então a verificação também está errada. Por isso o teste é escrito antes de o trabalho começar, onde uma pessoa pode lê-lo, e qualquer alteração posterior fica registrada.

Meu código sai do meu computador?

Não por causa do RADAR. Ele não precisa de conta nem de nuvem, e todo serviço externo é opcional e fica desligado até você ligá-lo. Seus agentes continuam se comunicando com os próprios provedores, como já fazem hoje.

Quanto custa para usar?

O RADAR não gera nenhuma cobrança própria. Os agentes que ele executa continuam usando as contas que você usa para entrar neles, como um plano do Claude ou do ChatGPT, conforme os termos e os limites de uso desses provedores. O RADAR só usa uma API paga se você indicar o provedor e um orçamento.

Seus agentes escrevem o código. O RADAR garante que esteja pronto de verdade.