RADAR de Grit En acceso anticipado

Los agentes dicen que está hecho.
RADAR lo comprueba.

RADAR ejecuta agentes de programación con IA, como Claude Code y Codex. Cada tarea recibe una prueba antes de que empiece el trabajo; la tarea se da por terminada solo cuando RADAR ejecuta esa prueba por sí mismo y esta pasa.

  1. Le das a RADAR una tarea y su prueba. La prueba se escribe antes de que empiece el trabajo.
  2. Un agente hace el trabajo. En su propia copia del proyecto.
  3. El agente dice que ha terminado. RADAR lo anota como una declaración, no como un resultado.
  4. RADAR ejecuta la prueba por sí mismo. Falla. La tarea se vuelve a abrir, con el fallo adjunto.
  5. El agente lo corrige. RADAR vuelve a ejecutar la prueba. Pasa.
  6. La tarea se cierra. Su evidencia se guarda.
radar app
sesión de ejemplo

radar appsesión de ejemplo

Desplázate o desliza para moverte por la pantalla.

radar app
ejemplo

Fig. 1 · Una sesión de ejemplo, con datos de muestra

Ejecuta los agentes que ya usas

  • Claude Code
  • Codex CLI
  • OMP
  • Hermes Agent

Funciona con

  • Claude
  • ChatGPT
  • Git
  • Python
  • Obsidian
  • Windows
  • Linux
¿RADAR sustituye a mi agente?

En pocas palabras

Qué hace RADAR, con un solo ejemplo.

Un agente de IA es un programa que escribe y cambia software por ti. Trabaja rápido y dice cuándo ha terminado. RADAR comprueba si de verdad lo ha hecho.

Agente de IA
Un programa que hace trabajo de software por sí solo, como corregir un error. Claude Code y Codex CLI son dos ejemplos.
La prueba
Una comprobación pequeña y exacta que demuestra que el trabajo está bien, escrita antes de que empiece el trabajo. Los ingenieros la llaman prueba de aceptación.
El registro
Donde se anota cada tarea: quién la tomó, qué declaró y qué mostró la prueba. RADAR lo llama libro mayor (ledger).
  1. Primero se escribe la prueba

    Antes de que nadie empiece, la tarea recibe su prueba: una contraseña incorrecta debe rechazarse y la correcta debe dejarte entrar.

  2. Un agente hace el trabajo

    RADAR entrega la tarea a un agente de IA. El agente trabaja en su propia copia del proyecto, así que no se toca nada más.

  3. El agente dice que ha terminado

    El agente informa: «hecho». RADAR lo anota como una declaración, no como un resultado.

  4. RADAR ejecuta la prueba por sí mismo

    RADAR ejecuta la prueba por su cuenta, sobre la última versión del trabajo, sin fiarse de la palabra del agente.

  5. Si falla, la tarea se vuelve a abrir

    Aquí una contraseña incorrecta todavía te deja entrar. La tarea se vuelve a abrir con el fallo adjunto, y el agente lo intenta de nuevo. Tras tres intentos, otro agente toma el relevo; tras tres más, la tarea te espera.

  6. Una prueba superada cierra la tarea

    El agente lo corrige y RADAR vuelve a ejecutar la prueba. Pasa, así que la tarea se cierra y el registro guarda la evidencia.

Por qué importa

Los agentes pueden equivocarse con total seguridad. Sin una comprobación, un «hecho» equivocado llega a tu producto y a tus clientes. Con RADAR, una tarea está terminada cuando la evidencia lo dice.

Fig. 2 · El mismo ejemplo, de cerca

La sala de mapas

Cada agente y cada tarea, en una sola pantalla.

Esta es la pantalla principal de RADAR. Abajo se explican cinco de sus partes.

radar
datos de muestra

radardatos de muestra

Desplázate o desliza para moverte por la pantalla.

Toca un número para acercar.

Fig. 3 · La pantalla principal, con datos de muestra
  1. Arriba a la derecha: CHART

    El mapa

    Cada isla es un ordenador: el tuyo o un servidor que administras. Las líneas discontinuas son los agentes que trabajan en él. Una máquina que deja de responder se marca como AGROUND y sigue en el mapa.

  2. Izquierda: LOG

    El registro

    Cada tarea se cuenta por estado: en espera, en curso o esperando su prueba. Todos los agentes comparten un único registro, así que nada se pierde entre ellos.

  3. Abajo a la izquierda: NEXT

    Pendiente de ti

    Solo te llegan las decisiones que necesitan a una persona, con el siguiente comando que hay que ejecutar. Un agente tiene tres intentos y después otro agente toma el relevo; tras tres intentos más, la tarea te espera aquí.

  4. Abajo a la izquierda: ARRIVALS

    Comprobado y después integrado

    El trabajo solo se incorpora a tu proyecto después de que pase su prueba, y la prueba se ejecuta una vez más después de incorporarlo. Las barras muestran cuántas tareas se incorporaron cada hora.

  5. Abajo a la derecha: COMMANDS

    Comandos y memoria

    RADAR se maneja con una lista corta de comandos. Uno de ellos busca en la memoria: notas de lecciones aprendidas que RADAR muestra al siguiente agente antes de que empiece. Puedes abrirlas en Obsidian.

Fig. 3 · La pantalla principal, con datos de muestra

Del propio trabajo de Grit

Observado, no es una comparación controlada

En el propio trabajo de Grit (del 20 al 28 de septiembre de 2026), los procesos de trabajo que ejecutaban un mismo agente de programación informaron 1608 veces de que una tarea estaba terminada (1457 tareas); cuando Grit volvió a ejecutar de inmediato los comandos de aceptación en el mismo servidor, fallaron en 74 de esos informes (4,6 %). Una declaración por sí sola no cierra una tarea.

Qué recuento mostrar

1608 informes decían «terminado», así que cada uno cuenta como hecho.Las pruebas se volvieron a ejecutar: fallaron en 74 de esos informes.

Un cuadrado: un informe de que una tarea estaba terminada La nueva ejecución de Grit falló

Registro interno de Grit, captura del 28 de septiembre de 2026 a las 06:00 UTC

Ediciones

Una edición abierta para particulares.
Una edición para empresas, en desarrollo.

Código abierto (Apache-2.0) en su lanzamiento público

RADAR

Para desarrolladores individuales, en tu propio ordenador.

  • El registro, las pruebas, la memoria y agentes trabajando en paralelo
  • Ejecuta Claude Code, Codex CLI, OMP y Hermes Agent
  • Python 3.12 o posterior; no hace falta cuenta ni nube

En desarrollo

RADAR para empresas

Para equipos, en tu propia infraestructura.

  • Se ejecuta en la infraestructura de tu propio equipo, sobre tu propio código
  • Grit lo instala y le da soporte
  • Sistemas autónomos creados para tu trabajo, con la misma regla: una tarea solo se cierra cuando su prueba vuelve a pasar
¿RADAR está disponible hoy?

RADAR está en acceso anticipado. Para unirte, escríbenos a través de la página de contacto o por X o Instagram. Cuando tengas acceso, le das a tu agente de programación el enlace del repositorio y le dices «instala esto». El repositorio incluye pasos de instalación escritos para agentes: el agente revisa tu ordenador, pregunta antes de instalar cualquier cosa que falte, configura RADAR y te informa del resultado.

¿RADAR sustituye a mi agente de programación?

No. RADAR ejecuta los agentes que ya usas y comprueba su trabajo. Los agentes siguen haciendo el trabajo. RADAR les da un único registro, una comprobación que no pueden saltarse y una única memoria.

¿Qué cuenta como terminado?

Una tarea está terminada cuando RADAR ha ejecutado su prueba sobre la última versión del trabajo y la prueba ha pasado. El «hecho» del propio agente se anota como una declaración; RADAR no cierra la tarea hasta que la prueba pasa. Una persona puede anular esa decisión, y la anulación queda registrada.

¿Qué agentes ejecuta?

Claude Code, Codex CLI, OMP y Hermes Agent. Cada uno trabaja en su propia copia del proyecto, en tu ordenador o en tus propios servidores Linux.

¿RADAR es mejor que Claude Code o Codex?

No los sustituye, así que no compite con ellos. RADAR los ejecuta y comprueba lo que entregan.

¿Y si la propia prueba está mal?

Entonces la comprobación también es incorrecta. Por eso la prueba se escribe antes de que empiece el trabajo, donde una persona puede leerla, y cualquier cambio posterior queda registrado.

¿Mi código sale de mi ordenador?

No por culpa de RADAR. No necesita cuenta ni nube, y todos los servicios externos son opcionales y están desactivados hasta que los activas. Tus agentes siguen comunicándose con sus propios proveedores, como hacen hoy.

¿Cuánto cuesta usarlo?

RADAR no añade ninguna factura propia. Los agentes que ejecuta siguen usando las cuentas con las que inicias sesión en ellos, como un plan de Claude o ChatGPT, según las condiciones y los límites de uso de esos proveedores. RADAR solo usa una API de pago si indicas el proveedor y un presupuesto.

Tus agentes escriben el código. RADAR se asegura de que esté terminado de verdad.