Los agentes dicen que está hecho. RADAR lo comprueba.
RADAR ejecuta agentes de programación con IA, como Claude Code y Codex. Cada tarea recibe una prueba antes de que empiece el trabajo; la tarea se da por terminada solo cuando RADAR ejecuta esa prueba por sí mismo y esta pasa.
Un agente de IA es un programa que escribe y cambia software por ti. Trabaja rápido y dice cuándo ha terminado. RADAR comprueba si de verdad lo ha hecho.
Agente de IA
Un programa que hace trabajo de software por sí solo, como corregir un error. Claude Code y Codex CLI son dos ejemplos.
La prueba
Una comprobación pequeña y exacta que demuestra que el trabajo está bien, escrita antes de que empiece el trabajo. Los ingenieros la llaman prueba de aceptación.
El registro
Donde se anota cada tarea: quién la tomó, qué declaró y qué mostró la prueba. RADAR lo llama libro mayor (ledger).
1
Primero se escribe la prueba
Antes de que nadie empiece, la tarea recibe su prueba: una contraseña incorrecta debe rechazarse y la correcta debe dejarte entrar.
radar app · t-4821example
○youthe login accepts a wrong password; fix it
◆radartaskt-4821created
┊the test, written before any work:
┊
testwritten before the worknot run yet
…a wrong password→refused
…the right password→signed in
┊the working agent cannot change the test command
2
Un agente hace el trabajo
RADAR entrega la tarea a un agente de IA. El agente trabaja en su propia copia del proyecto, así que no se toca nada más.
radar app · t-4821example
○youthe login accepts a wrong password; fix it
◆radartaskt-4821created·test written first
◇agentWorking in my own copy of the project.
·▸ Read login_app/auth.py13 lines
·▸ Grep wrong_password in tests/1 match
·▸ Edit login_app/auth.py+1 −1
┊leaseclaimed attempt1/3
3
El agente dice que ha terminado
El agente informa: «hecho». RADAR lo anota como una declaración, no como un resultado.
radar app · t-4821example
◇agentWorking in my own copy of the project.
·▸ Read login_app/auth.py13 lines
·▸ Grep wrong_password in tests/1 match
·▸ Edit login_app/auth.py+1 −1
◇agentdone:wrong passwords are refused now
┊radar:claim, not result·it runs the test itself
4
RADAR ejecuta la prueba por sí mismo
RADAR ejecuta la prueba por su cuenta, sobre la última versión del trabajo, sin fiarse de la palabra del agente.
radar app · t-4821example
◇agentdone:wrong passwords are refused now
┊radar:claim, not result·it runs the test itself
◆radarverifyt-4821·running the test itselfunder way
┊
testrun by radarrunning
a wrong password→…
the right password→…
5
Si falla, la tarea se vuelve a abrir
Aquí una contraseña incorrecta todavía te deja entrar. La tarea se vuelve a abrir con el fallo adjunto, y el agente lo intenta de nuevo. Tras tres intentos, otro agente toma el relevo; tras tres más, la tarea te espera.
radar app · t-4821example
◇agentdone:wrong passwords are refused now
◆radarverifyt-4821·1 failedexit 1
┊
testrun by radar1 failed · exit 1
a wrong password→signed inshould be refused
the right password→signed in
┊check_login("ada", "wrong password") returned True
┊t-4821reopened· failure attached · attempt 2/3
6
Una prueba superada cierra la tarea
El agente lo corrige y RADAR vuelve a ejecutar la prueba. Pasa, así que la tarea se cierra y el registro guarda la evidencia.
radar app · t-4821example
◇agentThe length check was not the bug: nothing compared the password with the stored hash.
·▸ Edit login_app/auth.py+2 −1
◆radarverifyt-4821·passed·judged by radar2 passed
┊
testrun by radar2 passed
a wrong password→refused
the right password→signed in
■t-4821closed·proof kept in the ledger
Por qué importa
Los agentes pueden equivocarse con total seguridad. Sin una comprobación, un «hecho» equivocado llega a tu producto y a tus clientes. Con RADAR, una tarea está terminada cuando la evidencia lo dice.
radar app · t-4821example
○youthe login accepts a wrong password; fix it
◆radartaskt-4821created
┊the test, written before any work:
┊
testwritten before the worknot run yet
…a wrong password→refused
…the right password→signed in
┊the working agent cannot change the test command
○youthe login accepts a wrong password; fix it
◆radartaskt-4821created·test written first
◇agentWorking in my own copy of the project.
·▸ Read login_app/auth.py13 lines
·▸ Grep wrong_password in tests/1 match
·▸ Edit login_app/auth.py+1 −1
┊leaseclaimed attempt1/3
◇agentWorking in my own copy of the project.
·▸ Read login_app/auth.py13 lines
·▸ Grep wrong_password in tests/1 match
·▸ Edit login_app/auth.py+1 −1
◇agentdone:wrong passwords are refused now
┊radar:claim, not result·it runs the test itself
◇agentdone:wrong passwords are refused now
┊radar:claim, not result·it runs the test itself
◆radarverifyt-4821·running the test itselfunder way
┊
testrun by radarrunning
a wrong password→…
the right password→…
◇agentdone:wrong passwords are refused now
◆radarverifyt-4821·1 failedexit 1
┊
testrun by radar1 failed · exit 1
a wrong password→signed inshould be refused
the right password→signed in
┊check_login("ada", "wrong password") returned True
┊t-4821reopened· failure attached · attempt 2/3
◇agentThe length check was not the bug: nothing compared the password with the stored hash.
·▸ Edit login_app/auth.py+2 −1
◆radarverifyt-4821·passed·judged by radar2 passed
┊
testrun by radar2 passed
a wrong password→refused
the right password→signed in
■t-4821closed·proof kept in the ledger
Fig. 2 · El mismo ejemplo, de cerca
La sala de mapas
Cada agente y cada tarea, en una sola pantalla.
Esta es la pantalla principal de RADAR. Abajo se explican cinco de sus partes.
radardatos de muestra120x36
1Toca un número para acercar.
Fig. 3 · La pantalla principal, con datos de muestra
01
Arriba a la derecha: CHART
El mapa
Cada isla es un ordenador: el tuyo o un servidor que administras. Las líneas discontinuas son los agentes que trabajan en él. Una máquina que deja de responder se marca como AGROUND y sigue en el mapa.
02
Izquierda: LOG
El registro
Cada tarea se cuenta por estado: en espera, en curso o esperando su prueba. Todos los agentes comparten un único registro, así que nada se pierde entre ellos.
03
Abajo a la izquierda: NEXT
Pendiente de ti
Solo te llegan las decisiones que necesitan a una persona, con el siguiente comando que hay que ejecutar. Un agente tiene tres intentos y después otro agente toma el relevo; tras tres intentos más, la tarea te espera aquí.
04
Abajo a la izquierda: ARRIVALS
Comprobado y después integrado
El trabajo solo se incorpora a tu proyecto después de que pase su prueba, y la prueba se ejecuta una vez más después de incorporarlo. Las barras muestran cuántas tareas se incorporaron cada hora.
05
Abajo a la derecha: COMMANDS
Comandos y memoria
RADAR se maneja con una lista corta de comandos. Uno de ellos busca en la memoria: notas de lecciones aprendidas que RADAR muestra al siguiente agente antes de que empiece. Puedes abrirlas en Obsidian.
Del propio trabajo de Grit
Observado, no es una comparación controlada
En el propio trabajo de Grit (del 20 al 28 de septiembre de 2026), los procesos de trabajo que ejecutaban un mismo agente de programación informaron 1608 veces de que una tarea estaba terminada (1457 tareas); cuando Grit volvió a ejecutar de inmediato los comandos de aceptación en el mismo servidor, fallaron en 74 de esos informes (4,6 %). Una declaración por sí sola no cierra una tarea.
1608 informes decían «terminado», así que cada uno cuenta como hecho.Las pruebas se volvieron a ejecutar: fallaron en 74 de esos informes.
Un cuadrado: un informe de que una tarea estaba terminadaLa nueva ejecución de Grit falló
Registro interno de Grit, captura del 28 de septiembre de 2026 a las 06:00 UTC
Ediciones
Una edición abierta para particulares. Una edición para empresas, en desarrollo.
Código abierto (Apache-2.0) en su lanzamiento público
RADAR
Para desarrolladores individuales, en tu propio ordenador.
El registro, las pruebas, la memoria y agentes trabajando en paralelo
Ejecuta Claude Code, Codex CLI, OMP y Hermes Agent
Python 3.12 o posterior; no hace falta cuenta ni nube
RADAR está en acceso anticipado. Para unirte, escríbenos a través de la página de contacto o por X o Instagram. Cuando tengas acceso, le das a tu agente de programación el enlace del repositorio y le dices «instala esto». El repositorio incluye pasos de instalación escritos para agentes: el agente revisa tu ordenador, pregunta antes de instalar cualquier cosa que falte, configura RADAR y te informa del resultado.
¿RADAR sustituye a mi agente de programación?
No. RADAR ejecuta los agentes que ya usas y comprueba su trabajo. Los agentes siguen haciendo el trabajo. RADAR les da un único registro, una comprobación que no pueden saltarse y una única memoria.
¿Qué cuenta como terminado?
Una tarea está terminada cuando RADAR ha ejecutado su prueba sobre la última versión del trabajo y la prueba ha pasado. El «hecho» del propio agente se anota como una declaración; RADAR no cierra la tarea hasta que la prueba pasa. Una persona puede anular esa decisión, y la anulación queda registrada.
¿Qué agentes ejecuta?
Claude Code, Codex CLI, OMP y Hermes Agent. Cada uno trabaja en su propia copia del proyecto, en tu ordenador o en tus propios servidores Linux.
¿RADAR es mejor que Claude Code o Codex?
No los sustituye, así que no compite con ellos. RADAR los ejecuta y comprueba lo que entregan.
¿Y si la propia prueba está mal?
Entonces la comprobación también es incorrecta. Por eso la prueba se escribe antes de que empiece el trabajo, donde una persona puede leerla, y cualquier cambio posterior queda registrado.
¿Mi código sale de mi ordenador?
No por culpa de RADAR. No necesita cuenta ni nube, y todos los servicios externos son opcionales y están desactivados hasta que los activas. Tus agentes siguen comunicándose con sus propios proveedores, como hacen hoy.
¿Cuánto cuesta usarlo?
RADAR no añade ninguna factura propia. Los agentes que ejecuta siguen usando las cuentas con las que inicias sesión en ellos, como un plan de Claude o ChatGPT, según las condiciones y los límites de uso de esos proveedores. RADAR solo usa una API de pago si indicas el proveedor y un presupuesto.
Tus agentes escriben el código. RADAR se asegura de que esté terminado de verdad.