RADAR par Grit En accès anticipé

Les agents disent que c’est fait.
RADAR vérifie.

RADAR pilote des agents de programmation IA comme Claude Code et Codex. Chaque tâche reçoit un test avant le début du travail ; elle n’est considérée comme terminée que lorsque RADAR exécute lui-même ce test et qu’il réussit.

  1. Vous donnez à RADAR une tâche et son test. Le test est écrit avant tout début de travail.
  2. Un agent fait le travail. Dans sa propre copie du projet.
  3. L’agent dit avoir terminé. RADAR l’enregistre comme une déclaration, pas comme un résultat.
  4. RADAR exécute lui-même le test. Il échoue. La tâche est rouverte, avec l’échec joint.
  5. L’agent corrige. RADAR relance le test. Il réussit.
  6. La tâche est clôturée. Sa preuve est conservée.
radar app
session d’exemple

radar appsession d’exemple

Faites défiler ou balayez pour vous déplacer dans l’écran.

radar app
exemple

Fig. 1 · Une session type, avec des données d’exemple

Pilote les agents que vous utilisez déjà

  • Claude Code
  • Codex CLI
  • OMP
  • Hermes Agent

Fonctionne avec

  • Claude
  • ChatGPT
  • Git
  • Python
  • Obsidian
  • Windows
  • Linux
RADAR remplace-t-il mon agent ?

En clair

Ce que fait RADAR, avec un seul exemple.

Un agent d’IA est un programme qui écrit et modifie des logiciels à votre place. Il travaille vite et dit quand il a fini. RADAR vérifie si c’est vraiment le cas.

Agent d’IA
Un programme qui fait seul du travail sur des logiciels, par exemple corriger un bug. Claude Code et Codex CLI en sont deux exemples.
Le test
Une vérification courte et précise qui prouve que le travail est correct, écrite avant le début du travail. Les ingénieurs l’appellent test d’acceptation.
Le registre
L’endroit où chaque tâche est consignée : qui l’a prise, ce qui a été déclaré et ce que le test a montré. RADAR l’appelle le grand livre (ledger).
  1. Le test est écrit en premier

    Avant que quiconque ne commence, la tâche reçoit son test : un mauvais mot de passe doit être refusé, et le bon doit vous laisser entrer.

  2. Un agent fait le travail

    RADAR confie la tâche à un agent d’IA. L’agent travaille dans sa propre copie du projet, donc rien d’autre n’est touché.

  3. L’agent dit avoir terminé

    L’agent annonce : « c’est fait ». RADAR l’enregistre comme une déclaration, pas comme un résultat.

  4. RADAR exécute lui-même le test

    RADAR exécute le test de son côté, sur la dernière version du travail, sans se fier à la parole de l’agent.

  5. S’il échoue, la tâche est rouverte

    Ici, un mauvais mot de passe vous laisse encore entrer. La tâche est rouverte avec le détail de l’échec, et l’agent réessaie. Après trois essais, un autre agent prend le relais ; après trois de plus, la tâche vous attend.

  6. Un test réussi clôture la tâche

    L’agent corrige, et RADAR relance le test. Il réussit : la tâche est clôturée, et le registre garde la preuve.

Pourquoi c’est important

Les agents peuvent se tromper avec assurance. Sans vérification, un « c’est fait » erroné arrive dans votre produit et chez vos clients. Avec RADAR, une tâche est terminée quand la preuve le dit.

Fig. 2 · Le même exemple, de près

La salle des cartes

Chaque agent, chaque tâche, sur un seul écran.

Voici l’écran d’accueil de RADAR. Cinq de ses parties sont expliquées ci-dessous.

radar
données d’exemple

radardonnées d’exemple

Faites défiler ou balayez pour vous déplacer dans l’écran.

Touchez un numéro pour zoomer.

Fig. 3 · L’écran d’accueil, avec des données d’exemple
  1. En haut à droite : CHART

    La carte

    Chaque île est un ordinateur : le vôtre, ou un serveur que vous gérez. Les lignes en pointillés sont les agents qui y travaillent. Une machine qui ne répond plus est marquée AGROUND et reste sur la carte.

  2. À gauche : LOG

    Le registre

    Chaque tâche est comptée par état : en attente, en cours ou en attente de son test. Tous les agents partagent un seul registre, donc rien ne se perd entre eux.

  3. En bas à gauche : NEXT

    Besoin de vous

    Seules les décisions qui demandent une personne vous parviennent, avec la prochaine commande à lancer. Un agent a trois essais, puis un autre agent prend le relais ; après trois essais de plus, la tâche vous attend ici.

  4. En bas à gauche : ARRIVALS

    Vérifié, puis intégré

    Le travail ne rejoint votre projet qu’une fois son test réussi, et le test est relancé une fois de plus après l’intégration. Les barres montrent combien de tâches ont été intégrées chaque heure.

  5. En bas à droite : COMMANDS

    Commandes et mémoire

    RADAR se pilote avec une courte liste de commandes. L’une d’elles recherche dans la mémoire : des notes sur les leçons apprises, que RADAR montre à l’agent suivant avant qu’il commence. Vous pouvez les ouvrir dans Obsidian.

Fig. 3 · L’écran d’accueil, avec des données d’exemple

Tiré des propres travaux de Grit

Une observation, pas une comparaison contrôlée

Dans les propres travaux de Grit (du 20 au 28 septembre 2026), des processus de travail qui exécutaient un même agent de programmation ont signalé 1 608 fois qu’une tâche était terminée (1 457 tâches) ; quand Grit a aussitôt relancé les commandes d’acceptation sur le même serveur, elles ont échoué pour 74 de ces signalements (4,6 %). Une déclaration seule ne clôture pas une tâche.

Chiffre affiché

1 608 signalements disaient « terminé », donc chacun compte comme fini.Les tests ont été relancés : ils ont échoué pour 74 de ces signalements.

Un carré : un signalement de tâche terminée La nouvelle exécution par Grit a échoué

Registre interne de Grit, instantané du 28 septembre 2026 à 06:00 UTC

Éditions

Une édition ouverte pour les particuliers.
Une édition pour les entreprises est en cours de développement.

Open source (Apache-2.0) dès la sortie publique

RADAR

Pour les développeurs individuels, sur votre propre ordinateur.

  • Le registre, les tests, la mémoire et des agents qui travaillent en parallèle
  • Pilote Claude Code, Codex CLI, OMP et Hermes Agent
  • Python 3.12 ou plus récent ; aucun compte ni cloud requis

En développement

RADAR pour les entreprises

Pour les équipes, sur votre propre infrastructure.

  • Fonctionne sur l’infrastructure de votre équipe, sur votre propre code
  • Mis en place et accompagné par Grit
  • Des systèmes autonomes conçus pour votre travail, selon la même règle : une tâche n’est clôturée que lorsque son test réussit à nouveau
RADAR est-il disponible aujourd’hui ?

RADAR est en accès anticipé. Pour le rejoindre, écrivez-nous via la page de contact, ou sur X ou Instagram. Une fois l’accès obtenu, vous donnez à votre agent de programmation le lien du dépôt et vous lui dites « installe ça ». Le dépôt contient des étapes d’installation écrites pour les agents : l’agent vérifie votre ordinateur, demande avant d’installer ce qui manque, configure RADAR et vous fait un compte rendu.

RADAR remplace-t-il mon agent de programmation ?

Non. RADAR pilote les agents que vous utilisez déjà et vérifie leur travail. Ce sont toujours les agents qui font le travail. RADAR leur donne un seul registre, une vérification qu’ils ne peuvent pas contourner et une seule mémoire.

Qu’est-ce qui compte comme terminé ?

Une tâche est terminée quand RADAR a exécuté son test sur la dernière version du travail et que le test a réussi. Le « c’est fait » de l’agent est enregistré comme une déclaration ; RADAR ne clôture pas la tâche tant que le test n’a pas réussi. Une personne peut passer outre, et cette décision est enregistrée.

Quels agents pilote-t-il ?

Claude Code, Codex CLI, OMP et Hermes Agent. Chacun travaille dans sa propre copie du projet, sur votre ordinateur ou sur vos propres serveurs Linux.

RADAR est-il meilleur que Claude Code ou Codex ?

Il ne les remplace pas, donc il n’est pas en concurrence avec eux. RADAR les pilote et vérifie ce qu’ils livrent.

Et si le test lui-même est faux ?

Alors la vérification est fausse elle aussi. C’est pourquoi le test est écrit avant le début du travail, là où une personne peut le lire, et toute modification ultérieure est enregistrée.

Mon code quitte-t-il mon ordinateur ?

Pas à cause de RADAR. Il ne demande ni compte ni cloud, et chaque service externe est facultatif et désactivé tant que vous ne l’activez pas. Vos agents continuent de communiquer avec leurs propres fournisseurs, comme aujourd’hui.

Combien coûte son utilisation ?

RADAR n’ajoute aucune facture qui lui soit propre. Les agents qu’il pilote continuent d’utiliser les comptes avec lesquels vous les connectez, comme un abonnement Claude ou ChatGPT, selon les conditions et les limites d’utilisation de ces fournisseurs. RADAR n’utilise une API payante que si vous indiquez le fournisseur et un budget.

Vos agents écrivent le code. RADAR s’assure qu’il est vraiment terminé.