RADAR von Grit Im Vorabzugang

Agenten melden „erledigt“.
RADAR prüft.

RADAR steuert KI-Coding-Agenten wie Claude Code und Codex. Jede Aufgabe erhält einen Test, bevor die Arbeit beginnt; als erledigt gilt sie erst, wenn RADAR diesen Test selbst ausführt und er erfolgreich ist.

  1. Sie übergeben RADAR eine Aufgabe samt Test. Der Test wird geschrieben, bevor die Arbeit beginnt.
  2. Ein Agent erledigt die Arbeit. In seiner eigenen Kopie des Projekts.
  3. Der Agent meldet, er sei fertig. RADAR hält das als Behauptung fest, nicht als Ergebnis.
  4. RADAR führt den Test selbst aus. Er schlägt fehl. Die Aufgabe wird mit dem angehängten Fehler wieder geöffnet.
  5. Der Agent behebt den Fehler. RADAR führt den Test erneut aus. Er ist erfolgreich.
  6. Die Aufgabe wird geschlossen. Ihr Nachweis bleibt erhalten.
radar app
Beispielsitzung

radar appBeispielsitzung

Scrollen oder wischen Sie, um sich auf dem Bildschirm zu bewegen.

radar app
Beispiel

Abb. 1 · Eine Beispielsitzung mit Beispieldaten

Steuert die Agenten, die Sie bereits nutzen

  • Claude Code
  • Codex CLI
  • OMP
  • Hermes Agent

Funktioniert mit

  • Claude
  • ChatGPT
  • Git
  • Python
  • Obsidian
  • Windows
  • Linux
Ersetzt RADAR meinen Agenten?

Einfach erklärt

Was RADAR tut, an einem Beispiel erklärt.

Ein KI-Agent ist ein Programm, das Software für Sie schreibt und ändert. Er arbeitet schnell und sagt, wann er fertig ist. RADAR prüft, ob das wirklich stimmt.

KI-Agent
Ein Programm, das selbstständig Softwarearbeit erledigt, zum Beispiel einen Fehler behebt. Claude Code und Codex CLI sind zwei Beispiele.
Der Test
Eine kleine, genaue Prüfung, die vor Arbeitsbeginn geschrieben wird und belegt, dass die Arbeit stimmt. Fachleute sprechen von einem Abnahmetest.
Das Protokoll
Wo jede Aufgabe festgehalten wird: wer sie übernommen hat, was behauptet wurde und was der Test gezeigt hat. In RADAR heißt es Ledger.
  1. Zuerst wird der Test geschrieben

    Bevor jemand beginnt, erhält die Aufgabe ihren Test: Ein falsches Passwort muss abgelehnt werden, das richtige muss Zugang gewähren.

  2. Ein Agent erledigt die Arbeit

    RADAR übergibt die Aufgabe an einen KI-Agenten. Der Agent arbeitet in seiner eigenen Kopie des Projekts, sodass alles andere unberührt bleibt.

  3. Der Agent meldet, er sei fertig

    Der Agent meldet: „Erledigt.“ RADAR hält das als Behauptung fest, nicht als Ergebnis.

  4. RADAR führt den Test selbst aus

    RADAR führt den Test selbst auf dem neuesten Stand der Arbeit aus, ohne sich auf die Aussage des Agenten zu verlassen.

  5. Schlägt er fehl, wird die Aufgabe wieder geöffnet

    Hier gewährt ein falsches Passwort noch immer Zugang. Die Aufgabe wird mit angehängtem Fehler wieder geöffnet, und der Agent versucht es erneut. Nach drei Versuchen übernimmt ein anderer Agent; nach drei weiteren wartet die Aufgabe auf Sie.

  6. Ein erfolgreicher Test schließt die Aufgabe

    Der Agent behebt den Fehler, und RADAR führt den Test erneut aus. Er ist erfolgreich, also wird die Aufgabe geschlossen, und das Protokoll bewahrt den Nachweis auf.

Warum das wichtig ist

Agenten können sich mit voller Überzeugung irren. Ohne Prüfung gelangt ein falsches „erledigt“ in Ihr Produkt und zu Ihren Kunden. Mit RADAR ist eine Aufgabe erledigt, wenn der Nachweis es bestätigt.

Abb. 2 · Dasselbe Beispiel aus der Nähe

Der Kartenraum

Alle Agenten, alle Aufgaben auf einem Bildschirm.

Das ist der Startbildschirm von RADAR. Fünf seiner Bereiche werden unten erklärt.

radar
Beispieldaten

radarBeispieldaten

Scrollen oder wischen Sie, um sich auf dem Bildschirm zu bewegen.

Tippen Sie auf eine Zahl, um hineinzuzoomen.

Abb. 3 · Der Startbildschirm mit Beispieldaten
  1. Oben rechts: CHART

    Die Karte

    Jede Insel ist ein Computer: Ihr eigener oder ein Server, den Sie betreiben. Die gestrichelten Linien stehen für die Agenten, die darauf arbeiten. Ein Rechner, der nicht mehr antwortet, wird als AGROUND markiert und bleibt auf der Karte.

  2. Links: LOG

    Das Protokoll

    Jede Aufgabe wird nach Status gezählt: wartend, in Arbeit oder auf ihren Test wartend. Alle Agenten teilen sich ein Protokoll, sodass zwischen ihnen nichts verloren geht.

  3. Unten links: NEXT

    Wartet auf Sie

    Sie erreichen nur die Entscheidungen, die ein Mensch treffen muss, jeweils mit dem nächsten auszuführenden Befehl. Ein Agent hat drei Versuche, dann übernimmt ein anderer Agent; nach drei weiteren wartet die Aufgabe hier auf Sie.

  4. Unten links: ARRIVALS

    Erst geprüft, dann übernommen

    Arbeit wird erst in Ihr Projekt übernommen, wenn ihr Test erfolgreich war, und nach der Übernahme läuft der Test noch einmal. Die Balken zeigen, wie viele Aufgaben pro Stunde übernommen wurden.

  5. Unten rechts: COMMANDS

    Befehle und Gedächtnis

    RADAR wird über eine kurze Liste von Befehlen bedient. Einer davon durchsucht das Gedächtnis: Notizen zu gewonnenen Erkenntnissen, die RADAR dem nächsten Agenten zeigt, bevor er beginnt. Sie lassen sich in Obsidian öffnen.

Abb. 3 · Der Startbildschirm mit Beispieldaten

Aus Grits eigener Arbeit

Beobachtung, kein kontrollierter Vergleich

In der eigenen Arbeit von Grit (20.–28. September 2026) meldeten Arbeitsprozesse, die ein und denselben Coding-Agenten ausführten, 1.608-mal eine Aufgabe als erledigt (1.457 Aufgaben); als Grit die Abnahmebefehle sofort auf demselben Server erneut ausführte, schlugen sie bei 74 dieser Meldungen fehl (4,6 %). Eine Behauptung allein schließt keine Aufgabe.

Angezeigte Zahl

1.608 Meldungen lauteten „erledigt“, also zählt jede als abgeschlossen.Die Tests wurden erneut ausgeführt: Bei 74 dieser Meldungen schlugen sie fehl.

Ein Quadrat: eine Meldung „Aufgabe erledigt“ Grits erneuter Testlauf schlug fehl

Internes Protokoll von Grit, Stand 28. September 2026, 06:00 UTC

Editionen

Eine offene Edition für Einzelpersonen.
Eine Edition für Unternehmen ist in Entwicklung.

Open Source (Apache-2.0) ab der allgemeinen Veröffentlichung

RADAR

Für einzelne Entwickler, auf Ihrem eigenen Computer.

  • Das Protokoll, die Tests, das Gedächtnis und parallel arbeitende Agenten
  • Steuert Claude Code, Codex CLI, OMP und Hermes Agent
  • Python 3.12 oder neuer; kein Konto und keine Cloud nötig

In Entwicklung

RADAR für Unternehmen

Für Teams, auf Ihrer eigenen Infrastruktur.

  • Läuft auf der eigenen Infrastruktur Ihres Teams, mit Ihrem eigenen Code
  • Eingerichtet und betreut von Grit
  • Autonome Systeme für Ihre Arbeit, nach derselben Regel: Eine Aufgabe wird erst geschlossen, wenn ihr Test erneut erfolgreich ist
Ist RADAR heute verfügbar?

RADAR befindet sich im Vorabzugang. Um dabei zu sein, schreiben Sie uns über die Kontaktseite oder auf X oder Instagram. Sobald Sie Zugang haben, geben Sie Ihrem Coding-Agenten den Link zum Repository und sagen Sie „Installiere das“. Das Repository enthält Installationsschritte, die für Agenten geschrieben sind: Der Agent prüft Ihren Computer, fragt nach, bevor er etwas Fehlendes installiert, richtet RADAR ein und meldet sich zurück.

Ersetzt RADAR meinen Coding-Agenten?

Nein. RADAR steuert die Agenten, die Sie bereits nutzen, und prüft ihre Arbeit. Die Arbeit erledigen weiterhin die Agenten. RADAR gibt ihnen ein einheitliches Protokoll, eine Prüfung, die sie nicht überspringen können, und ein gemeinsames Gedächtnis.

Was gilt als erledigt?

Eine Aufgabe ist erledigt, wenn RADAR seinen Test auf dem neuesten Stand der Arbeit ausgeführt hat und der Test erfolgreich war. Das „erledigt“ des Agenten wird als Behauptung festgehalten; RADAR schließt die Aufgabe nicht, bevor der Test erfolgreich ist. Eine Person kann das übersteuern, und dieser Eingriff wird protokolliert.

Welche Agenten steuert RADAR?

Claude Code, Codex CLI, OMP und Hermes Agent. Jeder arbeitet in seiner eigenen Kopie des Projekts, auf Ihrem Computer oder auf Ihren eigenen Linux-Servern.

Ist RADAR besser als Claude Code oder Codex?

RADAR ersetzt sie nicht und konkurriert deshalb nicht mit ihnen. RADAR steuert sie und prüft, was sie liefern.

Und wenn der Test selbst falsch ist?

Dann ist auch die Prüfung falsch. Deshalb wird der Test vor Arbeitsbeginn geschrieben, wo ein Mensch ihn lesen kann, und jede spätere Änderung daran wird protokolliert.

Verlässt mein Code meinen Computer?

Nicht durch RADAR. RADAR benötigt weder ein Konto noch eine Cloud, und jeder externe Dienst ist optional und bleibt aus, bis Sie ihn einschalten. Ihre Agenten kommunizieren weiterhin mit ihren eigenen Anbietern, wie bisher.

Was kostet der Betrieb?

RADAR stellt selbst nichts in Rechnung. Die Agenten, die es steuert, nutzen weiterhin die Konten, mit denen Sie sie angemeldet haben, etwa ein Claude- oder ChatGPT-Abonnement, zu den Bedingungen und Nutzungslimits dieser Anbieter. RADAR nutzt eine kostenpflichtige API nur, wenn Sie den Anbieter und ein Budget festlegen.

Ihre Agenten schreiben den Code. RADAR stellt sicher, dass er wirklich fertig ist.