RADAR от Grit Ранний доступ

Агенты говорят «готово».
RADAR проверяет.

RADAR запускает ИИ-агентов для программирования, таких как Claude Code и Codex. Для каждой задачи тест пишется до начала работы; задача считается выполненной, только когда RADAR сам запускает этот тест и тест проходит.

  1. Вы даёте RADAR задачу и её тест. Тест пишется до начала любой работы.
  2. Работу выполняет агент. В своей собственной копии проекта.
  3. Агент говорит, что всё готово. RADAR записывает это как заявление, а не как результат.
  4. RADAR сам запускает тест. Тест не пройден. Задача открывается снова, и к ней приложено описание сбоя.
  5. Агент исправляет ошибку. RADAR снова запускает тест. Тест пройден.
  6. Задача закрывается. Доказательство сохраняется.
radar app
пример сеанса

radar appпример сеанса

Прокручивайте или проводите пальцем, чтобы перемещаться по экрану.

radar app
пример

Рис. 1 · Пример сеанса на демонстрационных данных

Запускает агентов, которыми вы уже пользуетесь

  • Claude Code
  • Codex CLI
  • OMP
  • Hermes Agent

Работает с

  • Claude
  • ChatGPT
  • Git
  • Python
  • Obsidian
  • Windows
  • Linux
RADAR заменяет моего агента?

Простыми словами

Что делает RADAR — на одном примере.

ИИ-агент — это программа, которая пишет и меняет программы за вас. Он работает быстро, а закончив, сообщает об этом. RADAR проверяет, действительно ли он закончил.

ИИ-агент
Программа, которая сама выполняет работу над программами, например исправляет ошибку. Claude Code и Codex CLI — два таких агента.
Тест
Небольшая точная проверка, которая доказывает, что работа сделана правильно. Её пишут до начала работы. Инженеры называют её приёмочным тестом.
Журнал
Место, где записана каждая задача: кто её взял, что заявил и что показал тест. В RADAR он называется ledger.
  1. Сначала пишется тест

    Ещё до начала работы у задачи появляется тест: неправильный пароль должен отклоняться, а правильный — пускать вас внутрь.

  2. Работу выполняет агент

    RADAR передаёт задачу ИИ-агенту. Агент работает в своей собственной копии проекта, поэтому больше ничего не затрагивается.

  3. Агент говорит, что всё готово

    Агент сообщает: «готово». RADAR записывает это как заявление, а не как результат.

  4. RADAR сам запускает тест

    RADAR запускает тест самостоятельно, на последней версии работы, не полагаясь на слово агента.

  5. Если тест не пройден, задача открывается снова

    Здесь неправильный пароль всё ещё пускает внутрь. Задача открывается снова вместе с описанием сбоя, и агент пробует ещё раз. После трёх попыток задачу берёт другой агент; если не помогли и ещё три попытки, задача ждёт вас.

  6. Пройденный тест закрывает задачу

    Агент исправляет ошибку, и RADAR снова запускает тест. Тест пройден, поэтому задача закрывается, а журнал сохраняет доказательство.

Почему это важно

Агенты могут ошибаться с полной уверенностью. Без проверки ошибочное «готово» попадает в ваш продукт и к вашим клиентам. С RADAR задача считается выполненной, когда это подтверждает доказательство.

Рис. 2 · Тот же пример крупным планом

Штурманская рубка

Все агенты и все задачи на одном экране.

Это главный экран RADAR. Пять его частей объяснены ниже.

radar
демонстрационные данные

radarдемонстрационные данные

Прокручивайте или проводите пальцем, чтобы перемещаться по экрану.

Нажмите на номер, чтобы приблизить.

Рис. 3 · Главный экран на демонстрационных данных
  1. Справа вверху: CHART

    Карта

    Каждый остров — это компьютер: ваш собственный или сервер, которым вы управляете. Пунктирные линии — это агенты, которые на нём работают. Машина, которая перестала отвечать, помечается как AGROUND и остаётся на карте.

  2. Слева: LOG

    Журнал

    Каждая задача учитывается по состоянию: ожидает, в работе или ждёт своего теста. Все агенты ведут один общий журнал, поэтому между ними ничего не теряется.

  3. Слева внизу: NEXT

    Ждёт вас

    До вас доходят только решения, которые должен принять человек, вместе со следующей командой, которую нужно выполнить. У агента три попытки, затем задачу берёт другой агент; если не помогли и ещё три попытки, задача ждёт вас здесь.

  4. Слева внизу: ARRIVALS

    Сначала проверено, потом принято

    Работа попадает в ваш проект только после того, как её тест пройден, а после этого тест запускается ещё раз. Полосы показывают, сколько задач попадало в проект каждый час.

  5. Справа внизу: COMMANDS

    Команды и память

    RADAR управляется коротким списком команд. Одна из них ищет по памяти: заметкам о выученных уроках, которые RADAR показывает следующему агенту до начала работы. Их можно открыть в Obsidian.

Рис. 3 · Главный экран на демонстрационных данных

Из собственной работы Grit

Наблюдение, а не контролируемое сравнение

В собственной работе Grit (20–28 сентября 2026 г.) рабочие процессы, запускавшие одного и того же агента для программирования, 1 608 раз сообщили, что задача выполнена (1 457 задач); немедленный повторный запуск приёмочных команд, который Grit провёл на том же сервере, завершился неудачей для 74 из этих сообщений (4,6 %). Одно лишь заявление не закрывает задачу.

Какой подсчёт показать

Сообщений «готово»: 1 608, поэтому все они засчитаны как выполненные.Тесты запущены повторно: для 74 из этих сообщений они не прошли.

Один квадрат — одно сообщение о том, что задача выполнена Повторный запуск Grit не прошёл

Внутренний журнал Grit, снимок на 28 сентября 2026 г., 06:00 UTC

Редакции

Открытая редакция для частных лиц.
Редакция для компаний — в разработке.

Открытый исходный код (Apache-2.0) после публичного выпуска

RADAR

Для индивидуальных разработчиков, на вашем собственном компьютере.

  • Журнал, тесты, память и агенты, работающие параллельно
  • Запускает Claude Code, Codex CLI, OMP и Hermes Agent
  • Python 3.12 или новее; учётная запись и облако не нужны

В разработке

RADAR для компаний

Для команд, на вашей собственной инфраструктуре.

  • Работает на собственной инфраструктуре вашей команды, с вашим собственным кодом
  • Настройка и поддержка от Grit
  • Автономные системы для вашей работы по тому же правилу: задача закрывается, только когда её тест снова пройден
RADAR уже доступен?

RADAR находится в раннем доступе. Чтобы присоединиться, напишите нам через страницу контактов, в X или Instagram. Когда доступ откроется, вы даёте своему агенту для программирования ссылку на репозиторий и говорите «установи это». В репозитории есть шаги установки, написанные для агентов: агент проверяет ваш компьютер, спрашивает, прежде чем устанавливать то, чего не хватает, настраивает RADAR и сообщает о результате.

RADAR заменяет моего агента для программирования?

Нет. RADAR запускает агентов, которыми вы уже пользуетесь, и проверяет их работу. Саму работу по-прежнему выполняют агенты. RADAR даёт им один журнал, одну проверку, которую нельзя пропустить, и одну память.

Что считается выполненным?

Задача считается выполненной, когда RADAR запустил её тест на последней версии работы и тест пройден. Собственное «готово» агента записывается как заявление; пока тест не пройден, RADAR не закроет задачу. Человек может отменить это правило, и такая отмена записывается.

Каких агентов он запускает?

Claude Code, Codex CLI, OMP и Hermes Agent. Каждый работает в своей собственной копии проекта — на вашем компьютере или на ваших собственных серверах Linux.

RADAR лучше, чем Claude Code или Codex?

Он их не заменяет, поэтому и не соревнуется с ними. RADAR запускает их и проверяет то, что они сдают.

А если сам тест неправильный?

Тогда неверна и сама проверка. Поэтому тест пишется до начала работы, там, где его может прочитать человек, а любое последующее его изменение записывается.

Покидает ли мой код мой компьютер?

Не из-за RADAR. Ему не нужны ни учётная запись, ни облако, а все внешние сервисы необязательны и выключены, пока вы их не включите. Ваши агенты по-прежнему общаются со своими поставщиками, как и сегодня.

Сколько стоит его работа?

RADAR не добавляет собственных счетов. Агенты, которых он запускает, продолжают работать через учётные записи, под которыми вы в них вошли, например тариф Claude или ChatGPT, на условиях этих поставщиков и в пределах их лимитов использования. RADAR использует платный API, только если вы укажете поставщика и бюджет.

Код пишут ваши агенты. RADAR следит, чтобы всё было действительно готово.