证据,立于光下。

Grit 为企业和个人构建 AI 系统。我们的产品 RADAR 运行 AI 编程智能体,并且只有在亲自重新运行验收测试之后,才会关闭任务。

来自 Grit 自身的工作

观察所得,并非对照比较

  • 1,608 次中有 74 次编程智能体报告任务已完成,而 Grit 重新运行验收命令时失败
  • 4.6%这些报告中,未通过重新运行的比例

仅凭一项声明,不能关闭任务。 查看完整记录

Grit 内部台账,2026年9月28日 06:00 UTC 快照

我们的工作方式

测试再次通过,任务才算完成。

  1. 每项任务在工作开始之前,都会先有一项验收测试。

    示例。这里不会运行任何内容。

    任务修复登录后的重定向

    选择决定“完成”的测试

    “开始”保持锁定,直到任务有一项任何人都能重新运行的测试。

  2. 完成工作的智能体不会自行关闭任务。测试会重新运行一次。

    示例。这里不会运行任何内容。

    任务修复登录后的重定向打开

    智能体

    “完成了。所有测试都通过了。”

    已锁定:完成工作的智能体不能关闭它。

    检验方

    打开:等待检验方。

  3. 我们发布的每一个数字,都来自一条注明来源和日期的记录。

    真实数字,并非示例

    来自 Grit 自身的工作 · 观察所得,并非对照比较

    4.6%

    在 Grit 自身的工作中(2026年9月20日至28日),运行同一款编程智能体的工作进程共 1,608 次报告某项任务已完成(涉及 1,457 项任务);Grit 随即在同一台服务器上重新运行验收命令,其中 74 次报告的重新运行失败(4.6%)。仅凭一项声明,不能关闭任务。

    Grit 内部台账,2026年9月28日 06:00 UTC 快照

    查看完整记录

  4. 我们的工作设计为可在不止一个 AI 模型家族上运行。

    示例。这里不会运行任何内容。

    任务修复登录后的重定向

    智能体Claude Code

    测试pytest tests/test_login.py -k redirect同一项测试

    智能体及其背后的模型家族可以更换。关闭任务的那项测试不会改变。

radar
示例数据

radar示例数据

滚动或滑动,即可在屏幕中移动查看。

RADAR

我们的产品

RADAR 协调 AI 智能体,并检验它们交付的成果。

当智能体报告任务已完成时,RADAR 会再次运行该任务的验收测试。测试通过,任务即关闭。每一步都记录在您可以查阅的台账中。

示例

试一试:智能体能关闭自己的任务吗?

示例任务和输出,专为此演示编写。这里不会运行任何内容。

任务 打开

为结账添加优惠码

验收测试

pytest tests/test_checkout.py -k discount

打开:智能体正在处理。

台账

    尚无记录。

    您每凭证据关闭一项任务,Grit 圆盘就会点亮一格。

    我们做什么

    Grit 连接企业的数据,并将其工作自动化,所用的系统会自行检验自己的结果。

    • 网站

      从第一版草稿到正式上线,与您一同设计和构建:无障碍、加载迅速,并使用您的访客所读的语言。

      面向企业和个人

    • AI 自动化

      重复性的工作交由 AI 处理,每次都以相同的方式完成相同的步骤。每个结果在使用之前都会经过检验。

      面向工作内容重复的团队

    • 自主系统

      由智能体把一项工作从头到尾完成,构建方式与 RADAR 的工作方式相同:只有测试再次通过,任务才会关闭。

      面向对“完成”有明确定义的工作

    • 数据

      把分散的数据汇集到一处并加以清理,使其足够可靠,可用于日常工作和决策。

      面向数据分散在多处的机构

    公司

    带领 Grit 的人。

    • İsmet Aydın联合创始人
    • Mustafa Toker联合创始人
    • Ali Baha Berkal联合创始人

    把需要做好的工作交给我们。

    联系 Grit