RADAR, Claude Code और Codex जैसे AI कोडिंग एजेंटों को चलाता है। हर कार्य को काम शुरू होने से पहले एक परीक्षण मिलता है; कार्य तभी पूरा माना जाता है जब RADAR वह परीक्षण खुद चलाए और वह पास हो।
AI एजेंट एक प्रोग्राम है जो आपके लिए सॉफ़्टवेयर लिखता और बदलता है। यह तेज़ काम करता है और बताता है कि उसने काम पूरा कर लिया। RADAR जाँचता है कि क्या उसने सच में पूरा किया है।
AI एजेंट
एक प्रोग्राम जो सॉफ़्टवेयर का काम खुद करता है, जैसे किसी गड़बड़ी को ठीक करना। Claude Code और Codex CLI इसके दो उदाहरण हैं।
परीक्षण
एक छोटी और सटीक जाँच, जो साबित करती है कि काम सही है। इसे काम शुरू होने से पहले लिखा जाता है। इंजीनियर इसे स्वीकृति परीक्षण कहते हैं।
रिकॉर्ड
वह जगह जहाँ हर कार्य लिखा जाता है: उसे किसने लिया, उसने क्या दावा किया, और परीक्षण में क्या निकला। RADAR इसे लेजर कहता है।
1
पहले परीक्षण लिखा जाता है
किसी के शुरू करने से पहले कार्य का परीक्षण लिखा जाता है: गलत पासवर्ड को मना किया जाना चाहिए, और सही पासवर्ड से आपको अंदर जाने दिया जाना चाहिए।
radar app · t-4821example
○youthe login accepts a wrong password; fix it
◆radartaskt-4821created
┊the test, written before any work:
┊
testwritten before the worknot run yet
…a wrong password→refused
…the right password→signed in
┊the working agent cannot change the test command
2
एक एजेंट काम करता है
RADAR कार्य एक AI एजेंट को सौंपता है। एजेंट प्रोजेक्ट की अपनी अलग कॉपी में काम करता है, इसलिए बाकी किसी चीज़ को हाथ नहीं लगता।
radar app · t-4821example
○youthe login accepts a wrong password; fix it
◆radartaskt-4821created·test written first
◇agentWorking in my own copy of the project.
·▸ Read login_app/auth.py13 lines
·▸ Grep wrong_password in tests/1 match
·▸ Edit login_app/auth.py+1 −1
┊leaseclaimed attempt1/3
3
एजेंट कहता है कि काम पूरा हो गया
एजेंट बताता है: पूरा हो गया। RADAR इसे नतीजे के रूप में नहीं, बल्कि एक दावे के रूप में दर्ज करता है।
radar app · t-4821example
◇agentWorking in my own copy of the project.
·▸ Read login_app/auth.py13 lines
·▸ Grep wrong_password in tests/1 match
·▸ Edit login_app/auth.py+1 −1
◇agentdone:wrong passwords are refused now
┊radar:claim, not result·it runs the test itself
4
RADAR परीक्षण खुद चलाता है
RADAR एजेंट की बात मान लेने के बजाय, काम के सबसे नए संस्करण पर परीक्षण खुद चलाता है।
radar app · t-4821example
◇agentdone:wrong passwords are refused now
┊radar:claim, not result·it runs the test itself
◆radarverifyt-4821·running the test itselfunder way
┊
testrun by radarrunning
a wrong password→…
the right password→…
5
फेल हो, तो कार्य फिर से खुलता है
यहाँ गलत पासवर्ड से भी आप अंदर पहुँच जाते हैं। कार्य विफलता के ब्योरे के साथ फिर से खुलता है, और एजेंट फिर कोशिश करता है। तीन कोशिशों के बाद दूसरा एजेंट काम सँभाल लेता है; तीन और कोशिशों के बाद भी न हो, तो कार्य आपका इंतज़ार करता है।
radar app · t-4821example
◇agentdone:wrong passwords are refused now
◆radarverifyt-4821·1 failedexit 1
┊
testrun by radar1 failed · exit 1
a wrong password→signed inshould be refused
the right password→signed in
┊check_login("ada", "wrong password") returned True
┊t-4821reopened· failure attached · attempt 2/3
6
पास हुआ परीक्षण कार्य बंद करता है
एजेंट गड़बड़ी ठीक करता है, और RADAR परीक्षण फिर से चलाता है। परीक्षण पास होता है, इसलिए कार्य बंद हो जाता है, और रिकॉर्ड प्रमाण सँभालकर रखता है।
radar app · t-4821example
◇agentThe length check was not the bug: nothing compared the password with the stored hash.
·▸ Edit login_app/auth.py+2 −1
◆radarverifyt-4821·passed·judged by radar2 passed
┊
testrun by radar2 passed
a wrong password→refused
the right password→signed in
■t-4821closed·proof kept in the ledger
यह क्यों ज़रूरी है
एजेंट पूरे भरोसे के साथ भी गलत हो सकते हैं। जाँच के बिना एक गलत “पूरा हुआ” आपके उत्पाद और आपके ग्राहकों तक पहुँच जाता है। RADAR के साथ कार्य तब पूरा होता है, जब प्रमाण ऐसा कहे।
radar app · t-4821example
○youthe login accepts a wrong password; fix it
◆radartaskt-4821created
┊the test, written before any work:
┊
testwritten before the worknot run yet
…a wrong password→refused
…the right password→signed in
┊the working agent cannot change the test command
○youthe login accepts a wrong password; fix it
◆radartaskt-4821created·test written first
◇agentWorking in my own copy of the project.
·▸ Read login_app/auth.py13 lines
·▸ Grep wrong_password in tests/1 match
·▸ Edit login_app/auth.py+1 −1
┊leaseclaimed attempt1/3
◇agentWorking in my own copy of the project.
·▸ Read login_app/auth.py13 lines
·▸ Grep wrong_password in tests/1 match
·▸ Edit login_app/auth.py+1 −1
◇agentdone:wrong passwords are refused now
┊radar:claim, not result·it runs the test itself
◇agentdone:wrong passwords are refused now
┊radar:claim, not result·it runs the test itself
◆radarverifyt-4821·running the test itselfunder way
┊
testrun by radarrunning
a wrong password→…
the right password→…
◇agentdone:wrong passwords are refused now
◆radarverifyt-4821·1 failedexit 1
┊
testrun by radar1 failed · exit 1
a wrong password→signed inshould be refused
the right password→signed in
┊check_login("ada", "wrong password") returned True
┊t-4821reopened· failure attached · attempt 2/3
◇agentThe length check was not the bug: nothing compared the password with the stored hash.
·▸ Edit login_app/auth.py+2 −1
◆radarverifyt-4821·passed·judged by radar2 passed
┊
testrun by radar2 passed
a wrong password→refused
the right password→signed in
■t-4821closed·proof kept in the ledger
चित्र 2 · वही उदाहरण, पास से
नक्शा कक्ष
हर एजेंट, हर कार्य, एक ही स्क्रीन पर।
यह RADAR की होम स्क्रीन है। इसके पाँच हिस्से नीचे समझाए गए हैं।
radarनमूना डेटा120x36
1ज़ूम इन करने के लिए किसी नंबर पर टैप करें।
चित्र 3 · होम स्क्रीन, नमूना डेटा के साथ
01
ऊपर दाएँ: CHART
नक्शा
हर द्वीप एक कंप्यूटर है: आपका अपना, या कोई सर्वर जिसे आप चलाते हैं। टूटी रेखाएँ उस पर काम कर रहे एजेंट हैं। जो मशीन जवाब देना बंद कर दे, उस पर AGROUND का निशान लगता है और वह नक्शे पर बनी रहती है।
02
बाएँ: LOG
रिकॉर्ड
हर कार्य को उसकी स्थिति के हिसाब से गिना जाता है: इंतज़ार में, जारी, या अपने परीक्षण के इंतज़ार में। सभी एजेंटों के लिए एक ही रिकॉर्ड है, इसलिए उनके बीच कुछ भी खोता नहीं।
03
नीचे बाएँ: NEXT
आपकी ज़रूरत है
आप तक केवल वे फ़ैसले पहुँचते हैं जिनके लिए किसी इंसान की ज़रूरत है, साथ में चलाने के लिए अगला कमांड भी। एक एजेंट को तीन मौके मिलते हैं, फिर दूसरा एजेंट काम सँभाल लेता है; तीन और कोशिशों के बाद भी न हो, तो कार्य यहाँ आपका इंतज़ार करता है।
04
नीचे बाएँ: ARRIVALS
पहले जाँच, फिर शामिल
काम आपके प्रोजेक्ट में तभी शामिल होता है जब उसका परीक्षण पास हो जाए, और शामिल होने के बाद परीक्षण एक बार और चलता है। पट्टियाँ दिखाती हैं कि हर घंटे कितने कार्य शामिल हुए।
05
नीचे दाएँ: COMMANDS
कमांड और स्मृति
RADAR कमांडों की एक छोटी सूची से चलता है। उनमें से एक स्मृति में खोज करता है: सीखी हुई बातों के नोट्स, जिन्हें RADAR अगले एजेंट के शुरू करने से पहले उसके सामने रखता है। आप इन्हें Obsidian में खोल सकते हैं।
Grit के अपने काम से
अवलोकन, नियंत्रित तुलना नहीं
Grit के अपने काम में (20-28 सितंबर 2026), एक ही कोडिंग एजेंट चलाने वाले वर्कर्स ने 1,608 बार किसी कार्य को पूरा बताया (1,457 कार्य); Grit ने उसी सर्वर पर स्वीकृति कमांड तुरंत फिर से चलाए, और इनमें से 74 रिपोर्टों पर यह दोबारा चलाना फेल रहा (4.6%)। केवल दावे से कोई कार्य बंद नहीं होता।
1,608 रिपोर्टों में काम पूरा बताया गया, इसलिए हर एक पूरा गिना जाता है।परीक्षण फिर से चलाए गए: उनमें से 74 रिपोर्टें फेल रहीं।
एक वर्ग: किसी कार्य के पूरा होने की एक रिपोर्टGrit का दोबारा चलाना फेल रहा
Grit का आंतरिक लेजर, स्नैपशॉट 28 सितंबर 2026 06:00 UTC
संस्करण
व्यक्तियों के लिए एक ओपन संस्करण। कंपनियों के लिए एक संस्करण विकास में है।
सार्वजनिक रिलीज़ पर ओपन सोर्स (Apache-2.0)
RADAR
व्यक्तिगत डेवलपर्स के लिए, आपके अपने कंप्यूटर पर।
रिकॉर्ड, परीक्षण, स्मृति, और साथ-साथ काम करते एजेंट
Claude Code, Codex CLI, OMP और Hermes Agent चलाता है
Python 3.12 या नया संस्करण; न खाता चाहिए, न क्लाउड
RADAR शुरुआती एक्सेस में है। जुड़ने के लिए संपर्क पेज के ज़रिए, या X या Instagram पर हमें लिखें। एक्सेस मिलने के बाद आप अपने कोडिंग एजेंट को रिपॉज़िटरी का लिंक देकर कहें “इसे इंस्टॉल करो”। रिपॉज़िटरी में एजेंटों के लिए लिखे गए इंस्टॉल के चरण हैं: एजेंट आपका कंप्यूटर जाँचता है, जो कुछ मौजूद नहीं है उसे इंस्टॉल करने से पहले आपसे पूछता है, RADAR सेट करता है और आपको बताता है।
क्या RADAR मेरे कोडिंग एजेंट की जगह लेता है?
नहीं। RADAR उन्हीं एजेंटों को चलाता है जिन्हें आप पहले से इस्तेमाल करते हैं, और उनके काम की जाँच करता है। काम अब भी एजेंट ही करते हैं। RADAR उन्हें एक रिकॉर्ड, एक ऐसी जाँच जिसे वे छोड़ नहीं सकते, और एक स्मृति देता है।
पूरा किसे माना जाता है?
कार्य तब पूरा होता है जब RADAR काम के सबसे नए संस्करण पर अपना परीक्षण चला ले और वह पास हो जाए। एजेंट का अपना “पूरा हुआ” एक दावे के रूप में दर्ज होता है; परीक्षण पास होने तक RADAR कार्य बंद नहीं करता। कोई व्यक्ति इस नियम को पलट सकता है, और पलटना भी दर्ज होता है।
यह कौन-से एजेंट चलाता है?
Claude Code, Codex CLI, OMP और Hermes Agent। हर एक प्रोजेक्ट की अपनी अलग कॉपी में काम करता है, आपके कंप्यूटर पर या आपके अपने Linux सर्वरों पर।
क्या RADAR, Claude Code या Codex से बेहतर है?
यह उनकी जगह नहीं लेता, इसलिए उनसे मुकाबला नहीं करता। RADAR उन्हें चलाता है और जाँचता है कि वे क्या देते हैं।
अगर परीक्षण ही गलत हो तो?
तब जाँच भी गलत होगी। इसीलिए परीक्षण काम शुरू होने से पहले लिखा जाता है, जहाँ कोई व्यक्ति उसे पढ़ सके, और उसमें बाद का हर बदलाव दर्ज होता है।
क्या मेरा कोड मेरे कंप्यूटर से बाहर जाता है?
RADAR के ज़रिए नहीं। इसे न खाते की ज़रूरत है, न क्लाउड की; हर बाहरी सेवा वैकल्पिक है और तब तक बंद रहती है जब तक आप उसे चालू न करें। आपके एजेंट आज की तरह ही अपने-अपने प्रदाताओं से बात करते रहते हैं।
इसे चलाने में कितना खर्च आता है?
RADAR अपना कोई बिल नहीं जोड़ता। जिन एजेंटों को यह चलाता है, वे उन्हीं खातों का उपयोग करते रहते हैं जिनसे आप उनमें साइन इन करते हैं, जैसे Claude या ChatGPT प्लान, और यह उपयोग उन प्रदाताओं की शर्तों और उपयोग सीमाओं के तहत होता है। RADAR सशुल्क API का उपयोग तभी करता है जब आप प्रदाता और बजट तय करें।
कोड आपके एजेंट लिखते हैं। काम सच में पूरा हुआ है, यह RADAR पक्का करता है।