RADAR, Claude Code आणि Codex सारखे AI कोडिंग एजंट चालवते. प्रत्येक कार्याला काम सुरू होण्यापूर्वी एक चाचणी मिळते; RADAR ती चाचणी स्वतः चालवते आणि ती उत्तीर्ण होते, तेव्हाच कार्य पूर्ण मानले जाते.
AI एजंट हा आपल्यासाठी सॉफ्टवेअर लिहिणारा आणि बदलणारा एक प्रोग्राम आहे. तो वेगाने काम करतो आणि काम संपले असे सांगतो. ते खरोखर संपले आहे का, हे RADAR तपासते.
AI एजंट
एखादी चूक दुरुस्त करणे यांसारखे सॉफ्टवेअरचे काम स्वतःहून करणारा प्रोग्राम. Claude Code आणि Codex CLI ही त्याची दोन उदाहरणे आहेत.
चाचणी
काम बरोबर झाले आहे हे सिद्ध करणारी छोटी आणि नेमकी तपासणी, जी काम सुरू होण्यापूर्वी लिहिली जाते. अभियंते तिला स्वीकृती चाचणी म्हणतात.
नोंद
प्रत्येक कार्य जिथे लिहिले जाते ती जागा: ते कोणी घेतले, त्याने काय दावा केला आणि चाचणीत काय दिसले. RADAR तिला नोंदवही म्हणते.
1
आधी चाचणी लिहिली जाते
कोणीही सुरुवात करण्यापूर्वी कार्याची चाचणी लिहिली जाते: चुकीचा पासवर्ड नाकारला गेला पाहिजे, आणि बरोबर पासवर्डने आत जाता आले पाहिजे.
radar app · t-4821example
○youthe login accepts a wrong password; fix it
◆radartaskt-4821created
┊the test, written before any work:
┊
testwritten before the worknot run yet
…a wrong password→refused
…the right password→signed in
┊the working agent cannot change the test command
2
एक एजंट काम करतो
RADAR हे कार्य एका AI एजंटकडे सोपवते. एजंट प्रकल्पाच्या स्वतःच्या वेगळ्या प्रतीत काम करतो, त्यामुळे इतर कशालाही हात लागत नाही.
radar app · t-4821example
○youthe login accepts a wrong password; fix it
◆radartaskt-4821created·test written first
◇agentWorking in my own copy of the project.
·▸ Read login_app/auth.py13 lines
·▸ Grep wrong_password in tests/1 match
·▸ Edit login_app/auth.py+1 −1
┊leaseclaimed attempt1/3
3
एजंट म्हणतो, काम झाले
एजंट कळवतो: काम झाले. RADAR हे निकाल म्हणून नव्हे, तर दावा म्हणून नोंदवते.
radar app · t-4821example
◇agentWorking in my own copy of the project.
·▸ Read login_app/auth.py13 lines
·▸ Grep wrong_password in tests/1 match
·▸ Edit login_app/auth.py+1 −1
◇agentdone:wrong passwords are refused now
┊radar:claim, not result·it runs the test itself
4
RADAR चाचणी स्वतः चालवते
RADAR एजंटच्या शब्दावर विसंबून न राहता, कामाच्या नवीनतम आवृत्तीवर चाचणी स्वतः चालवते.
radar app · t-4821example
◇agentdone:wrong passwords are refused now
┊radar:claim, not result·it runs the test itself
◆radarverifyt-4821·running the test itselfunder way
┊
testrun by radarrunning
a wrong password→…
the right password→…
5
अयशस्वी झाली तर कार्य पुन्हा उघडते
इथे चुकीच्या पासवर्डनेही आत जाता येते. अपयशाच्या तपशिलासह कार्य पुन्हा उघडते, आणि एजंट पुन्हा प्रयत्न करतो. तीन प्रयत्नांनंतर दुसरा एजंट काम हाती घेतो; आणखी तीन प्रयत्नांनंतरही जमले नाही, तर कार्य आपली वाट पाहते.
radar app · t-4821example
◇agentdone:wrong passwords are refused now
◆radarverifyt-4821·1 failedexit 1
┊
testrun by radar1 failed · exit 1
a wrong password→signed inshould be refused
the right password→signed in
┊check_login("ada", "wrong password") returned True
┊t-4821reopened· failure attached · attempt 2/3
6
उत्तीर्ण चाचणी कार्य बंद करते
एजंट चूक दुरुस्त करतो, आणि RADAR चाचणी पुन्हा चालवते. ती उत्तीर्ण होते, म्हणून कार्य बंद होते, आणि नोंद पुरावा जपून ठेवते.
radar app · t-4821example
◇agentThe length check was not the bug: nothing compared the password with the stored hash.
·▸ Edit login_app/auth.py+2 −1
◆radarverifyt-4821·passed·judged by radar2 passed
┊
testrun by radar2 passed
a wrong password→refused
the right password→signed in
■t-4821closed·proof kept in the ledger
हे का महत्त्वाचे आहे
एजंट पूर्ण आत्मविश्वासाने चुकू शकतात. तपासणीशिवाय, चुकीचे “काम झाले” आपल्या उत्पादनापर्यंत आणि आपल्या ग्राहकांपर्यंत पोहोचते. RADAR सोबत, पुरावा सांगतो तेव्हा कार्य पूर्ण होते.
radar app · t-4821example
○youthe login accepts a wrong password; fix it
◆radartaskt-4821created
┊the test, written before any work:
┊
testwritten before the worknot run yet
…a wrong password→refused
…the right password→signed in
┊the working agent cannot change the test command
○youthe login accepts a wrong password; fix it
◆radartaskt-4821created·test written first
◇agentWorking in my own copy of the project.
·▸ Read login_app/auth.py13 lines
·▸ Grep wrong_password in tests/1 match
·▸ Edit login_app/auth.py+1 −1
┊leaseclaimed attempt1/3
◇agentWorking in my own copy of the project.
·▸ Read login_app/auth.py13 lines
·▸ Grep wrong_password in tests/1 match
·▸ Edit login_app/auth.py+1 −1
◇agentdone:wrong passwords are refused now
┊radar:claim, not result·it runs the test itself
◇agentdone:wrong passwords are refused now
┊radar:claim, not result·it runs the test itself
◆radarverifyt-4821·running the test itselfunder way
┊
testrun by radarrunning
a wrong password→…
the right password→…
◇agentdone:wrong passwords are refused now
◆radarverifyt-4821·1 failedexit 1
┊
testrun by radar1 failed · exit 1
a wrong password→signed inshould be refused
the right password→signed in
┊check_login("ada", "wrong password") returned True
┊t-4821reopened· failure attached · attempt 2/3
◇agentThe length check was not the bug: nothing compared the password with the stored hash.
·▸ Edit login_app/auth.py+2 −1
◆radarverifyt-4821·passed·judged by radar2 passed
┊
testrun by radar2 passed
a wrong password→refused
the right password→signed in
■t-4821closed·proof kept in the ledger
आकृती 2 · तेच उदाहरण, जवळून
नकाशा कक्ष
प्रत्येक एजंट, प्रत्येक कार्य, एकाच स्क्रीनवर.
ही RADAR ची मुख्य स्क्रीन आहे. तिचे पाच भाग खाली समजावून सांगितले आहेत.
radarनमुना डेटा120x36
1मोठे करण्यासाठी एखाद्या क्रमांकावर टॅप करा.
आकृती 3 · मुख्य स्क्रीन, नमुना डेटासह
01
वर उजवीकडे: CHART
नकाशा
प्रत्येक बेट एक संगणक आहे: आपला स्वतःचा, किंवा आपण चालवत असलेला सर्व्हर. तुटक रेषा म्हणजे त्यावर काम करणारे एजंट. उत्तर देणे थांबवलेल्या मशीनवर AGROUND अशी खूण होते आणि ते नकाशावरच राहते.
02
डावीकडे: LOG
नोंद
प्रत्येक कार्य त्याच्या स्थितीनुसार मोजले जाते: प्रतीक्षेत, सुरू असलेले, किंवा स्वतःच्या चाचणीची वाट पाहणारे. सर्व एजंटांसाठी एकच नोंद आहे, त्यामुळे त्यांच्यामध्ये काहीही हरवत नाही.
03
खाली डावीकडे: NEXT
आपली गरज असलेले
आपल्यापर्यंत फक्त तेच निर्णय पोहोचतात ज्यांसाठी माणसाची गरज आहे, आणि सोबत चालवायची पुढची कमांड. एका एजंटला तीन प्रयत्न मिळतात, मग दुसरा एजंट काम हाती घेतो; आणखी तीन प्रयत्नांनंतरही जमले नाही, तर कार्य इथे आपली वाट पाहते.
04
खाली डावीकडे: ARRIVALS
आधी तपासणी, मग समावेश
चाचणी उत्तीर्ण झाल्यानंतरच काम आपल्या प्रकल्पात सामील होते, आणि सामील झाल्यानंतर चाचणी आणखी एकदा चालते. पट्टे दाखवतात की प्रत्येक तासाला किती कार्ये सामील झाली.
05
खाली उजवीकडे: COMMANDS
कमांड आणि स्मृती
RADAR कमांडच्या एका छोट्या यादीतून चालते. त्यांपैकी एक स्मृतीमध्ये शोध घेते: शिकलेल्या गोष्टींच्या टिपा, ज्या RADAR पुढच्या एजंटने सुरुवात करण्यापूर्वी त्याच्यासमोर ठेवते. आपण त्या Obsidian मध्ये उघडू शकता.
Grit च्या स्वतःच्या कामातून
निरीक्षण, नियंत्रित तुलना नव्हे
Grit च्या स्वतःच्या कामात (20-28 सप्टेंबर 2026), एकच कोडिंग एजंट चालवणाऱ्या वर्करांनी १,६०८ वेळा एखादे कार्य पूर्ण झाल्याचे कळवले (१,४५७ कार्ये); Grit ने त्याच सर्व्हरवर स्वीकृती कमांड लगेच पुन्हा चालवल्या, तेव्हा त्यांपैकी ७४ अहवालांवर हे पुन्हा चालवणे अयशस्वी झाले (४.६%). फक्त दाव्याने कार्य बंद होत नाही.
१,६०८ अहवालांनी काम झाल्याचे सांगितले, म्हणून प्रत्येक अहवाल पूर्ण म्हणून मोजला जातो.चाचण्या पुन्हा चालवल्या: त्यांपैकी ७४ अहवाल अयशस्वी ठरले.
एक चौकोन: एखादे कार्य पूर्ण झाल्याचा एक अहवालGrit ने पुन्हा चालवल्यावर अयशस्वी
Grit ची अंतर्गत नोंदवही, 28 सप्टेंबर 2026 06:00 UTC चे स्नॅपशॉट
आवृत्त्या
व्यक्तींसाठी खुली आवृत्ती. कंपन्यांसाठीची आवृत्ती विकसित होत आहे.
सार्वजनिक प्रकाशनावेळी मुक्त स्रोत (Apache-2.0)
RADAR
वैयक्तिक डेव्हलपर्ससाठी, आपल्या स्वतःच्या संगणकावर.
नोंद, चाचण्या, स्मृती, आणि शेजारी शेजारी काम करणारे एजंट
Claude Code, Codex CLI, OMP आणि Hermes Agent चालवते
Python 3.12 किंवा नवीन आवृत्ती; खाते किंवा क्लाउड लागत नाही
RADAR लवकर प्रवेशात आहे. सामील होण्यासाठी संपर्क पानाद्वारे किंवा X अथवा Instagram वर आम्हाला लिहा. प्रवेश मिळाल्यावर आपल्या कोडिंग एजंटला रिपॉझिटरीची लिंक द्या आणि “हे इन्स्टॉल कर” असे सांगा. रिपॉझिटरीत एजंटसाठी लिहिलेल्या इन्स्टॉलच्या पायऱ्या आहेत: एजंट आपला संगणक तपासतो, कमी असलेले काहीही इन्स्टॉल करण्यापूर्वी आपल्याला विचारतो, RADAR सेट करतो आणि आपल्याला कळवतो.
RADAR माझ्या कोडिंग एजंटची जागा घेते का?
नाही. RADAR आपण आधीच वापरत असलेले एजंट चालवते आणि त्यांचे काम तपासते. काम अजूनही एजंटच करतात. RADAR त्यांना एक नोंद, टाळता न येणारी एक तपासणी, आणि एक स्मृती देते.
पूर्ण कशाला म्हणायचे?
RADAR ने कामाच्या नवीनतम आवृत्तीवर आपली चाचणी चालवली आणि ती उत्तीर्ण झाली की कार्य पूर्ण होते. एजंटचे स्वतःचे “काम झाले” हे दावा म्हणून नोंदवले जाते; चाचणी उत्तीर्ण होईपर्यंत RADAR कार्य बंद करत नाही. एखादी व्यक्ती हा नियम डावलू शकते, आणि तेही नोंदवले जाते.
ते कोणते एजंट चालवते?
Claude Code, Codex CLI, OMP आणि Hermes Agent. प्रत्येक एजंट प्रकल्पाच्या स्वतःच्या वेगळ्या प्रतीत काम करतो, आपल्या संगणकावर किंवा आपल्या स्वतःच्या Linux सर्व्हरवर.
RADAR हे Claude Code किंवा Codex पेक्षा चांगले आहे का?
ते त्यांची जागा घेत नाही, म्हणून त्यांच्याशी स्पर्धा करत नाही. RADAR त्यांना चालवते आणि ते जे देतात ते तपासते.
चाचणीच चुकीची असेल तर?
तर तपासणीही चुकीची ठरते. म्हणूनच चाचणी काम सुरू होण्यापूर्वी लिहिली जाते, जिथे एखादी व्यक्ती ती वाचू शकते, आणि तिच्यात नंतर होणारा प्रत्येक बदल नोंदवला जातो.
माझा कोड माझ्या संगणकाबाहेर जातो का?
RADAR मुळे नाही. त्याला खाते किंवा क्लाउड लागत नाही, आणि प्रत्येक बाह्य सेवा ऐच्छिक आहे आणि आपण सुरू करेपर्यंत बंद राहते. आपले एजंट मात्र आजच्यासारखेच आपापल्या पुरवठादारांशी संवाद साधत राहतात.
ते चालवायला किती खर्च येतो?
RADAR स्वतःचे कोणतेही बिल जोडत नाही. ते चालवत असलेले एजंट, आपण त्यांच्यात ज्या खात्यांनी साइन इन करता तीच खाती वापरत राहतात, जसे की Claude किंवा ChatGPT प्लॅन, त्या पुरवठादारांच्या अटी आणि वापर मर्यादांनुसार. आपण पुरवठादार आणि बजेट ठरवले तरच RADAR सशुल्क API वापरते.
कोड आपले एजंट लिहितात. काम खरोखर पूर्ण झाले आहे, याची खात्री RADAR करते.