RADAR اے آئی کوڈنگ ایجنٹس، جیسے Claude Code اور Codex، کو چلاتی ہے۔ ہر کام کے لیے، کام شروع ہونے سے پہلے، ایک ٹیسٹ لکھا جاتا ہے؛ کام صرف تب مکمل مانا جاتا ہے جب RADAR وہ ٹیسٹ خود چلائے اور وہ پاس ہو جائے۔
اے آئی ایجنٹ ایک پروگرام ہے جو آپ کے لیے سافٹ ویئر لکھتا اور بدلتا ہے۔ یہ تیزی سے کام کرتا ہے، اور جب کام ختم کرتا ہے تو بتا دیتا ہے۔ RADAR جانچتی ہے کہ اس نے واقعی ختم کیا یا نہیں۔
اے آئی ایجنٹ
ایک پروگرام جو سافٹ ویئر کا کام خود کرتا ہے، جیسے کسی خرابی کو ٹھیک کرنا۔ Claude Code اور Codex CLI ان میں سے دو ہیں۔
ٹیسٹ
ایک چھوٹی اور قطعی جانچ جو ثابت کرتی ہے کہ کام صحیح ہے، اور کام شروع ہونے سے پہلے لکھی جاتی ہے۔ انجینئر اسے قبولیتی ٹیسٹ کہتے ہیں۔
ریکارڈ
وہ جگہ جہاں ہر کام درج ہوتا ہے: کام کس نے لیا، اس نے کیا دعویٰ کیا، اور ٹیسٹ نے کیا دکھایا۔ RADAR اسے لیجر (ledger) کہتی ہے۔
1
ٹیسٹ پہلے لکھا جاتا ہے
کسی کے شروع کرنے سے پہلے کام کا ٹیسٹ لکھا جاتا ہے: غلط پاس ورڈ رد ہونا چاہیے، اور درست پاس ورڈ سے آپ کو اندر جانے دینا چاہیے۔
radar app · t-4821example
○youthe login accepts a wrong password; fix it
◆radartaskt-4821created
┊the test, written before any work:
┊
testwritten before the worknot run yet
…a wrong password→refused
…the right password→signed in
┊the working agent cannot change the test command
2
ایک ایجنٹ کام کرتا ہے
RADAR یہ کام ایک اے آئی ایجنٹ کے سپرد کرتی ہے۔ ایجنٹ پروجیکٹ کی اپنی الگ نقل میں کام کرتا ہے، اس لیے کسی اور چیز کو ہاتھ نہیں لگتا۔
radar app · t-4821example
○youthe login accepts a wrong password; fix it
◆radartaskt-4821created·test written first
◇agentWorking in my own copy of the project.
·▸ Read login_app/auth.py13 lines
·▸ Grep wrong_password in tests/1 match
·▸ Edit login_app/auth.py+1 −1
┊leaseclaimed attempt1/3
3
ایجنٹ کہتا ہے کام ہو گیا
ایجنٹ بتاتا ہے: کام ہو گیا۔ RADAR اسے نتیجے کے طور پر نہیں، بلکہ ایک دعوے کے طور پر درج کرتی ہے۔
radar app · t-4821example
◇agentWorking in my own copy of the project.
·▸ Read login_app/auth.py13 lines
·▸ Grep wrong_password in tests/1 match
·▸ Edit login_app/auth.py+1 −1
◇agentdone:wrong passwords are refused now
┊radar:claim, not result·it runs the test itself
4
RADAR ٹیسٹ خود چلاتی ہے
RADAR ایجنٹ کی بات پر بھروسا کیے بغیر، کام کے تازہ ترین ورژن پر ٹیسٹ خود چلاتی ہے۔
radar app · t-4821example
◇agentdone:wrong passwords are refused now
┊radar:claim, not result·it runs the test itself
◆radarverifyt-4821·running the test itselfunder way
┊
testrun by radarrunning
a wrong password→…
the right password→…
5
ناکامی پر کام دوبارہ کھل جاتا ہے
یہاں غلط پاس ورڈ اب بھی آپ کو اندر جانے دیتا ہے۔ کام ناکامی کی تفصیل کے ساتھ دوبارہ کھل جاتا ہے، اور ایجنٹ پھر کوشش کرتا ہے۔ تین کوششوں کے بعد کوئی دوسرا ایجنٹ کام سنبھال لیتا ہے؛ مزید تین کوششوں کے بعد کام آپ کا انتظار کرتا ہے۔
radar app · t-4821example
◇agentdone:wrong passwords are refused now
◆radarverifyt-4821·1 failedexit 1
┊
testrun by radar1 failed · exit 1
a wrong password→signed inshould be refused
the right password→signed in
┊check_login("ada", "wrong password") returned True
┊t-4821reopened· failure attached · attempt 2/3
6
کامیاب ٹیسٹ کام کو بند کرتا ہے
ایجنٹ اسے ٹھیک کرتا ہے، اور RADAR ٹیسٹ دوبارہ چلاتی ہے۔ ٹیسٹ کامیاب ہوتا ہے، اس لیے کام بند ہو جاتا ہے، اور ریکارڈ ثبوت محفوظ رکھتا ہے۔
radar app · t-4821example
◇agentThe length check was not the bug: nothing compared the password with the stored hash.
·▸ Edit login_app/auth.py+2 −1
◆radarverifyt-4821·passed·judged by radar2 passed
┊
testrun by radar2 passed
a wrong password→refused
the right password→signed in
■t-4821closed·proof kept in the ledger
یہ کیوں اہم ہے
ایجنٹ پورے اعتماد کے ساتھ غلط ہو سکتے ہیں۔ جانچ کے بغیر ایک غلط “ہو گیا” آپ کی پروڈکٹ اور آپ کے گاہکوں تک پہنچ جاتا ہے۔ RADAR کے ساتھ کوئی کام تب مکمل ہوتا ہے جب ثبوت یہ کہے۔
radar app · t-4821example
○youthe login accepts a wrong password; fix it
◆radartaskt-4821created
┊the test, written before any work:
┊
testwritten before the worknot run yet
…a wrong password→refused
…the right password→signed in
┊the working agent cannot change the test command
○youthe login accepts a wrong password; fix it
◆radartaskt-4821created·test written first
◇agentWorking in my own copy of the project.
·▸ Read login_app/auth.py13 lines
·▸ Grep wrong_password in tests/1 match
·▸ Edit login_app/auth.py+1 −1
┊leaseclaimed attempt1/3
◇agentWorking in my own copy of the project.
·▸ Read login_app/auth.py13 lines
·▸ Grep wrong_password in tests/1 match
·▸ Edit login_app/auth.py+1 −1
◇agentdone:wrong passwords are refused now
┊radar:claim, not result·it runs the test itself
◇agentdone:wrong passwords are refused now
┊radar:claim, not result·it runs the test itself
◆radarverifyt-4821·running the test itselfunder way
┊
testrun by radarrunning
a wrong password→…
the right password→…
◇agentdone:wrong passwords are refused now
◆radarverifyt-4821·1 failedexit 1
┊
testrun by radar1 failed · exit 1
a wrong password→signed inshould be refused
the right password→signed in
┊check_login("ada", "wrong password") returned True
┊t-4821reopened· failure attached · attempt 2/3
◇agentThe length check was not the bug: nothing compared the password with the stored hash.
·▸ Edit login_app/auth.py+2 −1
◆radarverifyt-4821·passed·judged by radar2 passed
┊
testrun by radar2 passed
a wrong password→refused
the right password→signed in
■t-4821closed·proof kept in the ledger
شکل 2 · وہی مثال، قریب سے
نقشہ خانہ
ہر ایجنٹ، ہر کام، ایک ہی اسکرین پر۔
یہ RADAR کی مرکزی اسکرین ہے۔ اس کے پانچ حصے نیچے بیان کیے گئے ہیں۔
radarنمونہ ڈیٹا120x36
1زوم کرنے کے لیے کسی نمبر کو ٹیپ کریں۔
شکل 3 · مرکزی اسکرین، نمونے کے ڈیٹا کے ساتھ
01
اوپر دائیں: CHART
نقشہ
ہر جزیرہ ایک کمپیوٹر ہے: آپ کا اپنا، یا کوئی سرور جو آپ چلاتے ہیں۔ ڈیش والی لکیریں وہ ایجنٹس ہیں جو اس پر کام کر رہے ہیں۔ جو مشین جواب دینا بند کر دے اس پر AGROUND کا نشان لگ جاتا ہے اور وہ نقشے پر ہی رہتی ہے۔
02
بائیں: LOG
ریکارڈ
ہر کام کو اس کی حالت کے لحاظ سے گنا جاتا ہے: انتظار میں، جاری، یا اپنے ٹیسٹ کے انتظار میں۔ تمام ایجنٹس ایک ہی ریکارڈ میں شریک ہیں، اس لیے ان کے درمیان کچھ ضائع نہیں ہوتا۔
03
نیچے بائیں: NEXT
آپ کی ضرورت ہے
آپ تک صرف وہ فیصلے پہنچتے ہیں جن کے لیے کسی انسان کی ضرورت ہو، اور ساتھ اگلی کمانڈ بھی جو چلانی ہے۔ ایک ایجنٹ کو تین کوششیں ملتی ہیں، پھر کوئی دوسرا ایجنٹ کام سنبھال لیتا ہے؛ مزید تین کوششوں کے بعد کام یہاں آپ کا انتظار کرتا ہے۔
04
نیچے بائیں: ARRIVALS
پہلے جانچ، پھر شمولیت
کام آپ کے پروجیکٹ میں صرف اس وقت شامل ہوتا ہے جب اس کا ٹیسٹ کامیاب ہو جائے، اور شامل ہونے کے بعد ٹیسٹ ایک بار پھر چلتا ہے۔ پٹیاں دکھاتی ہیں کہ ہر گھنٹے میں کتنے کام شامل ہوئے۔
05
نیچے دائیں: COMMANDS
کمانڈز اور یادداشت
RADAR کو کمانڈز کی ایک مختصر فہرست سے چلایا جاتا ہے۔ ان میں سے ایک یادداشت میں تلاش کرتی ہے: سیکھے ہوئے اسباق کے نوٹس، جو RADAR اگلے ایجنٹ کے کام شروع کرنے سے پہلے اس کے سامنے رکھتی ہے۔ آپ انہیں Obsidian میں کھول سکتے ہیں۔
Grit کے اپنے کام سے
مشاہدہ، کنٹرول شدہ موازنہ نہیں
Grit کے اپنے کام میں (20 تا 28 ستمبر 2026)، ایک ہی کوڈنگ ایجنٹ چلانے والے ورکر پراسیسز نے 1,608 بار کسی کام کو مکمل بتایا (1,457 کام)؛ Grit نے اسی سرور پر قبولیتی کمانڈز فوراً دوبارہ چلائیں، اور ان میں سے 74 رپورٹس پر وہ ناکام رہیں (4.6%)۔ صرف دعوے سے کوئی کام بند نہیں ہوتا۔
1,608 رپورٹس نے کہا کہ کام ہو گیا، اس لیے ہر ایک کو مکمل مانا جاتا ہے۔ٹیسٹ دوبارہ چلائے گئے: ان میں سے 74 رپورٹس ناکام رہیں۔
ایک خانہ: کسی کام کے مکمل ہونے کی ایک رپورٹGrit کا دوبارہ چلانا ناکام رہا
Grit کا اندرونی لیجر، 28 ستمبر 2026، 06:00 UTC کا اسنیپ شاٹ
ایڈیشنز
افراد کے لیے ایک اوپن ایڈیشن۔ کمپنیوں کے لیے ایک ایڈیشن تیاری کے مرحلے میں۔
عوامی اجرا پر اوپن سورس (Apache-2.0)
RADAR
انفرادی ڈویلپرز کے لیے، آپ کے اپنے کمپیوٹر پر۔
ریکارڈ، ٹیسٹ، یادداشت، اور متوازی طور پر کام کرتے ایجنٹس
Claude Code، Codex CLI، OMP اور Hermes Agent چلاتی ہے
Python 3.12 یا اس سے نیا ورژن؛ نہ اکاؤنٹ درکار ہے، نہ کلاؤڈ
RADAR ابتدائی رسائی میں ہے۔ شامل ہونے کے لیے ہمیں رابطے کے صفحے کے ذریعے، یا X یا Instagram پر لکھیں۔ رسائی ملنے کے بعد آپ اپنے کوڈنگ ایجنٹ کو ریپوزٹری کا لنک دیتے ہیں اور کہتے ہیں “اسے انسٹال کرو”۔ ریپوزٹری میں ایجنٹس کے لیے لکھے گئے انسٹال کے مراحل موجود ہیں: ایجنٹ آپ کے کمپیوٹر کی جانچ کرتا ہے، جو چیز موجود نہ ہو اسے انسٹال کرنے سے پہلے آپ سے پوچھتا ہے، RADAR سیٹ اپ کرتا ہے اور آپ کو نتیجہ بتاتا ہے۔
کیا RADAR میرے کوڈنگ ایجنٹ کی جگہ لے لیتی ہے؟
نہیں۔ RADAR انہی ایجنٹس کو چلاتی ہے جو آپ پہلے سے استعمال کرتے ہیں، اور ان کے کام کی جانچ کرتی ہے۔ کام اب بھی ایجنٹس ہی کرتے ہیں۔ RADAR انہیں ایک ریکارڈ، ایک ایسی جانچ جسے وہ چھوڑ نہیں سکتے، اور ایک یادداشت دیتی ہے۔
کام کو مکمل کب مانا جاتا ہے؟
کام تب مکمل ہوتا ہے جب RADAR نے اس کا ٹیسٹ کام کے تازہ ترین ورژن پر چلایا ہو اور ٹیسٹ کامیاب ہو گیا ہو۔ ایجنٹ کا اپنا “ہو گیا” ایک دعوے کے طور پر درج ہوتا ہے؛ جب تک ٹیسٹ کامیاب نہ ہو RADAR کام بند نہیں کرے گی۔ کوئی انسان اس فیصلے کو رد کر سکتا ہے، اور یہ رد کرنا بھی درج ہوتا ہے۔
یہ کون سے ایجنٹس چلاتی ہے؟
Claude Code، Codex CLI، OMP اور Hermes Agent۔ ہر ایک پروجیکٹ کی اپنی الگ نقل میں کام کرتا ہے، آپ کے کمپیوٹر پر یا آپ کے اپنے Linux سرورز پر۔
کیا Claude Code یا Codex کے مقابلے میں RADAR بہتر ہے؟
یہ ان کا متبادل نہیں، اس لیے ان سے مقابلہ نہیں کرتی۔ RADAR انہیں چلاتی ہے اور ان کے فراہم کردہ کام کی جانچ کرتی ہے۔
اگر ٹیسٹ خود ہی غلط ہو تو؟
تب جانچ بھی غلط ہے۔ اسی لیے ٹیسٹ کام شروع ہونے سے پہلے لکھا جاتا ہے، جہاں کوئی انسان اسے پڑھ سکے، اور بعد میں اس میں ہونے والی ہر تبدیلی درج ہوتی ہے۔
کیا میرا کوڈ میرے کمپیوٹر سے باہر جاتا ہے؟
RADAR کی وجہ سے نہیں۔ اسے نہ کسی اکاؤنٹ کی ضرورت ہے نہ کلاؤڈ کی، اور ہر بیرونی سروس اختیاری ہے اور تب تک بند رہتی ہے جب تک آپ اسے آن نہ کریں۔ آپ کے ایجنٹس اب بھی اپنے فراہم کنندگان سے بات کرتے ہیں، جیسے آج کرتے ہیں۔
اسے چلانے پر کتنا خرچ آتا ہے؟
RADAR اپنی طرف سے کوئی الگ بل نہیں لگاتی۔ جن ایجنٹس کو یہ چلاتی ہے، وہ انہی اکاؤنٹس کو استعمال کرتے رہتے ہیں جن سے آپ نے انہیں سائن اِن کیا ہو، جیسے Claude یا ChatGPT کا کوئی پلان، اور ان فراہم کنندگان کی شرائط اور استعمال کی حدود کے تحت۔ RADAR کوئی بامعاوضہ API صرف تب استعمال کرتی ہے جب آپ خود فراہم کنندہ اور بجٹ طے کریں۔
کوڈ آپ کے ایجنٹس لکھتے ہیں۔ کام واقعی مکمل ہو گیا ہے، یہ RADAR یقینی بناتی ہے۔