hrxdev
हिन्दी

कैसे बन रहा है

एक डेवलपर, एक AI कोडिंग असिस्टेंट, और मशीन से जाँचे जाने वाले ढेर सारे नियम।

लेखक: Nick

Prison Life मैं Claude Code (Anthropic का कोडिंग एजेंट) के साथ मिलकर लिखता हूँ। गेम क्या है और हम कौन-से रास्ते चुनेंगे, यह मैं तय करता हूँ; ज़्यादातर टाइपिंग असिस्टेंट करता है। क्योंकि कोड की समीक्षा मेरे और एक समीक्षक AI एजेंट के सिवा कोई नहीं करता, मैं ऑटोमेशन पर भरोसा करता हूँ: नियम अच्छे इरादों से नहीं, ऑटोमेटिक जाँचों और बिल्ड से लागू होते हैं।

काम सौंपना

मुख्य Claude Code सेशन काम की योजना बनाता है और टास्क ट्रैकर, डिज़ाइन फ़ैसलों का लिखित रिकॉर्ड और बदलावों का इतिहास सँभालता है। वह कोड नहीं लिखता: हर बदलाव, चाहे कितना भी छोटा हो, एक ख़ास AI एजेंट को सौंपता है। हर एजेंट की अपनी लिखित परिभाषा है जो उसकी भूमिका और मॉडल तय करती है।

भूमिकामॉडल स्तरकाम
आर्किटेक्चरOpusडेटा मॉडल, टिक, थ्रेड, पाथफ़ाइंडिंग, फ़ैसले
सिमुलेशन कोडOpusसिमुलेशन सिस्टम, किरदारों का AI, हॉट लूप
परफ़ॉर्मेंसOpusप्रोफ़ाइलिंग, बेंचमार्क रिग्रेशन
समीक्षा (सिर्फ़ पढ़ना)Opusdiff की समीक्षा; फ़ाइलें नहीं बदल सकता
क्लाइंट और टूलSonnetGodot क्लाइंट, UI, टूल
टेस्टSonnetस्वीकृति मानदंडों से टेस्ट
कंटेंट डेटाSonnetस्कीमा से JSON परिभाषाएँ
खोज, जाँचें चलानाHaikuकोड खोजना; जाँचें चलाना और विफलताओं का सार

कठिन काम सबसे ताक़तवर मॉडल को जाता है, रोज़मर्रा का काम सस्ते मॉडलों को। अगर कोई सस्ता AI एजेंट दो बार जाँचों में फ़ेल हो, तो काम एक स्तर ऊपर जाता है; अगर सबसे ऊपर का स्तर दो बार फ़ेल हो, तो वह रुककर मुझसे पूछता है।

मना करने वाले हुक

Claude Code के हुक ऐसी स्क्रिप्ट हैं जो असिस्टेंट की क्रियाओं के आसपास चलती हैं। मेरे हुक तीन नियम लागू करते हैं:

ये ग़लतियों से बचाते हैं, जानबूझकर किए गए बाईपास से नहीं: कोई ज़िद्दी शेल तरकीब इन्हें पार कर सकती है, और एक हुक किसी AI एजेंट में लाल जाँच देख तो लेता है पर उसे रोक नहीं पाता (मुख्य सेशन का स्टॉप हुक फिर भी उसे पकड़ लेता है)। मैं यह साफ़ कहना पसंद करूँगा।

लिखित फ़ैसले और जाँचें

डिटरमिनिस्टिक कोर

सिमुलेशन एक सादी .NET लाइब्रेरी में रहता है जिसमें Godot का कोई रेफ़रेंस नहीं; Godot क्लाइंट सिर्फ़ उसकी स्थिति पढ़ता है और कमांड भेजता है। कोर तय नियमों पर चलता है: दुनिया सिर्फ़ कमांड से बदलती है, समय पूर्णांक टिक है, रैंडमनेस सिर्फ़ दुनिया के सीड वाले जनरेटरों से आती है। एक ही सीड और एक ही कमांड लॉग से एक ही दुनिया बननी चाहिए। इन नियमों की जाँच सिर्फ़ समीक्षा से नहीं, कंपाइलर और टेस्ट से होती है; कैसे, यह डेवलॉग #1 में है, और दुनिया, सेव व रीप्ले के लिए डेवलॉग #2 देखें।

सिमुलेशन कोर का आर्किटेक्चरकमांड एक कतार में आते हैं। हर टिक चरण 0 (कमांड, जो कमांड लॉग में लिखे जाते हैं), चरण 1 (तय क्रम में सिस्टम) और चरण 2 (टिक का अंत) चलाता है। कमांड लॉग और दुनिया की स्थिति, अपने टाइल नक़्शे और सीड वाली रैंडम स्ट्रीम के साथ, स्टेट हैश में जाते हैं। आने वाले कमांड खिलाड़ी, टेस्ट, सिनेरियो कमांड कतार कतार में जोड़ना थ्रेड-सेफ़ है टिक T (एक थ्रेड, पूर्णांक समय) चरण 0: कमांड सीरियलाइज़, मुहर (टिक, क्रम) Validate, लॉग में लिखें, Apply अस्वीकार कमांड भी लॉग होते हैं चरण 1: सिस्टम कोड में तय क्रम से चलते हैं (अभी कोई दर्ज नहीं) चरण 2: टिक का अंत ढाँचागत बदलाव (अभी इस्तेमाल नहीं) फिर टिक काउंटर + 1 कमांड लॉग हर कमांड, उसके नतीजे के साथ बाइट्स + सार रीप्ले = सीड + लॉग दुनिया की स्थिति सीड, टिक टाइल नक़्शा (स्तर) सीड से 4 RNG स्ट्रीम: Commands, Needs, Ai, Events स्टेट हैश सीड, टिक, नक़्शा, RNG स्ट्रीम, लॉग का सार
सिमुलेशन कोर, जैसा वह आज है। अभी न सिस्टम हैं न किरदार; दुनिया में स्तरों वाला टाइल नक़्शा है, और हैश नक़्शे को भी कवर करता है और जो बनाया गया है उसे भी।

डिज़ाइन का लक्ष्य 20 टिक प्रति सेकंड पर 1,000 तक क़ैदी और स्टाफ़ है। यह एक लक्ष्य है: अभी किरदार नहीं हैं, इसलिए बेंचमार्क रनर मौजूद है लेकिन उस पैमाने पर अभी कुछ मापा नहीं गया।