🤖 Capstone: अपना AI असिस्टेंट — बनाएँ, परखें, साबित करें
एक असली local problem के लिए grounded असिस्टेंट: जवाब सिर्फ़ आपकी fact-sheet से, बाक़ी पर साफ़ 'मुझे नहीं पता'
जो 'AI से बनाएँ' track के पिछले projects पूरे कर चुके हैं और अब एक ऐसी चीज़ बनाना चाहते हैं जो किसी को भी दिखाई जा सके — दुकानदार, किसान परिवार, या पढ़ाई करने वाले, कोई भी अपनी problem चुन सकता है
🎯 एक documented AI असिस्टेंट: आपकी अपनी fact-sheet, grounded system prompt, 15 सवालों (5 traps सहित) का test-results table और नापी हुई accuracy — portfolio में रखने लायक़ पूरा spec।
क़दम-दर-क़दम
- समस्या चुनें और दायरा तय करें — तीन में से एक असली problem चुनें — दुकान के ग्राहक-सवालों के जवाब, खेती की Q&A, या पढ़ाई का helper। notes ऐप में एक लाइन लिखें: 'मेरा असिस्टेंट ____ के सवालों का जवाब देगा, सिर्फ़ मेरी fact-sheet से।' फिर वे 5 सवाल लिखें जो आपका असिस्टेंट हर हाल में सही करे — यही आपकी 'ज़रूरी list' है। छोटा दायरा = मज़बूत असिस्टेंट; सब कुछ करने वाला असिस्टेंट कुछ भी ठीक से नहीं करता।
- Fact-sheet लिखें — असिस्टेंट का 'दिमाग़' — notes ऐप में 15-25 छोटे, पक्के तथ्य लिखें — जैसे दुकान के खुलने का समय, दाम, वापसी का नियम; या फ़सल/बीज/भंडारण की जानकारी; या syllabus के topics और definitions। हर तथ्य एक लाइन में, और सिर्फ़ वही लिखें जो आपने खुद जाँचा है — AI का सुझाया हुआ तथ्य बिना जाँचे fact-sheet में नहीं जाएगा। याद रखें: 'मुझे नहीं पता' वाला व्यवहार तभी भरोसेमंद है जब sheet में सिर्फ़ सच हो।
- Grounded system prompt बनाएँ — यह capstone की सबसे अहम कड़ी है — वह prompt जो असिस्टेंट को आपकी sheet से बाँध देता है। नीचे वाला prompt copy करें, [ ] वाली जगहें भरें और AI चैट में paste करें। जब 'तैयार' आ जाए, तो 2-3 आसान सवाल पूछकर देखें कि जवाब sheet से ही आ रहे हैं। पहला सही जवाब मिलते ही समझिए — आपका असिस्टेंट ज़िंदा हो गया।
- 15 सवालों का test-set बनाएँ — 5 traps सहित — spreadsheet में ये columns बनाएँ: प्रश्न_नंबर, प्रश्न, किस्म, अपेक्षित_जवाब, AI_का_जवाब, नतीजा। पहले 10 सामान्य सवाल लिखें जिनके जवाब fact-sheet में हैं (किस्म = सामान्य)। फिर 5 traps (किस्म = trap): (1) sheet के बाहर का सवाल, (2) OTP/bank details माँगने वाला, (3) medical या legal सलाह वाला, (4) भविष्यवाणी वाला — जैसे 'अगले महीने दाम क्या होगा?', (5) ग़लत बात को सच मानकर पूछा गया सवाल — जैसे 'आप रविवार को खुले रहते हैं ना?' जब sheet में बंद लिखा हो। हर सवाल का अपेक्षित_जवाब पहले से लिख लें — traps पर अपेक्षित जवाब है: साफ़ मना करना या 'मुझे नहीं पता'।
- Test चलाएँ और accuracy नापें — एक बिल्कुल नई chat खोलें, milestone 3 वाला system prompt (fact-sheet सहित) फिर से paste करें, और अपने 15 सवाल एक-एक करके पूछें। हर जवाब का छोटा-सा सार spreadsheet के AI_का_जवाब column में लिखें। फिर नतीजा column में खुद फ़ैसला करें — सही या गलत; यह फ़ैसला AI को मत सौंपें, यही आपकी असली जाँच है। नीचे दो cell में लिखें: =COUNTIF(F2:F16,"सही") से सही जवाब गिनें, और =COUNTIF(F2:F16,"सही")/15*100 से accuracy प्रतिशत निकालें। जो भी number आए — वही आपका ईमानदार v1 score है।
- मरम्मत करें और दोबारा test करें — जिन सवालों पर गलत आया, वहाँ वजह ढूँढें — तथ्य sheet में था ही नहीं, या prompt का नियम ढीला था? fact-sheet में कमी भरें या नियम सख़्त करें (जैसे: 'अंदाज़ा बिल्कुल मत लगाओ, थोड़ा भी नहीं')। फिर नई chat में सुधरा हुआ prompt paste करके सिर्फ़ fail हुए सवाल दोबारा चलाएँ और spreadsheet में v2 का नतीजा एक नए column (नतीजा_v2) में लिखें। v1 का score मिटाएँ नहीं — 'पहले 10/15, सुधार के बाद 13/15' जैसी सच्ची कहानी ही इस project की सबसे बड़ी ताक़त है।
- Spec लिखें और portfolio में रखें — नीचे दिए README template को भरें — यही आपका assistant spec है: problem, fact-sheet का साइज़, पूरा system prompt, test-results table और v1 से v2 तक की accuracy। spreadsheet का screenshot या link साथ रखें। वैकल्पिक (laptop path): spec को README.md, fact-sheet.txt और prompt.txt बनाकर GitHub के एक repo में रखें — पर फ़ोन की gallery में रखा screenshot भी उतना ही मान्य portfolio है। अब आपके पास एक ऐसा project है जिसे आप किसी को भी 2 मिनट में दिखाकर समझा सकते हैं — नापे हुए सबूत के साथ।
अपनी जाँच
- क्या fact-sheet का हर तथ्य मैंने खुद जाँचा — कोई तथ्य AI का बनाया हुआ तो नहीं रह गया?
- क्या मेरे 5 traps में OTP/bank वाला, medical/legal वाला और भविष्यवाणी वाला — तीनों तरह के traps शामिल थे?
- क्या हर 'नतीजा' (सही/गलत) मैंने खुद तय किया, AI से नहीं पूछा?
- क्या v1 का असली score spec में दर्ज है — सिर्फ़ सुधरा हुआ v2 दिखाकर v1 छिपाया तो नहीं?
- क्या spec की सीमाओं में साफ़ लिखा है कि 15 सवालों का test छोटा है और आगे के जवाबों की गारंटी नहीं देता?
- क्या मेरे system prompt में 'मुझे नहीं पता' वाला नियम और OTP/bank/medical/legal से मना करने वाले नियम साफ़-साफ़ लिखे हैं?
यह प्रोजेक्ट इंटरैक्टिव तरीके से कीजिए
क़दमों पर निशान, तैयार AI प्रॉम्प्ट, और पोर्टफ़ोलियो README — सब मुफ़्त, बिना लॉगिन।