AI क्या लिख सकता है और क्या नहीं
यहाँ किसी सार्वजनिक आँकड़ों के पेज के ऊपर दो या तीन वाक्य हो सकते हैं, जो बताते हैं कि काउंटर ने इस महीने क्या किया। उन्हें एक भाषा मॉडल लिखता है। मॉडल कुछ भी गढ़ता नहीं, और जो व्यवस्था इसे सच बनाती है, वह बताने लायक है, क्योंकि इस सुविधा को बनाने के स्पष्ट तरीके में यह गुण नहीं होता।
सर्वर SQL चलाता है, तय करता है कि कौन-सा आँकड़ा बताने लायक है, और प्रॉम्प्ट लिखता है। मॉडल एक तथ्य को माँगी गई भाषा में एक वाक्य में बदलता है। फिर सर्वर जवाब को वापस पढ़ता है, और अगर उसमें कोई अंक प्रॉम्प्ट से नहीं आया, तो उसे फेंक देता है।
इसलिए मॉडल की एकमात्र आज़ादी शब्दों के चुनाव की है। वह यह नहीं चुनता कि क्या दिलचस्प है, वह गणना नहीं करता, वह राउंड नहीं करता। वह जो देता है, वह ऐसा कुछ है जो टेम्पलेट नहीं कर सकते: ग्यारह भाषाएँ, जो असली भाषा जैसी पढ़ी जाती हैं।
तीन जाँचें, और हर एक किस गलती के लिए है
इनमें से कोई भी सिर्फ़ एहतियात के तौर पर नहीं लिखी गई। हर एक इसलिए है, क्योंकि 17 अगस्त 2026 को कुछ खास गलत हुआ। एक छोटे मॉडल को एक काउंटर के बारे में दो तथ्य दिए गए — हफ़्ते का सबसे मज़बूत दिन सोमवार, 46% के साथ, और 5 देशों में से 76% विज़िटर पोलैंड से — और उसने एक वाक्य बनाया, जिसमें कहा गया कि बुधवार सबसे मज़बूत था और 46% विज़िटर पोलैंड से आए।
एक ही वाक्य में दो अलग गलतियाँ, और इनमें से कोई भी मनगढ़ंत संख्या नहीं है।
- हर अंक प्रॉम्प्ट में होना चाहिए। इससे गढ़े हुए आँकड़े पकड़े जाते हैं। इसका एक नतीजा है, जिसे बाद में गलत समझना आसान है: प्रॉम्प्ट के निर्देश वाले हिस्से में एक भी अंक नहीं होता। उसमें “एक या दो वाक्य” लिखा होता है, कभी “1-2” नहीं, क्योंकि वरना 1 और 2 जवाब में अनुमत संख्याएँ बन जाते।
- हर तथ्य के लिए एक प्रॉम्प्ट। इससे आपस में बदले गए आँकड़े पकड़े जाते हैं। ऊपर वाला 46 असली था — वह बस दूसरे तथ्य का था, और संख्याओं के सेट पर की गई जाँच इसे नहीं देख सकती। अगर मॉडल को हमेशा सिर्फ़ एक तथ्य दिखे, तो अदला-बदली के लिए कुछ बचता ही नहीं।
- नाम भी जाँचे जाते हैं। इससे “सोमवार” का “बुधवार” बन जाना पकड़ा जाता है। नाम तथ्य में लक्ष्य भाषा में होता है, उसे जवाब में ज्यों का त्यों आना चाहिए, और उसके जैसे दूसरे नाम नहीं आने चाहिए।
ये क्या नहीं पकड़तीं
यह बात बाकी बातों के साथ ही कही जानी चाहिए। दो चीज़ें इनसे निकल जाती हैं।
ऐसा वाक्य, जो अंकों का इस्तेमाल किए बिना कुछ गलत कहता है — जब यह 46% था, तब “ज़्यादातर विज़िटर” — तीनों में से किसी भी जाँच में नहीं पकड़ा जाता। इसे डिज़ाइन ही संभाल लेता है: फ़ैसला पहले से उस तथ्य में है जिसे सर्वर ने चुना, मॉडल की आज़ादी में नहीं।
और ऐसा वाक्य भी निकल जाता है जो अपने तथ्य से अलग विषय के बारे में हो, बशर्ते अंक मेल खाते हों। इसके खिलाफ़ सिर्फ़ एक ऐसा मॉडल है जो निर्देश मानता है। जिन विशेषताओं का कोई नाम होता है — हफ़्ते का दिन, डिवाइस, रोबोट, पेज — उनके लिए तीसरी जाँच इसे भी संभाल लेती है।
जो जाँच सिर्फ़ गढ़ी हुई संख्याएँ पकड़ती, वह ऊपर वाले वाक्य को बिना बदले पास कर देती। उसमें असली संख्याएँ गलत जगहों पर थीं, और यह गलती की ऐसी किस्म है जो सिर्फ़ आउटपुट में दिखती है, विचार में कभी नहीं।