हैलुसिनेटेड-साइटेशन ऑडिट: सबमिशन से पहले की जाँच
हैलुसिनेटेड उद्धरणों का ऑडिट, नकली AI-संदर्भों को सबमिशन से पहले पकड़ लेता है। 1-in-277 का PubMed-दर, चार-डेटाबेस वर्कफ़्लो, और उन्हें फ्लैग करने वाले निःशुल्क टूल, ये सब इसे संभव बनाते हैं।
सबमिशन से पहले किया जाने वाला हैलुसिनेटेड-उद्धरण ऑडिट अब एक साफ़ तकनीकी जाँच और शोध-सत्यनिष्ठा संबंधी आपत्ति के बीच का अंतर बन चुका है, और यह क्यों मायने रखता है, इसका उत्तर अब आँकड़ों में मौजूद है। Columbia की एक टीम ने, जिसका नेतृत्व Maxim Topaz कर रहे थे, PubMed Central में अनुक्रमित 25 लाख जैव-चिकित्सा शोधपत्रों का ऑडिट किया और वही पाया जिसकी हम सबको दबी आशंका थी। समीक्षित जैव-चिकित्सा साहित्य में नकली संदर्भों की संख्या ठीक उसी समय तेज़ी से बढ़ी, जब जनरेटिव AI उपकरण औसत शोधकर्ता की लेखन-प्रक्रिया का हिस्सा बने। 2026 के पहले सात सप्ताहों में प्रकाशित हर 277 शोधपत्रों में से एक ऐसा है, जिसमें कम से कम एक ऐसा संदर्भ है जो PubMed, Crossref, OpenAlex या Google Scholar में कहीं नहीं मिलता। दो वर्ष पहले यह अनुपात 2,828 में एक था। यानी साहित्य में घुसते नकली संदर्भों की दर में 12 गुना वृद्धि, और सबसे तीखा उछाल ठीक समय पर, 2024 के मध्य से शुरू।
Topaz ऑडिट हमारे पास मौजूद सबसे स्पष्ट आँकड़ा है, पर अकेला नहीं है। ArXiv ने घोषणा की कि जो लेखक स्पष्ट AI-जनित त्रुटियों वाले शोधपत्र, जिनमें हैलुसिनेटेड उद्धरण भी शामिल हैं, जमा करेंगे, उन पर एक वर्ष का सबमिशन प्रतिबंध लगेगा। GPTZero ने NeurIPS 2025 के 4,841 स्वीकृत शोधपत्रों का विश्लेषण किया और 53 शोधपत्रों में कम से कम 100 पुष्ट हैलुसिनेटेड उद्धरण पाए, जबकि हर शोधपत्र तीन से पाँच विशेषज्ञ समीक्षकों से गुज़र चुका था। Deakin University के एक अध्ययन में GPT-4o से बनवाए गए संदर्भों में 56 प्रतिशत या तो नकली निकले या त्रुटियों से भरे, और नकली संदर्भों में से 64 प्रतिशत के साथ ऐसा DOI जुड़ा था जो किसी वास्तविक किंतु असंबंधित शोधपत्र तक ले जाता था, यानी वह किस्म जिसे पकड़ना सबसे कठिन है।
अच्छी बात यह है कि सबमिशन-पूर्व हैलुसिनेटेड-उद्धरण ऑडिट, संदर्भ-सूची के आकार के अनुसार, 20 मिनट से दो घंटे के बीच पूरा हो जाता है, और यह इन त्रुटियों में से लगभग सभी को संपादक या समीक्षक की नज़र में आने से पहले पकड़ लेता है। यह पोस्ट स्वयं वही ऑडिट है। हम बताएँगे कि 2026 में हैलुसिनेटेड उद्धरण वास्तव में कैसे दिखते हैं, चार-डेटाबेस सत्यापन कार्यप्रवाह क्या है, सबमिशन-पूर्व चरण-दर-चरण जाँच-सूची कैसी है, कौन से उपकरण यह काम स्वचालित करते हैं, और यदि पहले से समीक्षाधीन पांडुलिपि में ऐसा उद्धरण मिल जाए तो क्या करें।
हैलुसिनेटेड-उद्धरण ऑडिट क्या है?
हैलुसिनेटेड-उद्धरण ऑडिट एक सबमिशन-पूर्व जाँच है जो आपकी पांडुलिपि के हर संदर्भ को PubMed, Crossref, OpenAlex और Google Scholar से मिलाकर परखती है, ताकि गढ़े हुए या बेमेल उद्धरण संपादक या समीक्षक तक पहुँचने से पहले पकड़े जा सकें। संदर्भ-सूची के आकार के अनुसार इसमें 20 मिनट से दो घंटे लगते हैं, और यह लगभग सारी ऐसी त्रुटियाँ पकड़ लेती है। यह इसलिए महत्वपूर्ण है क्योंकि 2026 के पहले सात सप्ताहों में PubMed-अनुक्रमित हर 277 शोधपत्रों में से एक में कम से कम एक ऐसा संदर्भ था जो इन चार डेटाबेस में कहीं मौजूद नहीं है, जो 2023 की 2,828 में एक की दर से 12 गुना अधिक है।
हैलुसिनेटेड उद्धरण अब स्क्रीनिंग की समस्या क्यों बन गए हैं
लगभग 2024 की दूसरी छमाही से संपादकों को अपनी तकनीकी जाँच में हैलुसिनेटेड संदर्भ दिखने लगे। 2026 के मध्य तक सभी प्रमुख चिकित्सा और जीवन-विज्ञान पत्रिकाओं ने संदर्भ-अस्तित्व की जाँच को अपनी आंतरिक पूर्व-समीक्षा प्रक्रियाओं या समीक्षकों के दिशानिर्देशों में शामिल कर लिया है। जिस Lancet पत्र में Topaz ऑडिट प्रकाशित हुआ, वह आंशिक रूप से पत्रिका की अपनी जाँच-प्रक्रिया कड़ी करने की सार्वजनिक प्रतिबद्धता भी था।
व्यावहारिक स्तर पर यह इसलिए मायने रखता है कि हैलुसिनेटेड उद्धरण को अब असावधानीवश हुई भूल नहीं माना जाता। उसे शोध-सत्यनिष्ठा पर उठा प्रश्न माना जाता है। "लेखकों ने वर्ष गलत लिख दिया" से "लेखकों ने यह स्रोत पढ़ा ही नहीं, क्योंकि यह अस्तित्व में ही नहीं है" तक की दूरी बहुत छोटी है, और संपादक अब यह निष्कर्ष निकालने के लिए प्रशिक्षित हैं। अधिकांश पत्रिकाओं में 60 प्रविष्टियों की सूची में एक भी गढ़ा हुआ संदर्भ पांडुलिपि लौटाने के लिए पर्याप्त है; सबसे सख़्त पत्रिकाओं में (Lancet, BMJ, कई Nature Portfolio शीर्षक) यह मामला संस्थान के शोध-सत्यनिष्ठा कार्यालय तक भेजा जा सकता है।
arXiv की नीति यही बात और भी तीखे रूप में कहती है। हैलुसिनेटेड संदर्भ वाला शोधपत्र जमा करने वाले किसी भी लेखक पर arXiv से एक वर्ष का प्रतिबंध लग सकता है। प्रतिबंध के बाद हर अगली arXiv सबमिशन को पहले किसी प्रतिष्ठित मंच की समीक्षा-प्रक्रिया से गुज़रना होगा, तभी arXiv उसे स्वीकार करेगा। एक अनचेक किए गए उद्धरण के आधार पर यह स्थायी प्रतिष्ठा-असंतुलन है। नकली उद्धरणों की यह समस्या केवल PubMed तक सीमित नहीं है।
हैलुसिनेटेड उद्धरण वास्तव में कैसे दिखते हैं
अधिकांश लेखक हैलुसिनेटेड उद्धरण की कल्पना किसी स्पष्ट रूप से टूटी चीज़ के रूप में करते हैं: बिगड़ा हुआ शीर्षक, ऐसी पत्रिका का नाम जो है ही नहीं, भविष्य में पड़ने वाला वर्ष। ऐसे मामले होते हैं, और वे समस्या का सबसे आसान 30 प्रतिशत हिस्सा हैं। कठिन 70 प्रतिशत देखने में वैध लगता है और सरसरी नज़र की जाँच से बच निकलता है।
हमें चार दोहराए जाने वाले पैटर्न दिखते हैं।
पैटर्न 1: असली लेखक, असली पत्रिका, विश्वसनीय शीर्षक, पर ऐसा कोई शोधपत्र नहीं। मॉडल ने उद्धरण अपने प्रशिक्षण डेटा से जोड़कर बनाया, जिसने उसे सिखाया था कि कौन से लेखक कहाँ और किस विषय पर छपते हैं। परिणाम असली संदर्भ जैसा पढ़ा जाता है। DOI, यदि मौजूद हो, या तो खुलता ही नहीं, या किसी दूसरे शोधपत्र पर खुलता है।
पैटर्न 2: असली शोधपत्र, गलत लेखक या गलत वर्ष। मॉडल जानता था कि शोधपत्र मौजूद है, पर उसने कोई मेटाडेटा फ़ील्ड बेमेल कर दी। ऐसा उद्धरण Google Scholar की शीर्षक-खोज पास कर लेता है, पर DOI जाँच में विफल रहता है। इसे पकड़ना प्रायः सबसे कठिन होता है, क्योंकि उद्धृत दावा असली शोधपत्र में सचमुच मौजूद हो सकता है (किसी और लेखक या वर्ष के अंतर्गत)।
पैटर्न 3: असली DOI, असंबंधित शोधपत्र। यही Deakin अध्ययन की खोज है। मॉडल ने देखने में विश्वसनीय उद्धरण बनाया और उसके साथ ऐसा DOI जोड़ दिया जो खुलता तो है, पर किसी बिल्कुल असंबंधित काम पर। सरसरी जाँच दिखाती है कि DOI असली है, पर जुड़े हुए शोधपत्र को पढ़ने पर ही समस्या दिखती है। यही 64 प्रतिशत वाली किस्म है।
पैटर्न 4: उद्धरण के इर्द-गिर्द विकृत-वाक्यांश शृंखलाएँ। Cabanac के Problematic Paper Screener ने 19,000 से अधिक ऐसे शोधपत्र चिह्नित किए हैं जिनमें पैराफ़्रेज़िंग सॉफ़्टवेयर से उपजे विकृत वाक्यांश हैं, जो प्रायः गढ़े हुए उद्धरणों के आसपास गुच्छों में मिलते हैं। United States के लिए "Joined Together States", breast cancer के लिए "bosom peril", kidney failure के लिए "kidney disappointment"। यदि किसी उद्धरण के आसपास का गद्य पैराफ़्रेज़ से धुला हुआ लगे, तो उद्धरण के हैलुसिनेटेड होने की संभावना भी अधिक है। उद्धरणों को सुरक्षित रखने वाली पैराफ़्रेज़िंग पर हमारा नोट उसी तकनीकी कमी को समझाता है जो पैटर्न 4 को जन्म देती है। पैटर्न 4 पैटर्न 1 से 3 के साथ सहसंबद्ध है, उनसे स्वतंत्र नहीं।
यही पैटर्न कारण हैं कि केवल एक डेटाबेस की जाँच पर्याप्त नहीं। केवल शीर्षक से की गई Google Scholar खोज पैटर्न 2 और 3 चूक जाती है। केवल DOI वाली Crossref जाँच पैटर्न 1 चूक जाती है। चार-डेटाबेस कार्यप्रवाह इसीलिए है, क्योंकि हर डेटाबेस विफलता का एक अलग रूप पकड़ता है।
AI उद्धरण कैसे सत्यापित करें: चार-डेटाबेस कार्यप्रवाह
हम हैलुसिनेटेड संदर्भ उसे कहते हैं जो PubMed, Crossref, OpenAlex या Google Scholar में से किसी में मौजूद नहीं है। अपने सबमिशन-पूर्व ऑडिट में हम इन्हीं चार स्रोतों पर निर्भर रहते हैं, क्योंकि हर स्रोत बाकी तीनों की कमियाँ ढकता है।
PubMed. जैव-चिकित्सा और नैदानिक साहित्य के लिए सर्वोत्तम कवरेज। यदि संदर्भ के पास PMID है, तो PMID से खोजें। अन्यथा शीर्षक और पहले लेखक के उपनाम से खोजें। PubMed ऐसे कई वास्तविक-पर-गलत उद्धरण अस्वीकार कर देगा जिन्हें Crossref स्वीकार कर लेता है।
Crossref. सभी क्षेत्रों के DOI का सर्वोत्तम कवरेज। संदर्भ को DOI से doi.crossref.org पर या उनके सार्वजनिक API endpoint api.crossref.org/works/[DOI] से खोजें। यदि DOI काम न करे, तो संदर्भ निश्चित रूप से हैलुसिनेटेड है। यदि काम करे, तो शीर्षक, लेखक और वर्ष मिलाएँ।
OpenAlex. सबसे व्यापक कवरेज, निःशुल्क, और यह वे उद्धरण भी खोज निकालता है जो PubMed और Crossref में नहीं आते (मानविकी, कंप्यूटर-विज्ञान सम्मेलन कार्यवाहियाँ, क्षेत्रीय पत्रिकाएँ)। संदर्भ को शीर्षक से खोजें और लेखकों का मिलान सुनिश्चित करें। OpenAlex इसलिए भी उपयोगी है क्योंकि यह वे उद्धरण सामने लाता है जो प्रीप्रिंट रूप में मौजूद हैं, पर अभी तक DOI-युक्त प्रकाशन नहीं बने।
Google Scholar. सबसे अंत में इस्तेमाल करें, सबसे व्यापक पर सबसे कम सटीक जाँच के रूप में। जो संदर्भ PubMed, Crossref, OpenAlex और Google Scholar में से किसी में न दिखे, वह व्यावहारिक रूप से निश्चित हैलुसिनेटेड है। जो संदर्भ केवल Google Scholar में दिखे, पर किसी संरचित डेटाबेस में नहीं, वह संदिग्ध है: वह मौजूद हो सकता है (ग्रे साहित्य, कोई शोध-प्रबंध, बिना DOI की कार्यवाही), पर सबमिशन से पहले उस उद्धरण की हाथ से जाँच आवश्यक है।
हाथ से करने पर इस कार्यप्रवाह में प्रति संदर्भ लगभग एक मिनट लगता है। 60 संदर्भों वाला शोधपत्र एक घंटे का काम है। 200 संदर्भों वाली व्यवस्थित समीक्षा तीन घंटे के करीब। ऑडिट उबाऊ है, पर यांत्रिक है, इसलिए स्वचालन के लिए स्वाभाविक लक्ष्य है; उपकरण अगले-से-अगले खंड में हैं।
सबमिट करने से पहले अपनी संदर्भ-सूची का ऑडिट करें
हमारा प्रूफ़रीडर एक ही पास में हर उद्धरण को PubMed, Crossref, OpenAlex और Google Scholar से मिलाता है, हैलुसिनेटेड संदर्भों को चिह्नित करता है, और एक साफ़ रिपोर्ट निर्यात करता है।
निःशुल्क आज़माएँसबमिशन-पूर्व ऑडिट, चरण दर चरण
एक दोहराने योग्य जाँच-सूची, जिसे हम हर उस पांडुलिपि पर चलाते हैं जो लेखन के दौरान किसी जनरेटिव AI उपकरण के पास से भी गुज़री हो। आठ चरण, और किसी में भी सशुल्क उपकरण की आवश्यकता नहीं।
1. संदर्भ-सूची को सपाट प्रारूप में निकालें। अपने संदर्भ-प्रबंधक (Zotero, Mendeley, EndNote, Paperpile) से BibTeX या RIS के रूप में निर्यात करें। यदि शोधपत्र बिना प्रबंधक के Word में लिखा गया है, तो संदर्भ-सूची को सादे टेक्स्ट फ़ाइल में चिपकाएँ। हर प्रविष्टि पर क्रमांक डालें। कौन से संदर्भ सत्यापित हो चुके हैं, इस पर नज़र रखने के लिए यह क्रमांकन चाहिए होगा।
2. हर वह संदर्भ चिह्नित करें जिसका शीर्षक आप नहीं पहचानते। यदि शोधपत्र की छवि मन में न बने, तो लगभग निश्चित है कि आपने उसे पढ़ा नहीं है। ऐसे संदर्भों के नकली होने का जोखिम सबसे अधिक है। सबसे गहन जाँच के लिए इन्हें चिह्नित करें।
3. हर DOI खोलकर देखें। हर DOI को https://doi.org/[DOI] में डालें। यदि DOI न खुले, तो संदर्भ हैलुसिनेटेड है। यदि खुले, तो गंतव्य शोधपत्र के शीर्षक और लेखकों का अपने उद्धरण से मिलान करें। बेमेल मामले पैटर्न 3 के हैलुसिनेशन हैं।
4. हर बिना-DOI संदर्भ को PubMed या Crossref में सत्यापित करें। शीर्षक-खोज और पहले लेखक का उपनाम। यदि शोधपत्र मौजूद है, तो अपने रिकॉर्ड के लिए PMID या DOI नोट करें। यदि दोनों डेटाबेस में न मिले, तो चरण 5 पर ले जाएँ।
5. आगे बढ़ाए गए संदर्भों को OpenAlex और Google Scholar में जाँचें। यदि कोई संदर्भ Crossref और PubMed में विफल रहा, तो OpenAlex और Google Scholar की जाँच निर्णायक है। चारों डेटाबेस में विफलता ही आपका प्रमाण है कि संदर्भ हैलुसिनेटेड है। यदि कोई संदर्भ केवल Google Scholar में दिखे, तो जुड़े स्रोत का हाथ से निरीक्षण करें।
6. प्रीप्रिंट के लिए प्रीप्रिंट और प्रकाशित संस्करण, दोनों सत्यापित करें। 2024 के मध्य के बाद का एक आम पैटर्न: मॉडल असली प्रीप्रिंट उद्धृत करता है, पर उसी काम का काल्पनिक पत्रिका-प्रकाशन गढ़ देता है। हर प्रीप्रिंट संदर्भ के लिए arXiv, bioRxiv, medRxiv और SSRN स्पष्ट रूप से देखें।
7. पाठ-भीतर दावे की स्रोत से नमूना-जाँच करें। असली शोधपत्र खोलें और जाँचें कि वह उसी विशिष्ट दावे का समर्थन करता है जिसके लिए आप उसे उद्धृत कर रहे हैं, कम से कम 10 प्रतिशत संदर्भों में (व्यवस्थित समीक्षा की स्थिति में सभी में)। Deakin अध्ययन की 56 प्रतिशत त्रुटि-दर में पैटर्न 2 के वे मामले शामिल हैं जहाँ उद्धृत शोधपत्र मौजूद है, पर दावे का समर्थन नहीं करता।
8. ऑडिट का दस्तावेज़ बनाएँ। ऑडिट लॉग सहेजें (कौन से संदर्भ, किन डेटाबेस से, किस तिथि को सत्यापित हुए)। यदि समीक्षा के दौरान पत्रिका पूछे, तो आपके पास प्रमाण होंगे। यदि कोई समीक्षक किसी विशेष उद्धरण पर प्रश्न उठाए, तो आप अपने सत्यापन-चरण की ओर संकेत कर सकते हैं।
ऑडिट चलाने की लागत दो घंटे है। छोड़ने की लागत, पकड़े जाने पर, तकनीकी-जाँच अस्वीकृति से लेकर arXiv प्रतिबंध तक जाती है। ऑडिट चलाइए।
ऑडिट को स्वचालित करने वाले उपकरण
आप आठों चरण हाथ से कर सकते हैं। उपकरणों के साथ आप तेज़ रहेंगे।
Crossref सार्वजनिक API। निःशुल्क, बिना साइनअप। endpoint api.crossref.org/works/[DOI] प्रामाणिक शीर्षक, लेखक और वर्ष JSON में लौटाता है। 20 पंक्तियों की Python स्क्रिप्ट, जो आपकी संदर्भ-सूची पर चलकर इस endpoint को बुलाती है, पैटर्न 1 और 3 को प्रति संदर्भ कुछ सेकंड में पकड़ लेती है। यह हल्का-से-हल्का स्वचालन है और 60 संदर्भों वाले शोधपत्र के लिए प्रायः पर्याप्त है।
Scite (scite.ai)। संदर्भों को सत्यापित करता है और बताता है कि बाद के शोधपत्रों ने उस काम को समर्थन में उद्धृत किया या विरोध में। पैटर्न 2 (असली शोधपत्र, गलत दावा) को बाकी उपकरणों से बेहतर पकड़ता है, क्योंकि यह वास्तविक सामग्री से जुड़ता है। निःशुल्क स्तर है; पूर्ण एकीकरण के लिए सशुल्क संस्करण आवश्यक है।
Problematic Paper Screener (Cabanac, Labbe, Magazinov)। निःशुल्क, खुला, मुख्यतः प्रकाशन-पश्चात जाँच का साधन, पर इसका डिटेक्टर-समूह पैटर्न 4 के लिए सबमिशन-पूर्व भी उपयोगी है। खोजें: dbrech.irit.fr/pls/apex/f?p=9999:1। यह पुष्टि करने में उपयोगी है कि आपके उद्धरणों के आसपास का गद्य पैराफ़्रेज़ से इतना धुला नहीं है कि पेपर-मिल उत्पादन जैसा लगे।
संदर्भ-प्रबंधकों में निर्मित जाँच। यदि Zotero को हैलुसिनेटेड संदर्भ मिले, तो उसका "Find Available PDF" काम नहीं करेगा। Mendeley की मेटाडेटा भरने वाली सुविधा का असर भी वही है। यह उद्देश्य-निर्मित हैलुसिनेशन-जाँचक नहीं है, पर सामान्य उपयोग में सबसे आसान समस्याएँ पहचान लेता है।
हमारा प्रूफ़रीडर। हमारा AI प्रूफ़रीडर एक ही पास में चार-डेटाबेस ऑडिट चलाता है, हैलुसिनेटेड और बेमेल संदर्भों को उभारता है, और एक साफ़ लॉग निर्यात करता है जिसे आप पांडुलिपि के साथ सहेज सकते हैं। हम यह उपकरण शोधपत्रों के लिए अपने व्यापक AI प्रूफ़रीडिंग टूल-समूह के हिस्से के रूप में देते हैं, जिसमें साफ़ संदर्भ-ऑडिट के साथ जुड़ी व्याकरण, उद्धरण-स्वरूपण और ट्रैक-चेंजेस प्रक्रियाएँ भी शामिल हैं।
पूर्ण प्रूफ़रीड से पहले एक स्वतंत्र जाँच के लिए, हमारा निःशुल्क AI उद्धरण परीक्षक किसी भी चिपकाई गई संदर्भ-सूची पर Crossref, Semantic Scholar और अन्य खुली रजिस्ट्रियों के विरुद्ध वही अस्तित्व-जाँच सीधे ब्राउज़र में चलाता है, बिना साइन-अप के।
अधिकांश लेखकों के लिए Crossref API स्क्रिप्ट और हाथ से जाँचने की एक छोटी सूची समस्या का 90 प्रतिशत पकड़ लेगी। उपकरण अपना मूल्य व्यवस्थित समीक्षाओं में, अनेक सबमिशन वाले शोध-समूहों में, और उन स्थितियों में सिद्ध करते हैं जहाँ एक भी चूके हुए हैलुसिनेशन की कीमत बड़ी हो (Lancet या NEJM सबमिशन, पिछले फ़्लैग के बाद arXiv पर दोबारा पोस्ट)।
हैलुसिनेटेड उद्धरण मिल जाए तो क्या करें
मिलेगा ज़रूर। हमारे अनुभव में, LLM के संपर्क में आई लगभग हर संदर्भ-सूची में कम से कम एक होता है। पांडुलिपि की अवस्था के अनुसार आपके पास विकल्प हैं।
सबमिशन से पहले। सबसे आसान स्थिति। उद्धरण हटाएँ, या उसकी जगह ऐसा वास्तविक संदर्भ रखें जो सचमुच दावे का समर्थन करता हो, या आसपास का वाक्य ऐसे लिखें कि असमर्थित दावा ही न रहे। बदलाव को अपने ऑडिट लॉग में दर्ज करें।
समीक्षाधीन। हैलुसिनेशन की पुष्टि होते ही हैंडलिंग एडिटर को लिखित सूचना दें। संशोधित संदर्भ-सूची और स्पष्टीकरण दें: क्या मिला, कैसे मिला, बाकी संदर्भों के सत्यापन के लिए आपने क्या किया। जो लेखक स्वयं सुधार करते हैं, संपादक उनके प्रति उन लेखकों की तुलना में कहीं बेहतर प्रतिक्रिया देते हैं जिन्हें समीक्षक पकड़ता है।
स्वीकृत, पर अभी अप्रकाशित। तुरंत प्रोडक्शन एडिटर से संपर्क करें। अधिकांश प्रकाशक प्रूफ़-चरण पर देर से किया गया सुधार स्वीकार कर लेते हैं, बशर्ते उसे नियमित संपादन के बजाय सत्यनिष्ठा-आधारित स्व-सुधार के रूप में प्रस्तुत किया जाए।
प्रकाशित। पत्रिका से संपर्क कर erratum, या गंभीर मामलों में corrigendum, का अनुरोध करें। यदि हैलुसिनेटेड उद्धरण शोधपत्र के किसी ठोस दावे का आधार है, तो सुधार उस दावे तक भी जाना पड़ सकता है। यही वह रास्ता है जिससे आप सबसे अधिक बचना चाहेंगे; ऑडिट इसी रास्ते को रोकता है।
यदि किसी AI उपकरण ने आपकी संदर्भ-सूची को छुआ है, जैसे पैराफ़्रेज़र या उद्धरण-जनरेटर, तो अपनी पांडुलिपि पर AI-प्रकटीकरण वक्तव्य दें। कवर लेटर में यह भी बताया जा सकता है कि आपने ऑडिट चलाया और स्वयं सुधार किया। यह चिंताजनक नहीं, बल्कि पेशेवर व्यवहार जैसा पढ़ा जाता है।
अक्सर पूछे जाने वाले प्रश्न
Q: 2026 में हैलुसिनेटेड उद्धरण कितने आम हैं?
Columbia विश्लेषण (Topaz et al, Lancet 2026) ने पाया कि 2026 के पहले सात सप्ताहों में प्रकाशित PubMed-अनुक्रमित हर 277 शोधपत्रों में से एक में कम से कम एक ऐसा संदर्भ था। यह 2023 की 2,828 में एक की दर से 12 गुना अधिक है। रुझान ऊपर की ओर है। कड़ी समीक्षा वाले सम्मेलनों में भी, GPTZero के NeurIPS 2025 विश्लेषण ने 4,841 स्वीकृत शोधपत्रों में से 53 में कम से कम 100 हैलुसिनेटेड उद्धरण पाए, यानी सम्मेलन का लगभग 1 प्रतिशत।
Q: 64 प्रतिशत वाली DOI किस्म पकड़ने में सबसे कठिन क्यों है?
जब LLM कोई संदर्भ हैलुसिनेट करता है, तो कभी-कभी वह अपने प्रशिक्षण डेटा से कोई असली DOI जोड़ देता है, जो उद्धृत शोधपत्र के बजाय किसी और शोधपत्र तक ले जाता है। DOI खुल जाता है, वह दूसरा शोधपत्र मौजूद है, और सरसरी जाँच ठीक लगती है। जुड़े शोधपत्र को खोलकर देखने पर ही पता चलता है कि उद्धृत संदर्भ के शीर्षक, लेखक या सामग्री उद्धरण से मेल नहीं खाते। Deakin अध्ययन दिखाता है कि GPT-4o से बने नकली उद्धरणों में 64 प्रतिशत के साथ यही हुआ। केवल DOI खोलना अपर्याप्त है; यह भी सत्यापित करना होगा कि जुड़ा शोधपत्र सचमुच उद्धरण से मेल खाता है।
Q: क्या एक हैलुसिनेटेड उद्धरण पर arXiv सचमुच मुझ पर एक वर्ष का प्रतिबंध लगा देगा?
हाँ, जब लापरवाही असंदिग्ध हो। Thomas Dietterich द्वारा घोषित मई 2026 की arXiv नीति उन मामलों के लिए है जहाँ लेखकों ने LLM का आउटपुट बिना जाँचे चिपका दिया, जिससे हैलुसिनेटेड संदर्भ, चैटबॉट का छूटा हुआ प्लेसहोल्डर टेक्स्ट, या ऐसा ही कुछ शोधपत्र में रह गया। arXiv ने स्पष्ट कहा है कि वास्तव में विवादित या सीमारेखा के मामले इस नीति के दायरे से बाहर हैं। प्रतिबंध समाप्त होने के बाद, हर भावी arXiv सबमिशन को पहले किसी प्रतिष्ठित मंच की समीक्षा पार करनी होगी, तभी arXiv उसे दोबारा स्वीकार करेगा।
Q: क्या मैं अपनी संदर्भ-सूची जाँचने के लिए उसे ChatGPT या Claude से नहीं गुज़ार सकता?
नहीं। जिस मॉडल ने संदर्भ हैलुसिनेट किया, वही सत्यापन भी हैलुसिनेट कर सकता है। हमने LLM को गढ़े हुए DOI को पूरे आत्मविश्वास से "वैध" बताते देखा है। जाँच बाहरी संरचित डेटाबेस (PubMed, Crossref, OpenAlex, Google Scholar) से होनी चाहिए, जिनके पास प्रामाणिक मेटाडेटा है, किसी और LLM से नहीं।
Q: यदि कोई संदर्भ केवल Google Scholar पर मिले तो?
जो संदर्भ Google Scholar में दिखे, पर PubMed, Crossref या OpenAlex में से किसी में नहीं, वह संदिग्ध है, पुष्ट-हैलुसिनेटेड नहीं। कुछ वास्तविक स्रोत (शोध-प्रबंध, बिना DOI की सम्मेलन कार्यवाही, वर्किंग पेपर, क्षेत्रीय पत्रिका) संरचित डेटाबेस में आए बिना Google Scholar में दिखते हैं। जुड़े स्रोत का हाथ से निरीक्षण करें। यदि आप शोधपत्र खोलकर दावे की पुष्टि कर सकें, तो संदर्भ असली है, बस कम-अनुक्रमित; उसे विश्वासपूर्वक उद्धृत करें। यदि स्रोत न खुले या कड़ी टूटी हो, तो उसे हैलुसिनेटेड मानकर हटाएँ या बदलें।
PubMed, Crossref, OpenAlex और Google Scholar के विरुद्ध एक-पास हैलुसिनेटेड-उद्धरण ऑडिट, आपके रिकॉर्ड के लिए डाउनलोड करने योग्य सत्यापन लॉग के साथ।

लिसा के पास NYU से भाषा विज्ञान में PhD है, और हमेशा इस बारे में उत्सुक रही है कि कंप्यूटर मानव भाषा को समझने और संचार करने और मानव लिखित सामग्री को संपादित करने में सहायता करने के लिए व्यावहारिक भाषाविज्ञान का लाभ कैसे उठा सकते हैं। वह वर्तमान में ProofreaderPro में मुख्य विपणन अधिकारी हैं, जहां वह कॉपी, सोशल मीडिया, ईमेल और ऑफ़लाइन चैनलों पर मार्केटिंग का नेतृत्व करती हैं।