सऊदी शोधकर्ताओं के लिए अंग्रेज़ी में AI ह्यूमनाइज़र
सऊदी शोधकर्ताओं के लिए AI ह्यूमनाइज़र। अरबी-प्रभावित अंग्रेज़ी में गलत AI-डिटेक्शन फ्लैग की संभावना घटाएँ, अर्थ और उद्धरण बनाए रखें, और ईमानदारी से खुलासा करें।
2022 में सऊदी अरब ने Scopus-इंडेक्स्ड 49,136 शोध-पत्र प्रकाशित किए, यह 2013 की तुलना में 320% की बढ़त है, और अब Nature Index पर वह 28वें सबसे बड़े शोध-उत्पादक के रूप में रैंक करता है। फिर भी, उसी देश का EF English Proficiency Index पर स्कोर 404 है, जो विश्व में 115वां स्थान है; और लेखन (writing) उसकी सबसे कमजोर स्किल है, 700 में से 295। यह वही अंतर है जहाँ सऊदी शोधकर्ताओं के लिए एक AI ह्यूमनाइज़र अपनी भूमिका पाता है: किसी चीज़ को छिपाने के लिए नहीं, बल्कि सावधानीपूर्ण, सही, गैर-मातृभाषी अंग्रेज़ी को मशीन-टेक्स्ट समझ लिए जाने से बचाने के लिए।
यह वह समस्या है जिसके बारे में लगभग कोई आपको पहले नहीं बताता। अब AI लेखन डिटेक्टर अधिकतर विश्वविद्यालयों में Turnitin और iThenticate के भीतर मौजूद हैं, और इन्हें उस गद्य (prose) को चिन्हित करने के लिए प्रशिक्षित किया गया था जो अत्यधिक पूर्वानुमेय (too predictable) दिखता है। अरबी-भाषी शोधकर्ता जिस स्पष्ट, मानक अंग्रेज़ी को लाने के लिए कड़ी मेहनत करते हैं, ये उपकरण उसी लेखन को गलत ढंग से आँकते हैं।
इसलिए एक सऊदी PhD उम्मीदवार हर शब्द खुद लिख सकती है, एक वास्तविक पांडुलिपि जमा कर सकती है, और फिर भी उसे वह AI फ्लैग दिखेगा जो उसने कभी अर्जित नहीं किया। यह गाइड बताता है कि ऐसा क्यों होता है और आप इसका जवाब कैसे दे सकते हैं, अपने स्वयं के AI-सहायता प्राप्त ड्राफ्ट, अपनी ही समझ, और पूर्ण और पारदर्शी खुलासे के आधार पर।
أداة أنسنة النصوص بالذكاء الاصطناعي للباحثين السعوديين
ProofreaderPro.ai की AI-आधारित टेक्स्ट ह्यूमनाइज़ेशन टूल सऊदी शोधकर्ताओं को अर्थ, शब्दावली और संदर्भ (references) बनाए रखते हुए अंग्रेज़ी पत्रिकाओं में प्रकाशित करने में मदद करती है।
हमारा ह्यूमनाइज़र सऊदी शोधकर्ताओं को अपनी आवाज़ या अपने citations खोए बिना अंग्रेज़ी में प्रकाशित करने में मदद करता है। विज्ञान का मसौदा तैयार करें। अपने ही AI-सहायता प्राप्त prose की लय (rhythm) और शब्द-चयन (word choice) को बदलने दें ताकि सावधानी से किया गया, मानक अंग्रेज़ी (standard English) किसी detector द्वारा गलत पढ़े जाने की संभावना कम हो। अपनी AI उपयोग को उसी तरह प्रकट करें जैसा आपकी संस्था की आवश्यकताओं के अनुसार है।
यह 60 से अधिक भाषाओं का समर्थन करता है और अरबी-प्रभावित टेक्स्ट को भाषा-समझदार (language-aware) मॉडल के माध्यम से संसाधित करता है, जो वाक्य-संरचना और अर्थ (meaning) को अक्षुण्ण रखता है। आपकी खोजों (findings) में कुछ भी नहीं बदलता। केवल वही सतही लय (surface cadence) बदलती है, जिस पर डिटेक्टर अत्यधिक निर्भर (overfit) होते हैं।
क्या आप अरबी में मसौदा तैयार कर रहे हैं? Humanizer इसे भी पहचानता है और पुनर्लेखन करता है
आप ह्यूमनाइज़ करने से पहले ड्राफ्ट को अंग्रेज़ी में अनुवाद करने के लिए बाध्य नहीं हैं। अरबी टेक्स्ट पेस्ट करें, और ProofreaderPro स्क्रिप्ट को स्वतः पहचान लेगा; फिर इसे अरबी-सचेत (Arabic-aware) मॉडल के माध्यम से चलाया जाएगा, जो आपकी टर्मिनोलॉजी, डायक्रिटिक्स (diacritics) और उद्धरण (citations) को संरक्षित रखता है। एक أداة أنسنة النصوص بالذكاء الاصطناعي के रूप में यह आपकी अरबी अकादमिक गद्य (prose) की लय (rhythm) में बदलाव करता है, जबकि हर finding और reference को यथावत रखता है। स्वचालित पहचान 60 से अधिक भाषाओं तक पहुँचती है, इसलिए अरबी को सामान्य अंग्रेज़ी में “रीशेप” करने के बजाय अरबी की तरह ही ट्रीट किया जाता है।

ProofreaderPro AI Humanizer द्वारा अरबी अकादमिक टेक्स्ट का पुनर्लेखन। before और after diff अर्थ और citations को बनाए रखता है, और detector checks एक स्वाभाविक, मानव-सदृश (human) पढ़ने की पुष्टि करते हैं।
क्यों सऊदी शोधकर्ताओं को AI डिटेक्टरों से फ्लैग किया जाता है
2023 में Liang और उनके सहयोगियों के नेतृत्व वाली स्टैनफोर्ड की एक शोध टीम ने Cell Press जर्नल Patterns में एक सीधी-सी शीर्षक वाली स्टडी प्रकाशित की: "GPT detectors are biased against non-native English writers." उन्होंने मानव-लिखित TOEFL निबंधों को सात व्यापक रूप से उपयोग किए जाने वाले AI डिटेक्टरों में चलाया।
परिणाम हर अरबी-भाषी अकादमिक के लिए चिंता का विषय होना चाहिए। औसतन, गैर-मातृभाषी (non-native) लेखकों के लगभग 61% निबंधों को AI-generated के रूप में फ्लैग किया गया, जबकि मूल (native) अंग्रेज़ी लेखकों के लिए यह लगभग 5% था। लगभग पाँच में से एक गैर-मातृभाषी निबंध को सर्वसम्मति से फ्लैग किया गया, हर एक डिटेक्टर द्वारा। और इनमें से हर निबंध मानव-लेखन (human) था।
इसका तंत्र (mechanism) perplexity कहलाता है। डिटेक्टर यह मापते हैं कि भाषा मॉडल के लिए प्रत्येक शब्द-चयन (word choice) कितना “अप्रत्याशित” (surprising) है। सावधानीपूर्वक लिखने वाले द्वितीय-भाषा (second-language) लेखक सामान्य शब्द और मानक, पूर्वानुमेय वाक्य-प्रयोग (phrasing) चुनते हैं, जिससे perplexity कम होती है, और वह मशीन-टेक्स्ट जैसा पढ़ता है। अंग्रेज़ी को स्पष्ट बनाने वाली वही आदतें हैं, जिनको इन टूल्स ने दंडित (punish) करने के लिए प्रशिक्षित किया था। हम why AI detectors flag non-native writers में विज्ञान को विस्तार से खोलते हैं।
false flags के पीछे अरबी की प्रथम-भाषा (first-language) की रूपरेखाएँ
अरबी और अंग्रेज़ी अलग भाषा-परिवारों (language families) में आती हैं, सेमिटिक और जर्मेनिक, इसलिए सऊदी शोधकर्ता सुरक्षित (safe), पाठ्यपुस्तक-सम (textbook) संरचनाओं के साथ समायोजन (compensate) करना सीखते हैं। यही सुरक्षित संरचनाएँ डिटेक्टर को कम perplexity की तरह दिखाई देती हैं। आइए देखें कि पाँच सामान्य पैटर्न false flag को कैसे “फ़ीड” करते हैं।
The article system. अरबी में निश्चित लेख (ال) है, लेकिन अनिश्चित लेख (indefinite article) नहीं, इसलिए a, an, और the का मैप किसी सहज (intuitive) चीज़ पर नहीं बैठता। "We used questionnaire," जैसी छोटी चूक से बचने के लिए सावधान लेखक उन सबसे मानक और सबसे पूर्वानुमेय लेख (article) पैटर्नों का सहारा लेते हैं जिन्हें वे प्रबंधित कर सकें। सही (correct) और सतर्क (cautious), और कम perplexity।
Word order. अरबी का डिफ़ॉल्ट क्रम Verb-Subject-Object है, जबकि अंग्रेज़ी Subject-Verb-Object। वाक्यों को “सेफ” रखने के लिए सऊदी लेखक सबसे सरल SVO टेम्पलेट्स ("The table shows that," "The temperature increased significantly") को प्राथमिकता देते हैं। पाठ्यपुस्तक जैसा साफ-सुथरा (textbook-clean) और बिल्कुल वही नियमितता (regularity) जिसे डिटेक्टर मशीन से अपेक्षित मानता है।
The missing copula. अरबी की present-tense equative वाक्य-रचनाओं को "to be" जैसी क्रिया (verb) की जरूरत नहीं होती: "The result significant" अरबी में पूर्ण है (النتيجة مهمة)। जिन लेखकों ने इस फर्क को अंग्रेज़ी में “न निकालना” (train this out of their English) सीखा है, वे "is" और "are" के साथ और भी अधिक सावधानी और नियमितता दिखाते हैं, ऐसी स्थिर, एकरूप (uniform) phrasing बनाते हैं जो कम perplexity के स्कोर करती है।
Coordination over subordination. अरबी वाक्पटुता (rhetoric) में "wa" (and) से जुड़े लंबे वाक्य-खंडों (chains) को प्राथमिकता दी जाती है। लेखक और संपादक इसे सुधारकर छोटे, सम, और समानांतर वाक्यों (parallel sentences) में बदल देते हैं। साफ अकादमिक अंग्रेज़ी, और वह सहज (smooth) एवं एकरूप लय (uniform cadence) भी, जिसे डिटेक्टर generated text से जोड़ते हैं।
Resumptive pronouns. अरबी relative clauses में एक सर्वनाम (pronoun) बना रहता है जो वापस संज्ञा (noun) की ओर संकेत करता है ("the method that we used it"). इस आदत को हटाने से लेखक अंग्रेज़ी में relative clauses के सबसे मानक रूपों की ओर बढ़ते हैं। सही (Correct) और पूर्वानुमेय (predictable)।
इनमें से कोई भी अंतिम टेक्स्ट में “गलती” नहीं है। ये एक सावधान गैर-मातृभाषी लेखक के संकेत (marks) हैं, और वही सावधानी वह चीज़ है जिसे गलत पढ़ा जाता है।
सऊदी अरब का AI-detection और Turnitin संदर्भ
टर्निटिन या iThenticate का उपयोग आम तौर पर किंगडम में थीसिस, डिसर्टेशन और जर्नल आर्टिकल्स की समानता (similarity) और AI संकेतकों (AI indicators) की जाँच के लिए नियमित रूप से किया जाता है। Vision 2030 और Research, Development, and Innovation Authority (RDIA) के अंतर्गत शोध-आउटपुट और अखंडता (integrity) की निगरानी बढ़ी है। अब फंडर और जर्नल लेखकों से अपेक्षा करते हैं कि वे AI टूल्स के अपने उपयोग का खुलासा करें।
यह जानना मददगार है कि ये स्कोर कितने नाज़ुक (fragile) हैं। Turnitin 1 से 19% की रेंज में AI रीडिंग को दबाता है (यह संख्या के बजाय एक asterisk दिखाता है) और चेतावनी देता है कि उसका स्कोर अपने दम पर किसी अखंडता (integrity) संबंधी निर्णय को चलाने (drive) नहीं चाहिए। 2023 में Vanderbilt ने Turnitin के AI detector को पूरी तरह बंद कर दिया, क्योंकि false positives और गैर-मातृभाषी लेखकों के खिलाफ bias का हवाला दिया गया। Michigan State, UT Austin, Northwestern, Pittsburgh, SMU, और Waterloo ने भी इसी तरह के कदम उठाए।
सऊदी शोधकर्ताओं के लिए मुख्य निष्कर्ष सरल है। एक AI फ्लैग ऐसा दावा (claim) है जिसे आप चुनौती (contest) दे सकते हैं, यह अंतिम फैसला (verdict) नहीं है। आपका काम यह सुनिश्चित करना है कि आपका वास्तविक लेखन वैसा ही “मानव-कार्य” (human work) पढ़े जैसा वह है, और ऐसे रिकॉर्ड रखें जो इसे साबित करें।
अपने सावधानी से लिखे अंग्रेजी को गलत AI अलर्ट से सुरक्षित रखिए
अपने स्वयं के AI-सहायता प्राप्त मसौदे को मानवीकृत करें, अपना अर्थ और उद्धरण बनाए रखें, फिर प्रकट करें। अंतरराष्ट्रीय जर्नलों के लिए अंग्रेजी में लिखने वाले अरबी-भाषी शोधकर्ताओं के लिए बनाया गया।
Humanizer को निःशुल्क आज़माइएशीर्ष सऊदी विश्वविद्यालय और जहाँ AI जाँच दिखती है
सऊदी अरब के 68 विश्वविद्यालय 2.2 मिलियन छात्रों को दाखिला देते हैं, और अग्रणी शोध-उत्पादक संस्थान सभी थीसिस और पांडुलिपियों को समानता (similarity) और AI संकेतकों के लिए स्क्रीन करते हैं। प्रमुख संस्थानों में शामिल हैं:
- King Saud University (KSU), جامعة الملك سعود, in Riyadh
- King Abdulaziz University (KAU), جامعة الملك عبدالعزيز, in Jeddah
- King Abdullah University of Science and Technology (KAUST), جامعة الملك عبدالله للعلوم والتقنية, in Thuwal
- King Fahd University of Petroleum and Minerals (KFUPM), جامعة الملك فهد للبترول والمعادن, in Dhahran
- Imam Abdulrahman Bin Faisal University (IAU), جامعة الإمام عبدالرحمن بن فيصل, in Dammam
- Umm Al-Qura University (UQU), جامعة أم القرى, in Makkah
- Imam Mohammad Ibn Saud Islamic University, جامعة الإمام محمد بن سعود الإسلامية, in Riyadh
- Taibah University, جامعة طيبة, in Madinah
- King Khalid University, جامعة الملك خالد, in Abha
- Najran University, جامعة نجران, in Najran
- Qassim University, جامعة القصيم, in Buraydah
- Princess Nourah bint Abdulrahman University (PNU), جامعة الأميرة نورة بنت عبدالرحمن, in Riyadh
इन सभी में, प्रोमोशन और ग्रेजुएशन Scopus या Web of Science में इंडेक्स्ड अंग्रेज़ी भाषा की पत्रिकाओं में प्रकाशन (publication) पर निर्भर करता है, और हर सबमिशन वही डिटेक्टरों से गुजरता है। इसी कारण सावधानीपूर्ण अंग्रेज़ी को false flags से बचाना एक व्यावहारिक (practical) चिंता है, न कि केवल सैद्धांतिक।
सऊदी शोधकर्ताओं के लिए AI ह्यूमनाइज़र कैसे काम करता है
नीचे यह पूरा वर्कफ़्लो है, शुरू से अंत तक।
सबसे पहले, अपना पेपर ड्राफ्ट करें। यदि आपका तर्क अरबी में अधिक स्वाभाविक रूप से बहता है, तो उसे अरबी में लिखें और अंग्रेज़ी में अनुवाद करें, फिर व्याकरण (grammar) को प्रूफरीड करें ताकि विज्ञान (science) स्पष्ट रूप से पढ़े। हमारा text humanizer अगले चरण में आता है: यह आपकी अपनी AI-सहायता प्राप्त अंग्रेज़ी ड्राफ्ट लेकर उसके rhythm, sentence length, और word choice में बदलाव करता है ताकि सावधानीपूर्ण, मानक गद्य (prose) डिटेक्टर द्वारा मशीन आउटपुट समझे जाने की संभावना कम हो जाए। यह आपका अर्थ (meaning), आपकी तकनीकी शब्दावली, और आपके citations को संरक्षित रखता है, और उस repetitive cadence तथा stray em dashes को हटाता है जिन्हें AI ड्राफ्टिंग अक्सर पीछे छोड़ देती है।
हमारे मानवाइज़र का परीक्षण प्रमुख तीन डिटेक्टरों (Turnitin, Originality.ai, GPTZero) के खिलाफ किया गया है, और यह AI टेक्स्ट को अधिक स्वाभाविक मानवीय (human) रूप में पुनर्लेखित करता है, जो उन सभी में “मानव” जैसा पढ़ता है। अकादमिक टेक्स्ट पर, हमारा grammar 96% से बेहतर है। हम इन संख्याओं की गारंटी नहीं देते। ये परीक्षण (testing) के परिणाम हैं। डिटेक्टर हर कुछ महीनों में फिर से ट्रेन होते हैं, इसलिए हम वादा करके नहीं बल्कि वही रिपोर्ट करते हैं जो हमने मापा है।
फिर, और यह भाग महत्वपूर्ण है, अपनी AI-उपयोग की जानकारी उसी प्रारूप में घोषित करें जो आपकी संस्था और लक्ष्य (target) जर्नल मांगते हैं। अपने ही लेखन को ह्यूमनाइज़ करना उसे biased स्कोर से बचाता है। खुलासा (disclosure) आपको अखंडता (integrity) नियमों के भीतर बनाए रखता है। साथ मिलकर ये वास्तविक काम को उसकी योग्यता (merits) पर खड़ा रहने देते हैं। अधिक विस्तृत क्रॉस-लैंग्वेज तस्वीर के लिए हमारा multilingual AI humanizer hub देखें, और यदि आपको लाइन-लेवल भाषा सहायता (line-level language help) भी चाहिए, तो academic editing for researchers in Saudi Arabia पर हमारा साथी गाइड संपादन (editing) पक्ष को कवर करता है।
स्थानीय फंडिंग निकाय, जर्नल, और AI-खुलासे (AI-disclosure) की अपेक्षाएँ
Research, Development, and Innovation Authority (RDIA) अब उस राष्ट्रीय शोध रणनीति (national research strategy) की निगरानी करता है जिसे पहले KACST ने एंकर किया था। इसके फंडिंग तंत्र पर्याप्त हैं: Basic Science Grant (BSG) अधिकतम $426,000 तक प्रदान करता है, और Research Competitive Grant (RCG) $2.6 मिलियन तक जा सकता है। दोनों आपके प्रकाशन-ट्रैक रिकॉर्ड का मूल्यांकन करते हैं और Scopus व Web of Science में इंडेक्स्ड आउटपुट की अपेक्षा रखते हैं, जिसका अर्थ है कि अधिक पांडुलिपियाँ अधिक डिटेक्टरों से गुजरेंगी।
किंगडम के अपने जर्नल भी वही मानक ऊँचा रखते हैं। प्रमुख शीर्षकों में शामिल हैं:
- Arabian Journal of Chemistry (Elsevier, impact factor 6.27)
- Saudi Journal of Biological Sciences (Elsevier, impact factor 5.35)
- Saudi Pharmaceutical Journal (Elsevier, impact factor 3.70)
- Saudi Medical Journal (Saudi Medical Association, indexed in PubMed and Scopus)
- Journal of King Saud University (multiple discipline-specific science and engineering series)
इन सभी को अंग्रेज़ी पांडुलिपियाँ चाहिए, और अंतरराष्ट्रीय प्रकाशक increasingly एक स्पष्ट AI-use statement माँग रहे हैं। अपना बयान सरल लिखें: टूल्स के नाम बताइए, उन्होंने क्या किया (grammar, rephrasing, अपने शब्दों को humanizing) यह बताइए, और यह पुष्टि कीजिए कि विचार (ideas) और डेटा आपके अपने हैं। यदि कोई डिटेक्टर फिर भी वास्तविक काम को फ्लैग करता है, तो अपने ड्राफ्ट और नोट्स संभालकर रखें ताकि आप सबूत के साथ appeal a false AI detection flag कर सकें। सबमिशन से पहले अपनी अंतिम अंग्रेज़ी को text humanizer से गुज़ारना biased डिटेक्टरों के लिए पकड़ना कठिन बनाता है।
अक्सर पूछे जाने वाले प्रश्न
प्र: क्या सऊदी शोधकर्ताओं के लिए AI ह्यूमनाइज़र का उपयोग Turnitin को धोखा देने का तरीका है?
नहीं। सही उपयोग यह है कि आप अपने AI-सहायता प्राप्त ड्राफ्ट को ह्यूमनाइज़ करें, अपना अर्थ और citations बनाए रखें, और फिर अपने AI उपयोग का खुलासा करें। आप सावधानीपूर्ण गैर-मातृभाषी अंग्रेज़ी को एक biased स्कोर से बचा रहे हैं, किसी गढ़े (fabricated) काम या किसी और के लेखन को छिपा नहीं रहे। cheating का अर्थ वह काम है जिसे आपका नहीं, उसे छिपाकर “अलग” दिखाना, और यह उस वर्कफ़्लो के विपरीत है जिसके लिए यह प्रक्रिया बनाई गई है।
प्र: क्या ह्यूमनाइज़र मेरे तकनीकी शब्द (technical terms) या citations बदल देगा?
नहीं। यह टूल आपकी terminology, आपके numbers और आपके references को संरक्षित रखता है, जबकि rhythm और word choice में बदलाव करता है। आपकी APA, IEEE, या Vancouver citations अक्षुण्ण रहती हैं, और आपका अर्थ नहीं बदलता। यह सतही लय (surface cadence) बदलता है, पदार्थ (substance) नहीं।
प्र: क्या यह मेरी पेपर को हर AI डिटेक्टर से पास कराने की गारंटी दे सकता है?
नहीं, और किसी भी ऐसे टूल से सावधान रहें जो ऐसा वादा करे। प्रमुख डिटेक्टरों के खिलाफ परीक्षण के आधार पर, हमारा ह्यूमनाइज़र AI टेक्स्ट को अधिक स्वाभाविक मानवीय रूप में पुनर्लेखित करता है, जिससे AI संकेत (AI signal) कम होता है और कड़े डिटेक्टरों के खिलाफ इसकी संभावना बेहतर होती है, हालाँकि कोई टूल किसी निश्चित परिणाम का वादा नहीं कर सकता। डिटेक्टर लगातार रीट्रेन होते हैं, इसलिए कोई भी गंभीर सेवा 100% का दावा नहीं करती।
प्र: क्या यह तब काम करेगा जब मैं पहले अरबी में ड्राफ्ट करूँ?
हाँ। कई सऊदी शोधकर्ता अरबी में अधिक स्वाभाविक ढंग से सोचते हैं। आप अरबी में ड्राफ्ट कर सकते हैं, उसे अंग्रेज़ी में अनुवाद कर सकते हैं, grammar प्रूफरीड कर सकते हैं, और फिर अंग्रेज़ी को ह्यूमनाइज़ कर सकते हैं। यह ह्यूमनाइज़र 60 से अधिक भाषाओं का समर्थन करता है और प्रक्रिया के दौरान वाक्य-संरचना तथा अर्थ को स्थिर (steady) बनाए रखता है।
प्र: क्या मुझे अभी भी AI उपयोग का खुलासा करना होगा यदि मैंने अपना ही लेखन ह्यूमनाइज़ किया है?
हाँ, हमेशा। खुलासा वही है जो आपको आपकी संस्था और आपकी पत्रिका की अखंडता (integrity) नियमों के भीतर रखता है। ह्यूमनाइज़िंग आपके लेखन को एक अनुचित फ्लैग से बचाती है, और disclosure प्रक्रिया को पारदर्शी (transparent) बनाए रखता है। अपने विश्वविद्यालय और लक्ष्य जर्नल द्वारा माँगे गए बिल्कुल उसी प्रारूप का उपयोग करें।
अरबी-भाषी शोधकर्ताओं के लिए: अपने स्वयं के AI-सहायता प्राप्त मसौदे को मानवीकृत करें, अर्थ और उद्धरण सुरक्षित रखें, और आत्मविश्वास के साथ प्रकटीकरण करें। Turnitin, Originality.ai, और GPTZero के विरुद्ध परीक्षणित।

मो प्राकृतिक भाषा प्रसंस्करण में PhD वाला एक NLP इंजीनियर है। उनके शोध में कम्प्यूटेशनल भाषाविज्ञान, पाठ विश्लेषण और मशीन लर्निंग शामिल है, और यह सीधे ProofreaderPro के पीछे संपादन और मानवीकरण मॉडल में शामिल है। वह प्रक्रिया के उस हिस्से के बारे में लिखते हैं जिसे ज्यादातर लोग कभी नहीं देखते हैं: कैसे एक भाषा मॉडल एक वाक्य को पढ़ता है, उसे स्कोर करता है, और निर्णय लेता है कि क्या बदलना है।