هومانیزر هوش مصنوعی برای پژوهشگران اتیوپیایی که به انگلیسی مینویسند
هومانیزر هوش مصنوعی برای پژوهشگران اتیوپیایی. میزان خطاهای مثبتِ تشخیص هوش مصنوعی را در انگلیسیِ تحتتأثیر زبانهای آمهری (Amharic) کاهش دهید؛ معنا و ارجاعات را حفظ کنید و استفاده از هوش مصنوعی را صادقانه اعلام کنید.
اتیوپی در سال 2023 تعداد 10,614 مقاله نمایهشده در اسکوپوس منتشر کرد؛ رشدی 20.2 درصدی که آن را در میان سریعترین تولیدکنندگان تحقیق در آفریقا قرار میدهد. شاخص H آن در رتبه 77 جهانی است؛ و از میان کشورهای کمدرآمد، تنها یکی از سه کشور در «صد کشور برتر» جهان از نظر اثرگذاری استنادی قرار دارد. پشت این اعداد، هزاران دانشگاهیِ آمهریزبان قرار دارند که پیشنویس تهیه میکنند، بازبینی انجام میدهند و روزبهروز بیشتر به سراغ ابزارهای هوش مصنوعی برای نوشتن در زبان دوم میروند.
اینجا مشکل آغاز میشود. هومانیزر هوش مصنوعی برای پژوهشگران اتیوپیایی قرار نیست کاری را پنهان کند. هدف، حفاظت از انگلیسیِ دقیق و استاندارد در برابر سامانههایی است که آن را اشتباه میخوانند.
وقتی پژوهشگری در بِهیر دار (Bahir Dar) یا گوندَر (Gondar) یک نثر آکادمیک روشن و قابلپیشبینی مینویسد، دقیقاً همان ویژگیهایی که خواندن را آسان میکنند ممکن است یک سامانه تشخیص هوش مصنوعی را به ثبتِ «پرچمِ خطا» وادار کند. این راهنما توضیح میدهد چرا چنین اتفاقی رخ میدهد و چگونه آن را بهسادگی اصلاح کنید: پیشنویسِ خودِ یاریشده با هوش مصنوعی را «انسانیسازی» کنید، معنا و ارجاعات را نگه دارید، سپس استفاده از هوش مصنوعی را همانطور که مؤسسه و ژورنال شما میخواهند صادقانه اعلام کنید.
ሰላም: یک هومانیزر هوش مصنوعی ساختهشده برای پژوهشگران اتیوپیایی که به انگلیسی مینویسند
ሰላም (selam) یعنی سلام. هومانیزر ما به پژوهشگران اتیوپیایی کمک میکند تا در انگلیسی منتشر کنند؛ به این صورت که پیشنویسِ یاریشده با هوش مصنوعیِ خودتان را میگیرد و ریتمِ ماشینمانند آن را بدون دستزدن به معنا، دادهها یا ارجاعاتتان صاف و یکدست میکند. این ابزار از بیش از 60 زبان پشتیبانی میکند، از جمله آمهری (አማርኛ)، تیگرینیایی (Tigrinya) و اورومو (Oromo). بنابراین مقالهای که ابتدا در زبان کاریتان به دقت طرحریزی میکنید میتواند به انگلیسی آکادمیک منتقل شود و همچنان «مالِ شما» بماند.
فرقی ندارد که در دانشگاه آدیس آبابا (Addis Ababa University) در پایتخت مینویسید یا در یک پردیس منطقهای که پشتیبانی انگلیسیِ محدودی دارد. میتوانید از هر کجا و با اتصال اینترنت از آن استفاده کنید. این موضوع در کشوری که شکاف زبانی میان مؤسسات زیاد است اهمیت زیادی دارد؛ و فشار برای انتشار در همهجا یکسان است.
نوشتن به آمهری؟ بهصورت خودکار تشخیص داده میشود و بومیسازی میگردد
بسیاری از پژوهشگران اتیوپیایی پیش از نوشتن به انگلیسی، ابتدا در آمهری (Amharic) پیشنویس تهیه میکنند و هومانیزر این کار را همانطور مستقیم مدیریت میکند. متن آمهری (አማርኛ) را بچسبانید؛ ProofreaderPro بهصورت خودکار خط Ge'ez را تشخیص میدهد، سپس آن را با استفاده از یک مدلِ آگاه از زبان پردازش میکند تا اصطلاحات و ارجاعات شما دقیقاً همانطور که نوشته شدهاند باقی بماند. پیشنویس آمهری شما به همان اندازه پیشنویس انگلیسیتان انسانیسازی میشود؛ بنابراین لازم نیست ابتدا آن را ترجمه کنید. همین تشخیص برای بیش از شصت زبان اعمال میشود و هر متن، با توجه به خطِ همان زبان بازنویسی میشود.

هومانیزر ProofreaderPro متن آکادمیک آمهری را بازنویسی میکند. مقایسه «قبل و بعد» معنا و ارجاعات را حفظ میکند و بررسیهای سامانههای تشخیص تأیید میکنند که قرائت انسانی و طبیعی است.
چرا پژوهشگران اتیوپیایی توسط سامانههای تشخیص هوش مصنوعی پرچم میخورند
در سال 2023، یک مطالعه در دانشگاه استنفورد (Stanford) توسط Liang و همکاران، در ژورنال Cell Press با عنوان Patterns منتشر شد و تیتر صریحی داشت: "GPT detectors are biased against non-native English writers." تیم، انشاهای TOEFL نوشتهشده توسط انسان را از میان هفت سامانه تشخیص هوش مصنوعیِ بسیار رایج عبور داد. هر انشا نویسنده انسانی داشت.
سامانهها حدود 61% از انشاهای غیرزبانمادری را بهعنوان تولیدشده توسط هوش مصنوعی علامت زدند؛ در حالی که این رقم برای نویسندگانِ انگلیسیِ زبانمادری حدود 5% بود. تقریباً از هر پنج نفرِ یک نفر (حدود 19.8%) بهصورت یکصدا توسط همه سامانههای موجود در این مجموعه پرچم خورد. هیچکدام توسط یک ماشین نوشته نشده بود.
مکانیسم «شگفتی» (perplexity) است. بسیاری از سامانهها نمره میدهند به اینکه هر انتخاب واژه تا چه حد برای یک مدل زبانی «غیرمنتظره» است. نویسندگانِ دقیق در زبان دوم به واژههای رایج و عبارتبندی استاندارد و قابلپیشبینی متکی میشوند؛ همین امر perplexity پایین ایجاد میکند و در نتیجه متن شبیه نوشته ماشین به نظر میرسد. عادتهایی که باعث میشود آکادمیکهای آمهریزبان در انگلیسی روشن باشند دقیقاً همانهایی هستند که این ابزارها برای شناساییشان آموزش دیدهاند. ما کل مکانیسم را در why AI detectors flag non-native writers بهطور کامل توضیح میدهیم.
الگوهای زبان اول آمهری که پشت «پرچمهای خطا» قرار دارند
آمهری یک زبان سامی (Semitic) است که با خط Ge'ez نوشته میشود و دستور زبان آن به شکلهای نظاممند با انگلیسی تفاوت دارد. پژوهشی درباره نوشتار دانشجویان اتیوپیایی نشان داد 55.6% از دانشجویان میگویند نحویِ آمهری مستقیماً انگلیسیشان را شکل میدهد. این بخشی است که سامانههای تشخیص از آن غافل میشوند: وقتی این الگوها را اصلاح کنید، نثر شما دقیقاً به سطح «استانداردِ کتابدرسی» تبدیل میشود؛ و «استانداردِ کتابدرسی» دقیقاً همان چیزی است که بهعنوان perplexity پایین خوانده میشود.
صدا (Passive voice). در نگارش رسمی آمهری، ساختهای غیرشخصی ترجیح داده میشود و آموزش انگلیسیِ قدیمیتر در اتیوپی، «Passive voice» را بهعنوان "more academic" آموزش میداد. حدود 32% از نسخههای خطی بهشدت روی آن تکیه میکنند. نثرِ مجهول هم از نظر دستور زبان درست است و هم یکدست؛ و همین یکدستی، یک نشانه دیگر برای این است که سامانه تشخیص، ریتمِ ماشینمانند را دریافت میکند.
زمان فعل. آمهری زمان، جنبه و وجه را از طریق ریشههای همخوانی و الگوهای مصوت منتقل میکند؛ اینها بر گذشته، حال و آینده در انگلیسی تطبیق مستقیم ندارند. حدود 28% از نسخههای خطی در یک بخش، زمان را جابهجا میکنند. وقتی ویراستار این جابهجاییها را در یک زمانِ ثابت و یکدست یکپارچه میکند، نتیجه یکنواخت و قابلپیشبینی میشود.
تطابق فاعل و فعل. در آمهری، فاعل داخل خودِ فعل رمزگذاری میشود؛ بنابراین تطابق صریحی که انگلیسی از شما میخواهد میتواند زائد و تکراری به نظر برسد. حدود 23% از نسخههای خطی، خطاهای تطابق با موضوعات/فاعلهای پیچیده را دارند؛ مثل "The analysis of the collected data from all three sites show." وقتی اینها اصلاح میشوند، تبدیل به یک ساخت تمیز و منظم میگردند؛ نشانهای دیگر از اینکه متن کمغافلگیرکننده است.
حذف حروف تعریف. آمهری معادل مستقیمی برای "a," "an," یا "the" ندارد؛ بنابراین حروف تعریف حذف میشوند: "Result was significant" بهجای "The result was significant." این حروف را به همان شکل برگردانید که یک نویسنده دقیق انجام میدهد؛ آنگاه ارجاع دقیقتر و استانداردتر میشود.
ترتیب واژگان. آمهری، جزءِ توصیفی/توصیفگر را پیش از اسمِ اصلی میگذارد؛ بنابراین در ترتیبی دیگر از انگلیسی قرار میگیرد و ترکیبهایی مثل "temperature increase rate" به جای "rate of temperature increase" تولید میکند. وقتی این ترتیب ثابت میشود، متن شبیه انگلیسی فنیِ تمیز میخوانَد.
هیچکدام از اینها تقلب نیست و هیچکدام ضعف هم نیست. اینها شیوههای نوشتنیِ دقیق هستند که فقط قابلپیشبینیاند، و یک هومانیزر، تنوع طبیعیای را که یک سامانه تشخیص انتظار دیدنش را دارد دوباره برقرار میکند.
زمینه تشخیص هوش مصنوعی در اتیوپی و Turnitin
Turnitin یا iThenticate یکی از ابزارهایی است که برای بررسی شباهتها در پایاننامهها و ارسالهای ژورنالی در دانشگاههای دولتی اتیوپی استفاده میشود. استفاده از شاخصهای هوش مصنوعی دارد به رویهای رایج تبدیل میشود. ارتقای علمی به انتشار در ژورنالهای نمایهشده بینالمللی زیر بخشنامه هماهنگشده وزارت علوم و آموزش عالی (MoSHE) نیاز دارد. این یعنی همه مقالات تحت بررسی دقیقتر قرار میگیرند، نه کمتر.
برای یک پژوهشگر اتیوپیایی، دانستن میزان لرزانبودن این نمرههای هوش مصنوعی کمک میکند. در سال 2023، وندربیلت (Vanderbilt) بهدلیل مثبتهای کاذب و سوگیری علیه نویسندگان غیرزبانمادری، تشخیصدهنده AI در Turnitin را خاموش کرد. دانشگاههای میشیگان استیت (Michigan State)، UT آستین (UT Austin)، نورثوسترن (Northwestern)، پیتسبورگ (Pittsburgh)، SMU و واترلو (Waterloo) نیز چنین کردند. خودِ Turnitin نیز نمرهها را در بازه 1 تا 19% سرکوب میکند و هشدار میدهد که این عدد نباید بهتنهایی برای تصمیمگیری درباره موارد مربوط به یکپارچگی (integrity) استفاده شود.
جمعبندی برای پژوهشگر اتیوپیایی ساده است: پرچمِ هوش مصنوعی یک ادعا است که میتوانید با آن مخالفت کنید، نه یک حکم نهایی. هیچ دانشجویی نگفت "sued Turnitin and won"؛ اختلافهای واقعی درباره این بود که مدارس چگونه از یک پرچم استفاده میکردند. وظیفه شما این است که نوشتار خود را شفاف نگه دارید و پیش از هر چیز اجازه ندهید آن را اشتباه بخوانند.
پیش نویس خود را انسانی کنید، همه ارجاعات را حفظ کنید
مقاله خود را که با کمک AI تهیه شده است بارگذاری کنید و بگذارید انسانیساز، تنوع طبیعی را بازگرداند، در حالی که معنا، اصطلاحات و ارجاعات حفظ میشوند. مخصوص پژوهشگران انگلیسیزبان آمهرایی.
نسخه رایگان Humanizer را امتحان کنیددانشگاههای برتر اتیوپی و اینکه بررسیهای هوش مصنوعی کجا ظاهر میشود
سامانه دانشگاهی اتیوپی به بیش از 47 مؤسسه عمومی رسیده و قویترین تولیدکنندگان پژوهش، همه پایاننامهها و نسخههای خطی را برای شباهت و شاخصهای هوش مصنوعی غربال میکنند. اگر در هر یک از اینها بنویسید، جریان کاری زیر برای شما هم اعمال میشود:
- دانشگاه آدیس آبابا (አዲስ አበባ ዩኒቨርሲቲ))، قدیمیترین و پژوهشمحورترین دانشگاه کشور، در پایتخت.
- دانشگاه جیمّا (ጅማ ዩኒቨርሲቲ))، قوی در علوم سلامت و بهداشت عمومی.
- دانشگاه بِهیر دار (ባህር ዳር ዩኒቨርሲቲ))، یک قطب رو به رشد برای مهندسی، کشاورزی و آموزش در منطقه آمهارا.
- دانشگاه گوندَر (ጎንደር ዩኒቨርሲቲ))، شناختهشده برای پزشکی و علوم دامپزشکی.
- دانشگاه هَووَسا (ሃዋሳ ዩኒቨርሲቲ))، یک تولیدکننده برتر در کشاورزی و علوم طبیعی.
- دانشگاه مِکِلِه (መቀሌ ዩኒቨርሲቲ))، یک دانشگاه بزرگ پژوهشی در تیگرای با قوت در کشاورزی دیم و علوم زمینسنجی.
- دانشگاه علوم و فناوری آداما (አዳማ ሳይንስና ቴክኖሎጂ ዩኒቨርሲቲ))، متمرکز بر مهندسی و فناوری.
- دانشگاه هارامایا (ሀረማያ ዩኒቨርሲቲ))، یکی از قدیمیترینها، قوی در کشاورزی و پزشکی دامپزشکی.
- دانشگاه آربا مینچ (አርባ ምንጭ ዩኒቨርሲቲ))، شناختهشده برای فناوری آب و پژوهشهای زیستمحیطی.
- دانشگاه دِبرِه بِرهان (ደብረ ብርሃን ዩኒቨርሲቲ))، یک دانشگاه منطقهای با ظرفیت پژوهشی در حال توسعه سریع.
در اینجا اهمیت «شکاف مهارت منطقهای» را میبینیم. آدیس آبابا در شاخص EF English Proficiency نمره 522 میگیرد، اما منطقه آمهارا نمره 436 دارد (اختلاف 86 امتیاز). بنابراین پژوهشگری در بِهیر دار یا گوندَر دشوارترِ بیشتری نسبت به همتای خود در آدیس آبابا دارد. با این حال، آنها مجموعهای یکسان از قوانین و سامانههای تشخیص یکسانی دارند. ابزاری که از هر اتصال اینترنتی کار کند، کمک میکند این میدان تا حدی همسطح شود.
نحوه کار هومانیزر هوش مصنوعی برای پژوهشگران اتیوپیایی
در ادامه، جریان کاری پیشنهادی ما را از ابتدا تا انتها میبینید.
ابتدا پیشنویس. استدلال خود را به هر زبانی که برایتان سریعتر فکر میکند بنویسید: آمهری، اورومو، تیگرینیایی یا انگلیسی. اگر پیشنویس را در زبان کاریتان بنویسید، AI translator ما آن را به انگلیسی آکادمیک منتقل میکند و در عین حال اصطلاحات و ساختار شما را حفظ میکند.
دوم، ویراستاری. بخش دستور زبان را اجرا کنید تا چگالیِ «صدا» (passive-voice) را که در بالا گفته شد کم کنید، جابهجایی زمان (tense drift) را اصلاح کنید، خطاهای تطابق (agreement slips) را برطرف کنید و حروف تعریفِ از قلم افتاده را اضافه کنید. انگلیسیِ تمیز و اصلاحشده، پایه کار است و هومانیزر جایگزین آن نیست.
سوم، انسانیسازی. پیشنویس یاریشده با هوش مصنوعیِ خودتان را بردارید و آن را از طریق text humanizer اجرا کنید. این کار ریتم جملهها و انتخاب واژهها را متغیر میکند، ریتمهای تکراری و خط تیرههای (em dashes) سرگردان را حذف میکند و همان تنوع طبیعیای را بازمیگرداند که یک سامانه تشخیص انتظار دارد—همه اینها در حالی است که معنا، اصطلاحات فنی و ارجاعات شما حفظ میشوند.
هومانیزر ما که در برابر سامانههای اصلی تشخیص آزمایش شده، متنِ تولیدشده با هوش مصنوعی را به شکلی طبیعیتر بازکار میکند که در Turnitin، Originality.ai و GPTZero انسانیتر دیده میشود؛ در عین حال دقت دستور زبان در متن آکادمیک همچنان بالا میمانَد. اینها نتایج آزمون هستند، نه تضمین. سامانههای تشخیص هر چند ماه یکبار دوباره آموزش میبینند و هیچ ابزار جدیای وعده «غیرقابلتشخیص بودن» نمیدهد. هدف، انصاف برای کار واقعی است، نه استتار.
چهارم، اعلام. استفاده خود از هوش مصنوعی را دقیقاً در قالبی بنویسید که مؤسسه و ژورنال هدف شما میخواهند. انسانیسازیِ نوشتار خود و اعلام اینکه از هوش مصنوعی استفاده کردهاید، با هم در تعارض نیستند؛ این دو با هم باعث میشوند در چارچوب قوانین یکپارچگی بمانید، در حالی که از یک متنِ دقیقِ زباندوم که به اشتباه پرچم «خطا» میخورد محافظت میکنید.
این مرحله انسانیسازی، مکمل راهنمای ما برای academic editing for Ethiopian researchers است و درون هاب گستردهتر multilingual AI humanizer hub قرار میگیرد که پوششدهنده پژوهشگرانی است که به دهها زبان مینویسند.
نهادهای تأمین مالی محلی، ژورنالها و انتظارات اعلام استفاده از هوش مصنوعی
تأمین مالی پژوهش در اتیوپی عمدتاً از دولت و از طریق کمکهزینههای دانشگاهی زیر نظر MoSHE و نیز پروژههای توسعه بینالمللی و همکاریهای سازمانهای مردمنهاد (NGO) تأمین میشود. بیشتر این بودجهها بر حوزههای سلامت، کشاورزی و مهندسی متمرکز است؛ جایی که ژورنالهای هدف همگی به انگلیسی منتشر میشوند. «مخزن دیجیتال ملی آکادمیک اتیوپی» (NADRE) انتشار با دسترسی آزاد برای پژوهشهای عمومیِ تأمینشده را الزامی میکند. دسترسی آزاد یعنی انتشار به انگلیسی. پژوهشگران باید منتشر کنند تا ارتقا بگیرند و بودجههای آینده را نیز تضمین کنند.
ژورنالهای نمایهشده داخلی کشور، ارسالها را مطابق استانداردهای زبانی بینالمللی بررسی میکنند:
- Ethiopian Journal of Health Sciences که در MEDLINE و Scopus نمایه شده است.
- Ethiopian Journal of Health Development که در Scopus و Web of Science نمایه شده است.
- Ethiopian Medical Journal که یکی از قدیمیترین ژورنالهای پزشکی آفریقا است.
- Ethiopian Journal of Education and Sciences که حوزه آموزش و تعلیموتربیت را پوشش میدهد.
- Ethiopian Journal of Agricultural Sciences که پژوهشهای کشاورزی اتیوپی را پوشش میدهد.
تأمینکنندگان مالی و ژورنالها بهطور فزاینده از نویسندگان میخواهند استفاده از هوش مصنوعی را اعلام کنند و این انتظار فقط رو به رشد است. الگوی امن در همهجا یکسان است: نوشتار خود را برای انصاف انسانیسازی کنید، پیش از ارسال مقاله را از طریق text humanizer اجرا کنید، سپس دقیقاً اعلام کنید از هوش مصنوعی چگونه استفاده کردهاید. اگر همچنان یک سامانه تشخیص، یک کار دقیق و مشروع را پرچم زد، شما حق کامل دارید که این پرچم را به اعتراض بکشید و با ویراستار خود درباره آن صحبت کنید؛ نه اینکه آن را بهعنوان نتیجه نهایی بپذیرید.
پرسشهای پرتکرار
س: آیا یک هومانیزر هوش مصنوعی به پژوهشگران اتیوپیایی کمک میکند تا Turnitin را منصفانه پشت سر بگذارند؟
کمک میکند، در معنای واقعی. تنوع طبیعی را به انگلیسیِ دقیق و مراقبانهای که شما با کمک هوش مصنوعی نوشتهاید برمیگرداند تا احتمال اینکه سامانه تشخیص آن را اشتباه بخواند کمتر شود. در آزمایشهای ما، هومانیزر متنِ مبتنی بر هوش مصنوعی را به شکلی انسانیتر بازنویسی میکند؛ بنابراین «سیگنال هوش مصنوعی» در Turnitin کاهش مییابد. با این حال سامانههای تشخیص مدام دوباره آموزش میبینند و هیچ ابزار جدیای نمیتواند وعده دهد که غیرقابلتشخیص میشود. هر پرچمی را بهعنوان ادعایی برای بحث در نظر بگیرید، کارتان را واقعی نگه دارید و استفاده از هوش مصنوعی را اعلام کنید.
س: اگر ابتدا در آمهری پیشنویس تهیه کنم، آیا هومانیزر کار میکند؟
بله. بسیاری از پژوهشگران اتیوپیایی سریعترین فکرشان در آمهری، اورومو یا تیگرینیایی شکل میگیرد. شما میتوانید پیشنویس را به زبان کاریتان بنویسید، آن را به انگلیسی آکادمیک منتقل کنید، دستور زبان را ویراستاری کنید و سپس انسانیسازی را انجام دهید؛ و ابزار در هر مرحله، معنا و ارجاعات شما را حفظ میکند، در بیش از 60 زبان.
س: آیا استفاده از هومانیزر هوش مصنوعی بهعنوان تقلب در نظر گرفته میشود؟
خیر؛ وقتی آن را فقط روی کار خودتان استفاده کنید و اعلامش کنید. انسانیسازی یعنی ریتمِ ماشینمانندِ پیشنویسی را که خودتان نوشته و پژوهش کردهاید نرمتر و طبیعیتر کنید و معنا را دستنخورده نگه دارید. تقلب این است که کارِ جعلی تحویل دهید یا کارِ شخص دیگری را ارائه کنید. اعلامِ کمک واقعیِ هوش مصنوعی دقیقاً برعکسِ پنهانکاری است.
س: چرا حتی مقالاتی با انگلیسی دقیق و درست هم پرچم میخورند؟
چون بسیاری از سامانهها نمره perplexity میدهند؛ یعنی اینکه انتخابهای واژگانی شما چقدر قابلپیشبینی است. نگارش آکادمیکِ زبان دوم معمولاً استاندارد و کمغافلگیرکننده است و همین «پروفایل کمغافلگیرکننده» چیزی است که این ابزارها آموزش دیدهاند تا آن را «تولیدشده توسط ماشین» بنامند. یک مطالعه در دانشگاه استنفورد نشان داد حدود 61% از انشاهای غیرزبانمادریِ نوشتهشده توسط انسان بهعنوان هوش مصنوعی پرچم میخورند؛ بنابراین این یک سوگیری شناختهشده است، نه بازتابی از توانایی شما.
س: آیا انسانیسازی ارجاعات یا اصطلاحات فنی من را تغییر میدهد؟
خیر. هومانیزر، ارجاعات شما، دادهها و اصطلاحات تخصصی حوزهتان را حفظ میکند؛ در حالی که ریتم جملهها و انتخاب واژهها را متنوع میکند. شما هر تغییر را مرور میکنید، بنابراین هیچچیز در منابع یا یافتههای شما بدون تأیید شما جابهجا نمیشود.
تنوع طبیعی را به انگلیسی آکادمیکِ تهیهشده با کمک AI خود بازگردانید، هر استناد را حفظ کنید و با اعتماد به نفس افشا کنید. مخصوص پژوهشگران اتیوپیایی که برای مجلات بینالمللی مینویسند.

Moe یک مهندس NLP با PhD در پردازش زبان طبیعی است. تحقیقات او زبانشناسی محاسباتی، تجزیه و تحلیل متن و یادگیری ماشین را پوشش میدهد و مستقیماً به مدلهای ویرایش و انسانیسازی پشت ProofreaderPro وارد میشود. او در مورد بخشی از فرآیند می نویسد که اکثر مردم هرگز نمی بینند: چگونه یک مدل زبان جمله ای را می خواند، آن را نمره می دهد و تصمیم می گیرد چه چیزی را تغییر دهد.