آیا Turnitin میتواند ChatGPT را تشخیص دهد؟ آنچه را میگیرد و آنچه را از دست میدهد
گزارش نگارش AI در Turnitin و گزارش همانندی آن دو محصول متفاوت با مخاطبان متفاوت و سوابق دقت متفاوت هستند. در اینجا میبینید امتیاز AI دقیقا چه چیزی را میسنجد، آزمونهای مستقل کجا نشان میدهند که دچار خطا میشود، و چرا گزارش شما ممکن است شبیه گزارش هماتاقیتان نباشد.
بله، اما فقط برای یک نوع خاص از استفاده از AI، و درون گزارشی که بیشتر دانشجویان هرگز آن را نمیبینند. نشانگر نوشتار AI در Turnitin نثری را علامتگذاری میکند که از نظر آماری شبیه متن معمول یک مدل زبانی به نظر میرسد، و این کار را در سهم رو به رشدی از مقالههایی که بررسی میکند انجام میدهد: حدود 15 درصد از نوشتهها بین October 2025 و February 2026، 80 درصد یا بیشتر نوشتار تولیدشده توسط AI را نشان دادند، در حالی که این رقم هنگام عرضه ابزار در April 2023 حدود 3 درصد بود. این که آیا ارسال مشخص شما علامتگذاری میشود یا نه، به جزئیاتی بستگی دارد که بیشتر پاسخها به can Turnitin detect ChatGPT از کنار آن میگذرند: این که گزارش AI چه تفاوتی با گزارش سرقت ادبی دارد، چه کسی در عمل عدد را میبیند، و این که آن عدد هر چند وقت یک بار نادرست از آب درمیآید.
این نوشته به سازوکار همین یک محصول میپردازد، نه به یکپارچگی دانشگاهی به طور کلی. در آن توضیح داده میشود که گزارش نوشتار AI چه چیزی را میسنجد، آزمونهای مستقل چه چیزهایی را درست و نادرست یافتهاند، و چرا دو دانشجو که کار یکسانی را تحویل میدهند ممکن است بسته به این که در کدام دانشگاه تحصیل میکنند، به نتایج متفاوتی برسند. هیچ یک از اینها آنچه را راهنمای درس خود شما درباره استفاده مجاز از AI میگوید تغییر نمیدهد. این متن، به جای یک حدس درباره یک جعبه سیاه، توصیفی از آن چیزی ارائه میکند که واقعاً درون آن است.
Can Turnitin Detect ChatGPT? گزارش واقعاً چه چیزی را نشان میدهد
گزارش نوشتار AI در Turnitin محصولی جدا از گزارش شباهت است که سرقت ادبی را بررسی میکند. این دو بر پایه مدلهای متفاوتی اجرا میشوند و در زبانههای متفاوتی در همان رابط کاربری نمایش داده میشوند. امتیاز شباهت، ارسال شما را بررسی میکند و آن را با پایگاه دادهای از منابع پیشتر منتشرشده و دیگر نوشتههای دانشجویی مقایسه میکند تا درصدی را که تطابق دارد برگرداند. امتیاز AI کار کاملاً دیگری انجام میدهد: این یک طبقهبند است که نثر شما را جمله به جمله میخواند، برای هر جمله احتمال تولیدشده توسط AI بودن را تعیین میکند، و سپس این امتیازهای سطح جمله را به یک درصد واحد برای کل سند تبدیل میکند. چون این دو چیزهای متفاوتی را میسنجند، یک ارسال میتواند امتیاز شباهت 2 درصد و امتیاز AI 60 درصد داشته باشد، یا برعکس.
این درصد در واقع از آنچه به نظر میرسد محدودتر است. این نسبتِ نثرِ واجد شرایطی است که مدل پیشبینی میکند توسط AI نوشته شده است, نه کل سند, زیرا هنگام محاسبه امتیاز, مواردی مانند بلوکهای کد, فهرستهای گلولهای, سرفصلها و نوشتار کوتاه را حذف میکنند. این آشکارساز فقط بر اسنادی قابل اعمال است که دستکم 300 واژه نثرِ بلند داشته باشند, و تا زمان نگارش این متن, فقط برای متنهای انگلیسی, اسپانیایی و ژاپنی است. همانطور که انتظار میرود, اگر آن را در کنار اینکه آشکارسازهای AI آن امتیاز را چگونه محاسبه میکنند به طور کلی بگذاریم, الگوی اینجا آشناست: یک عدد در سطح سند که دقیق به نظر میرسد, بر پایه بخشی محدودتر از متن ساخته شده است تا آنچه رقمِ تیتر القا میکند.
چه چیزهایی به عنوان AI ظاهر میشوند: ChatGPT و بقیه
Turnitin میگوید طبقهبند آن به دنبال الگوی نوشتار است, نه نام یک برند, و دامنه پوشش آن از زمان عرضه اولیه GPT-3.5 و GPT-4 در 2023 بارها گسترش یافته است. راهنمای کنونی, سری GPT-5, Gemini و Claude را در میان سامانههایی نام میبرد که مدل بر ضد آنها آموزش دیده است, و نسخههای جدید مدل به صورت مستمر افزوده میشوند. این شامل متنی هم میشود که هرگز مستقیماً با ChatGPT تماس نداشته است. دانشجویی که به جای آن از Gemini, Claude یا DeepSeek استفاده کرده است, صرفاً با انتخاب یک شرکت دیگر, آشکارساز را دور نمیزند, زیرا توصیف خود Turnitin از مدل صریح است که معیار آن این نیست که کدام فروشنده متن را تولید کرده است, بلکه این است که متن چگونه خوانده میشود.
متن AI بازنویسیشده, دستهبندی جداگانه خود را دارد, نه معافیت. مستندات Turnitin میان متنی که آن را صرفاً AI-generated میداند و متنی که آن را AI-generated و سپس AI-paraphrased میداند تفکیک میکند, و در اوت 2025 تشخیصِ هدفگیریشدهای را افزود که مشخصاً معطوف به ابزارهای AI bypasser است که برای بازنویسی خروجی ماشین به گونهای ساخته شدهاند که از آشکارساز عبور کند. این به آن معنا نیست که بازنویسی بیفایده است یا هر بخش بازنویسیشدهای شناسایی میشود. معنایش این است که این فرض که بازنویسی به طور پیشفرض برای Turnitin نامرئی است, مدتهاست که دیگر بهروز نیست.
امتیاز AI Turnitin چقدر دقیق است؟
ادعای دقت Turnitin به یک عدد اصلی خلاصه میشود: این شرکت میگوید نرخ مثبت کاذب را در اسنادی که بیش از 20 درصد متن آنها علامتگذاری میشود، پایینتر از 1 درصد نگه میدارد. این شرکت همچنین میگوید هر نسخه جدید از مدلهای خود را در برابر 700,000 مقاله دانشگاهی که پیش از وجود ChatGPT نوشته شدهاند آزمایش میکند تا این دقت را تأیید کند. این یک ادعای مشخص و قابل آزمون درباره مجموعهای خاص از شرایط است. شایسته است که دقیقاً به همین صورت خوانده شود. Turnitin در 2023، اندکی پس از عرضه خود، ادعاهای دیگری نیز درباره دقت مطرح کرده است. مدیر ارشد محصول این شرکت بهطور عمومی اذعان کرد که آزمونهای آزمایشگاهی پیشبینی نمیکردند چند مورد مثبت کاذب در استفاده واقعی ظاهر خواهد شد، بهویژه در ارسالهای کوتاه، و گفت درصد مثبتهای کاذب در عمل از آزمونها بالاتر بوده است. او نرخ مثبت کاذب در سطح جمله را حدود 4 درصد گزارش کرد و اشاره کرد که Turnitin در نتیجه، حداقل طول ارسالهایی را که میتوان برای آنها امتیاز محاسبه کرد از 150 به 300 کلمه افزایش داد. حداقل فعلی همچنان 300 کلمه است.
آزمون مستقل جزئیاتی را اضافه میکند که رقم ارائهشده از سوی فروشنده آن را نشان نمیدهد. مرکز پیشبرد آموزش در Temple University یکی از دقیقترین بررسیهای موجود را انجام داد، در همان روحی که آزمون مستقل آشکارسازهای AI دنبال میکند و پیوسته شکافهایی میان شرایط آزمایشگاهی و ارسالهای واقعی نشان میدهد. پژوهشگران 120 نمونه نوشتاری ارائه کردند که بهطور مساوی میان نوشتار کاملاً انسانی، نوشتار کاملاً تولیدشده توسط AI، نوشتار تولیدشده توسط AI که از یک ابزار بازنویسی عبور داده شده بود، و متنهای ترکیبی که مشارکتهای انسانی و AI را در هم میآمیختند تقسیم شده بودند، و آنچه Turnitin برای هر کدام بازگرداند را ثبت کردند. این ابزار 93 درصد از نمونههای کاملاً انسانی و 77 درصد از نمونههای کاملاً تولیدشده توسط AI را بهدرستی شناسایی کرد.
در پرسشهای دشوارتر، دقت حتی بیشتر کاهش یافت. Turnitin تنها 63 درصد از نمونههای بازنویسیشده توسط AI را بهدرستی بهعنوان تولیدشده توسط AI شناسایی کرد و فقط 43 درصد از نمونههای ترکیبی را بهدرستی نه کاملاً انسانی و نه کاملاً AI تشخیص داد، یعنی همان دستههایی که به نحوه واقعی تولید نوشتارِ کمکگرفته از AI نزدیکترند. متن ترکیبی، بهویژه، برای پژوهشگران اهمیت داشت، زیرا آنان معتقدند که احتمالاً در آینده بخش بزرگی، و شاید اکثریت، از ارسالهای واقعی را تشکیل خواهد داد، زیرا هرچه تعداد بیشتری از درسها تکالیفی را تعیین میکنند که از دانشجویان میخواهند برای بخشی از کار از AI استفاده کنند.
| چه چیزی آزموده شد | نتیجه Turnitin |
|---|---|
| نمونههای 100% نوشتهشده توسط انسان | 93% بهدرستی بهعنوان انسانی شناسایی شد |
| نمونههای 100% تولیدشده توسط AI | 77% بهدرستی بهعنوان AI شناسایی شد |
| متن AI که از یک ابزار بازنویسی عبور داده شده بود | 63% بهدرستی بهعنوان AI شناسایی شد |
| نمونههای ترکیبی، بخشی انسانی و بخشی AI | 43% بهدرستی بهعنوان نه 0% و نه 100% شناسایی شد |
| اسنادی با بیش از 20% علامتگذاریشده، رقم خود Turnitin | نرخ مثبت کاذب کمتر از 1% |
Humanize your own paper
Transform your AI-assisted text and make it sound human, without touching important words or citations.
جایی که حتی وقتی عدد درست به نظر میرسد، باز هم کارکرد آن دچار اختلال میشود
امتیاز در سطح سند تنها چیزی نیست که یک مدرس میتواند ببیند، و نمای دیگر کمتر قابل اعتماد است. برخی رابطها به مدرس اجازه میدهند گزارشی از علامتگذاری را باز کند که جملات مشخصی را بهعنوان احتمالاً نوشتهشده توسط AI برجسته میکند. پژوهشگران Temple این برجستهسازیها را با اینکه کدام جملات در نمونههای ترکیبی آنان واقعاً توسط AI نوشته شده بودند مقایسه کردند و هیچ رابطهای میان این دو نیافتند. این موضوع اهمیت دارد اگر استادی بهجای درصد خلاصه، تصویری از یک بند برجستهشده برای شما بفرستد: امتیاز کلی سند بهمراتب بهتر از برجستهسازیهای سطح جمله عمل کرد.
امتیازهای پایین دوباره به شکلی متفاوت، و با احتیاط بیشتری نسبت به گذشته، مدیریت میشوند. از July 2024، Turnitin به جای عدد، یک ستاره نمایش میدهد هرگاه مدل آن برآورد کند که کمتر از 20 درصد یک سند بهوسیله AI نوشته شده است، زیرا این بازه همان جایی است که احتمال خطای ابزار در هر دو جهت بیشترین است. یک ویرایش سبک با کمک AI، یعنی بازنویسی یک پاراگراف با کمک و نوشتن بقیه بدون کمک، اغلب به جای یک درصد کوچک، هیچ درصد قابل مشاهدهای تولید نمیکند، و این نکته پیش از آنکه نبودِ عدد را بهعنوان دلیلی برای هر چیزی تلقی کنیم، ارزش دانستن دارد.
چه کسانی در عمل عدد را میبینند
امتیاز AI به طور پیشفرض بخشی از گزارشِ قابل مشاهده برای دانشجو نیست. این امتیاز در زبانهای جداگانه قرار دارد، برای مدرسان و مدیران قابل مشاهده است، و دانشجو فقط در صورتی آن را میبیند که مدرس تصمیم بگیرد گزارش را به اشتراک بگذارد یا آن را مستقیماً مطرح کند. این یک تفاوت ساختاری واقعی با امتیاز شباهت است، زیرا دانشجویان معمولاً میتوانند پس از پردازش یک ارسال، خودشان آن را در همان سامانه مشاهده کنند.
همین موضوع درباره این که آیا این ویژگی اصلاً برای یک درس مشخص وجود دارد یا نه نیز صدق میکند، و این یک تصمیم نهادی است که فراتر از مدرس قرار دارد. مدیران در سطح حساب کاربری میتوانند تشخیص AI در Turnitin را برای یک مؤسسه کامل روشن یا خاموش کنند. ممکن است یک مدرس نتواند آن را روشن کند اگر دانشگاه او آن را خاموش کرده باشد، و برعکس. دانشجویی از یک دانشگاه که کاری مشابه را به دانشجویی دیگر از دانشگاهی متفاوت ارسال میکند، ممکن است تجربهای بسیار متفاوت از این ابزار داشته باشد، به دلایلی که هیچ ارتباطی با آنچه هر یک از آنها نوشتهاند ندارد.
چرا برخی دانشگاهها آن را خاموش کردهاند
دانشگاه واترلو در سپتامبر 2025 قابلیت تشخیص هوش مصنوعی Turnitin را متوقف کرد، و استدلال منتشرشده آن بهطور غیرمعمولی صریح است. این دانشگاه به غیرقابلاعتماد بودن مستندشده این ابزار، سوگیری آن علیه دانشجویانی که زبان اولشان انگلیسی نیست، و آزمونهای داخلی خود اشاره کرد، آزمونهایی که دستکم یک مورد از متن کاملا نوشتهشده توسط انسان را شامل میشد که 100 درصد بهعنوان تولیدشده توسط هوش مصنوعی امتیاز گرفته بود. دانشگاه با در نظر گرفتن هزینه این ابزار، نتیجه گرفت که هزینهها از مزایا بیشتر است و در عوض تلاش را به سمت بازطراحی ارزیابی و آموزش سواد هوش مصنوعی هدایت کرد.
واترلو یک نمونه آشکار از یک شکاف گستردهتر است، نه یک مورد استثنایی. دانشگاههایی که این قابلیت را روشن نگه میدارند، عموما بهجای آنکه امتیاز را بهتنهایی یک حکم بدانند، برای آن حفاظهایی افزودهاند، و پیش از آغاز هر اقدام رسمی، گفتوگویی با دانشجو را الزامی میکنند و عدد را دلیلی برای گشودن آن گفتوگو میدانند، نه بستن آن. مطالعه اینکه دانشگاهها بهطور گستردهتر چگونه با سیاست AI برخورد میکنند این الگو را روشنتر میکند: اینکه اصلا امتیازی به شما برسد یا نه، به تصمیمی بستگی دارد که بسیار بالاتر از کلاس سمینار شما گرفته شده است، نه به ویژگی ثابتی از خود فناوری.
آنچه یک امتیاز بالا ثابت میکند، و آنچه ثابت نمیکند
یک امتیاز بالای AI یک قرینه است، نه یک حکم. خود Turnitin درصد را بهعنوان یکی از دادهها برای قضاوت مدرس صورتبندی میکند، نه بهعنوان یافتهای درباره تخلف، و ارقام دقت بالا توضیح میدهند که چرا این صورتبندی اهمیت دارد: حتی امتیاز در سطح سند که نسبتا خوب عمل میکند، بخش معناداری از نوشتارهای بهشدت ویرایششده، بازنویسیشده یا ترکیبی را بهاشتباه میخواند، و برجستهسازیهای سطح جمله بهمراتب از عدد خلاصه کماعتمادترند. هیچیک از اینها تضمین نمیکند که هر امتیاز منفردی نادرست است. معنایش این است که یک درصد، دلیلی برای پرسیدن پرسشهاست، نه یافتهای که بتوان آن را در نگاه اول پذیرفت. اگر میخواهید پیش از آنکه شخص دیگری نوشته شما را امتیازدهی کند ببینید متن خودتان در چه وضعی قرار دارد، همان الگوهای کمتنوع و عبارتپردازی کلی که یک طبقهبند به آنها واکنش نشان میدهد را میتوان مستقیما با یک free perplexity checker بررسی کرد.
TextPulse's انسانساز AI برای دانشجویان بر همان مبنای آماری کار میکند، و بررسیکننده رایگان burstiness آن برای نیمه مربوط به ریتم جمله در همان سنجش نیز همینطور است. این ابزار یک Human Score تخمینی بر پایه پیشنویس خودتان به شما میدهد، نه پیشبینی این که Turnitin درباره آن چه خواهد گفت. هیچ ابزاری نمیتواند بهطور مسئولانه درباره سامانهای که کنترلش را در اختیار ندارد چنین وعدهای بدهد. آن را فقط بهعنوان یک خوانش دوم از نوشته خودتان در نظر بگیرید، نه بیشتر.
چندین مورد از این پرسشها صفحههای جداگانه خود را دارند. این که آیا یک استاد میتواند بدون هیچ آشکارسازى تشخیص دهد که از ChatGPT استفاده کردهاید، و نسخه صریحتر آن، آیا گیر میافتم، جداگانه پاسخ داده شدهاند. همینطور رفتار Turnitin در برابر متن بازنویسیشده و نیز این که آیا Turnitin خروجی DeepSeek را تشخیص میدهد بهطور مشخص. برای تنظیمات خاص، نوشتههایی درباره تشخیص AI در برنامههای پرستاری و درباره این که آیا دفاتر پذیرش دانشگاهی این بررسیها را انجام میدهند وجود دارد. چارچوب کلیتر در نوشتهای جداگانه درباره یکپارچگی دانشگاهی و AI آمده است.
هیچیک از اینها به احتمال زیاد نسخه نهایی نیست. Turnitin از 2023 تاکنون بیش از یک بار آستانههای خود، قواعد نمایانی خود و پوشش مدلهایش را بازنویسی کرده است، و August 2026 نیز آخرین سخن نخواهد بود. آنچه ثابت میماند عادتی است که صرفنظر از این که یک درس معین از کدام آشکارساز استفاده میکند، ارزش داشتن دارد: آنقدر با جزئیات مشخص، نامنظم و واقعاً متعلق به خودتان بنویسید که آنچه یک طبقهبند ممکن است فکر کند، به حاشیه برود.
Frequently Asked Questions
نشانگر نگارش AI در Turnitin دقیقا برای پاسخ به همین پرسش وجود دارد. آیا Turnitin میتواند ChatGPT را تشخیص دهد؟ معمولا بله، وقتی یک سند شامل نگارش گسترده AI باشد: طبقهبند نثری را علامتگذاری میکند که از نظر آماری شبیه متن یک مدل زبانی است، و دادههای خود Turnitin نشان میدهد که اکنون حدود 15 درصد از مقالههای اسکنشده امتیاز نگارش شدیدا AI را میگیرند. همچنین بهطور منظم متن را از دست میدهد، و آزمونهای مستقل نشان دادهاند که دقت آن در نگارش AI بازنویسیشده به 63 درصد و در متن ترکیبی به 43 درصد کاهش یافته است.
PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.