AI Detection

آیا Turnitin می‌تواند ChatGPT را تشخیص دهد؟ آنچه را می‌گیرد و آنچه را از دست می‌دهد

گزارش نگارش AI در Turnitin و گزارش همانندی آن دو محصول متفاوت با مخاطبان متفاوت و سوابق دقت متفاوت هستند. در اینجا می‌بینید امتیاز AI دقیقا چه چیزی را می‌سنجد، آزمون‌های مستقل کجا نشان می‌دهند که دچار خطا می‌شود، و چرا گزارش شما ممکن است شبیه گزارش هم‌اتاقی‌تان نباشد.

8 min
Illustration answering can Turnitin detect ChatGPT, showing the AI writing report displayed separately from the similarity report

بله، اما فقط برای یک نوع خاص از استفاده از AI، و درون گزارشی که بیشتر دانشجویان هرگز آن را نمی‌بینند. نشانگر نوشتار AI در Turnitin نثری را علامت‌گذاری می‌کند که از نظر آماری شبیه متن معمول یک مدل زبانی به نظر می‌رسد، و این کار را در سهم رو به رشدی از مقاله‌هایی که بررسی می‌کند انجام می‌دهد: حدود 15 درصد از نوشته‌ها بین October 2025 و February 2026، 80 درصد یا بیشتر نوشتار تولیدشده توسط AI را نشان دادند، در حالی که این رقم هنگام عرضه ابزار در April 2023 حدود 3 درصد بود. این که آیا ارسال مشخص شما علامت‌گذاری می‌شود یا نه، به جزئیاتی بستگی دارد که بیشتر پاسخ‌ها به can Turnitin detect ChatGPT از کنار آن می‌گذرند: این که گزارش AI چه تفاوتی با گزارش سرقت ادبی دارد، چه کسی در عمل عدد را می‌بیند، و این که آن عدد هر چند وقت یک بار نادرست از آب درمی‌آید.

این نوشته به سازوکار همین یک محصول می‌پردازد، نه به یکپارچگی دانشگاهی به طور کلی. در آن توضیح داده می‌شود که گزارش نوشتار AI چه چیزی را می‌سنجد، آزمون‌های مستقل چه چیزهایی را درست و نادرست یافته‌اند، و چرا دو دانشجو که کار یکسانی را تحویل می‌دهند ممکن است بسته به این که در کدام دانشگاه تحصیل می‌کنند، به نتایج متفاوتی برسند. هیچ یک از این‌ها آنچه را راهنمای درس خود شما درباره استفاده مجاز از AI می‌گوید تغییر نمی‌دهد. این متن، به جای یک حدس درباره یک جعبه سیاه، توصیفی از آن چیزی ارائه می‌کند که واقعاً درون آن است.

Can Turnitin Detect ChatGPT? گزارش واقعاً چه چیزی را نشان می‌دهد

گزارش نوشتار AI در Turnitin محصولی جدا از گزارش شباهت است که سرقت ادبی را بررسی می‌کند. این دو بر پایه مدل‌های متفاوتی اجرا می‌شوند و در زبانه‌های متفاوتی در همان رابط کاربری نمایش داده می‌شوند. امتیاز شباهت، ارسال شما را بررسی می‌کند و آن را با پایگاه داده‌ای از منابع پیش‌تر منتشرشده و دیگر نوشته‌های دانشجویی مقایسه می‌کند تا درصدی را که تطابق دارد برگرداند. امتیاز AI کار کاملاً دیگری انجام می‌دهد: این یک طبقه‌بند است که نثر شما را جمله به جمله می‌خواند، برای هر جمله احتمال تولیدشده توسط AI بودن را تعیین می‌کند، و سپس این امتیازهای سطح جمله را به یک درصد واحد برای کل سند تبدیل می‌کند. چون این دو چیزهای متفاوتی را می‌سنجند، یک ارسال می‌تواند امتیاز شباهت 2 درصد و امتیاز AI 60 درصد داشته باشد، یا برعکس.

این درصد در واقع از آنچه به نظر می‌رسد محدودتر است. این نسبتِ نثرِ واجد شرایطی است که مدل پیش‌بینی می‌کند توسط AI نوشته شده است, نه کل سند, زیرا هنگام محاسبه امتیاز, مواردی مانند بلوک‌های کد, فهرست‌های گلوله‌ای, سرفصل‌ها و نوشتار کوتاه را حذف می‌کنند. این آشکارساز فقط بر اسنادی قابل اعمال است که دست‌کم 300 واژه نثرِ بلند داشته باشند, و تا زمان نگارش این متن, فقط برای متن‌های انگلیسی, اسپانیایی و ژاپنی است. همان‌طور که انتظار می‌رود, اگر آن را در کنار اینکه آشکارسازهای AI آن امتیاز را چگونه محاسبه می‌کنند به طور کلی بگذاریم, الگوی اینجا آشناست: یک عدد در سطح سند که دقیق به نظر می‌رسد, بر پایه بخشی محدودتر از متن ساخته شده است تا آنچه رقمِ تیتر القا می‌کند.

چه چیزهایی به عنوان AI ظاهر می‌شوند: ChatGPT و بقیه

Turnitin می‌گوید طبقه‌بند آن به دنبال الگوی نوشتار است, نه نام یک برند, و دامنه پوشش آن از زمان عرضه اولیه GPT-3.5 و GPT-4 در 2023 بارها گسترش یافته است. راهنمای کنونی, سری GPT-5, Gemini و Claude را در میان سامانه‌هایی نام می‌برد که مدل بر ضد آن‌ها آموزش دیده است, و نسخه‌های جدید مدل به صورت مستمر افزوده می‌شوند. این شامل متنی هم می‌شود که هرگز مستقیماً با ChatGPT تماس نداشته است. دانشجویی که به جای آن از Gemini, Claude یا DeepSeek استفاده کرده است, صرفاً با انتخاب یک شرکت دیگر, آشکارساز را دور نمی‌زند, زیرا توصیف خود Turnitin از مدل صریح است که معیار آن این نیست که کدام فروشنده متن را تولید کرده است, بلکه این است که متن چگونه خوانده می‌شود.

متن AI بازنویسی‌شده, دسته‌بندی جداگانه خود را دارد, نه معافیت. مستندات Turnitin میان متنی که آن را صرفاً AI-generated می‌داند و متنی که آن را AI-generated و سپس AI-paraphrased می‌داند تفکیک می‌کند, و در اوت 2025 تشخیصِ هدف‌گیری‌شده‌ای را افزود که مشخصاً معطوف به ابزارهای AI bypasser است که برای بازنویسی خروجی ماشین به گونه‌ای ساخته شده‌اند که از آشکارساز عبور کند. این به آن معنا نیست که بازنویسی بی‌فایده است یا هر بخش بازنویسی‌شده‌ای شناسایی می‌شود. معنایش این است که این فرض که بازنویسی به طور پیش‌فرض برای Turnitin نامرئی است, مدت‌هاست که دیگر به‌روز نیست.

امتیاز AI Turnitin چقدر دقیق است؟

ادعای دقت Turnitin به یک عدد اصلی خلاصه می‌شود: این شرکت می‌گوید نرخ مثبت کاذب را در اسنادی که بیش از 20 درصد متن آن‌ها علامت‌گذاری می‌شود، پایین‌تر از 1 درصد نگه می‌دارد. این شرکت همچنین می‌گوید هر نسخه جدید از مدل‌های خود را در برابر 700,000 مقاله دانشگاهی که پیش از وجود ChatGPT نوشته شده‌اند آزمایش می‌کند تا این دقت را تأیید کند. این یک ادعای مشخص و قابل آزمون درباره مجموعه‌ای خاص از شرایط است. شایسته است که دقیقاً به همین صورت خوانده شود. Turnitin در 2023، اندکی پس از عرضه خود، ادعاهای دیگری نیز درباره دقت مطرح کرده است. مدیر ارشد محصول این شرکت به‌طور عمومی اذعان کرد که آزمون‌های آزمایشگاهی پیش‌بینی نمی‌کردند چند مورد مثبت کاذب در استفاده واقعی ظاهر خواهد شد، به‌ویژه در ارسال‌های کوتاه، و گفت درصد مثبت‌های کاذب در عمل از آزمون‌ها بالاتر بوده است. او نرخ مثبت کاذب در سطح جمله را حدود 4 درصد گزارش کرد و اشاره کرد که Turnitin در نتیجه، حداقل طول ارسال‌هایی را که می‌توان برای آن‌ها امتیاز محاسبه کرد از 150 به 300 کلمه افزایش داد. حداقل فعلی همچنان 300 کلمه است.

آزمون مستقل جزئیاتی را اضافه می‌کند که رقم ارائه‌شده از سوی فروشنده آن را نشان نمی‌دهد. مرکز پیشبرد آموزش در Temple University یکی از دقیق‌ترین بررسی‌های موجود را انجام داد، در همان روحی که آزمون مستقل آشکارسازهای AI دنبال می‌کند و پیوسته شکاف‌هایی میان شرایط آزمایشگاهی و ارسال‌های واقعی نشان می‌دهد. پژوهشگران 120 نمونه نوشتاری ارائه کردند که به‌طور مساوی میان نوشتار کاملاً انسانی، نوشتار کاملاً تولیدشده توسط AI، نوشتار تولیدشده توسط AI که از یک ابزار بازنویسی عبور داده شده بود، و متن‌های ترکیبی که مشارکت‌های انسانی و AI را در هم می‌آمیختند تقسیم شده بودند، و آنچه Turnitin برای هر کدام بازگرداند را ثبت کردند. این ابزار 93 درصد از نمونه‌های کاملاً انسانی و 77 درصد از نمونه‌های کاملاً تولیدشده توسط AI را به‌درستی شناسایی کرد.

در پرسش‌های دشوارتر، دقت حتی بیشتر کاهش یافت. Turnitin تنها 63 درصد از نمونه‌های بازنویسی‌شده توسط AI را به‌درستی به‌عنوان تولیدشده توسط AI شناسایی کرد و فقط 43 درصد از نمونه‌های ترکیبی را به‌درستی نه کاملاً انسانی و نه کاملاً AI تشخیص داد، یعنی همان دسته‌هایی که به نحوه واقعی تولید نوشتارِ کمک‌گرفته از AI نزدیک‌ترند. متن ترکیبی، به‌ویژه، برای پژوهشگران اهمیت داشت، زیرا آنان معتقدند که احتمالاً در آینده بخش بزرگی، و شاید اکثریت، از ارسال‌های واقعی را تشکیل خواهد داد، زیرا هرچه تعداد بیشتری از درس‌ها تکالیفی را تعیین می‌کنند که از دانشجویان می‌خواهند برای بخشی از کار از AI استفاده کنند.

چه چیزی آزموده شدنتیجه Turnitin
نمونه‌های 100% نوشته‌شده توسط انسان93% به‌درستی به‌عنوان انسانی شناسایی شد
نمونه‌های 100% تولیدشده توسط AI77% به‌درستی به‌عنوان AI شناسایی شد
متن AI که از یک ابزار بازنویسی عبور داده شده بود63% به‌درستی به‌عنوان AI شناسایی شد
نمونه‌های ترکیبی، بخشی انسانی و بخشی AI43% به‌درستی به‌عنوان نه 0% و نه 100% شناسایی شد
اسنادی با بیش از 20% علامت‌گذاری‌شده، رقم خود Turnitinنرخ مثبت کاذب کمتر از 1%

Humanize your own paper

Transform your AI-assisted text and make it sound human, without touching important words or citations.

Get started free

جایی که حتی وقتی عدد درست به نظر می‌رسد، باز هم کارکرد آن دچار اختلال می‌شود

امتیاز در سطح سند تنها چیزی نیست که یک مدرس می‌تواند ببیند، و نمای دیگر کمتر قابل اعتماد است. برخی رابط‌ها به مدرس اجازه می‌دهند گزارشی از علامت‌گذاری را باز کند که جملات مشخصی را به‌عنوان احتمالاً نوشته‌شده توسط AI برجسته می‌کند. پژوهشگران Temple این برجسته‌سازی‌ها را با این‌که کدام جملات در نمونه‌های ترکیبی آنان واقعاً توسط AI نوشته شده بودند مقایسه کردند و هیچ رابطه‌ای میان این دو نیافتند. این موضوع اهمیت دارد اگر استادی به‌جای درصد خلاصه، تصویری از یک بند برجسته‌شده برای شما بفرستد: امتیاز کلی سند به‌مراتب بهتر از برجسته‌سازی‌های سطح جمله عمل کرد.

امتیازهای پایین دوباره به شکلی متفاوت، و با احتیاط بیشتری نسبت به گذشته، مدیریت می‌شوند. از July 2024، Turnitin به جای عدد، یک ستاره نمایش می‌دهد هرگاه مدل آن برآورد کند که کمتر از 20 درصد یک سند به‌وسیله AI نوشته شده است، زیرا این بازه همان جایی است که احتمال خطای ابزار در هر دو جهت بیشترین است. یک ویرایش سبک با کمک AI، یعنی بازنویسی یک پاراگراف با کمک و نوشتن بقیه بدون کمک، اغلب به جای یک درصد کوچک، هیچ درصد قابل مشاهده‌ای تولید نمی‌کند، و این نکته پیش از آنکه نبودِ عدد را به‌عنوان دلیلی برای هر چیزی تلقی کنیم، ارزش دانستن دارد.

چه کسانی در عمل عدد را می‌بینند

امتیاز AI به طور پیش‌فرض بخشی از گزارشِ قابل مشاهده برای دانشجو نیست. این امتیاز در زبانه‌ای جداگانه قرار دارد، برای مدرسان و مدیران قابل مشاهده است، و دانشجو فقط در صورتی آن را می‌بیند که مدرس تصمیم بگیرد گزارش را به اشتراک بگذارد یا آن را مستقیماً مطرح کند. این یک تفاوت ساختاری واقعی با امتیاز شباهت است، زیرا دانشجویان معمولاً می‌توانند پس از پردازش یک ارسال، خودشان آن را در همان سامانه مشاهده کنند.

همین موضوع درباره این که آیا این ویژگی اصلاً برای یک درس مشخص وجود دارد یا نه نیز صدق می‌کند، و این یک تصمیم نهادی است که فراتر از مدرس قرار دارد. مدیران در سطح حساب کاربری می‌توانند تشخیص AI در Turnitin را برای یک مؤسسه کامل روشن یا خاموش کنند. ممکن است یک مدرس نتواند آن را روشن کند اگر دانشگاه او آن را خاموش کرده باشد، و برعکس. دانشجویی از یک دانشگاه که کاری مشابه را به دانشجویی دیگر از دانشگاهی متفاوت ارسال می‌کند، ممکن است تجربه‌ای بسیار متفاوت از این ابزار داشته باشد، به دلایلی که هیچ ارتباطی با آنچه هر یک از آن‌ها نوشته‌اند ندارد.

چرا برخی دانشگاه‌ها آن را خاموش کرده‌اند

دانشگاه واترلو در سپتامبر 2025 قابلیت تشخیص هوش مصنوعی Turnitin را متوقف کرد، و استدلال منتشرشده آن به‌طور غیرمعمولی صریح است. این دانشگاه به غیرقابل‌اعتماد بودن مستندشده این ابزار، سوگیری آن علیه دانشجویانی که زبان اولشان انگلیسی نیست، و آزمون‌های داخلی خود اشاره کرد، آزمون‌هایی که دست‌کم یک مورد از متن کاملا نوشته‌شده توسط انسان را شامل می‌شد که 100 درصد به‌عنوان تولیدشده توسط هوش مصنوعی امتیاز گرفته بود. دانشگاه با در نظر گرفتن هزینه این ابزار، نتیجه گرفت که هزینه‌ها از مزایا بیشتر است و در عوض تلاش را به سمت بازطراحی ارزیابی و آموزش سواد هوش مصنوعی هدایت کرد.

واترلو یک نمونه آشکار از یک شکاف گسترده‌تر است، نه یک مورد استثنایی. دانشگاه‌هایی که این قابلیت را روشن نگه می‌دارند، عموما به‌جای آنکه امتیاز را به‌تنهایی یک حکم بدانند، برای آن حفاظ‌هایی افزوده‌اند، و پیش از آغاز هر اقدام رسمی، گفت‌وگویی با دانشجو را الزامی می‌کنند و عدد را دلیلی برای گشودن آن گفت‌وگو می‌دانند، نه بستن آن. مطالعه اینکه دانشگاه‌ها به‌طور گسترده‌تر چگونه با سیاست AI برخورد می‌کنند این الگو را روشن‌تر می‌کند: اینکه اصلا امتیازی به شما برسد یا نه، به تصمیمی بستگی دارد که بسیار بالاتر از کلاس سمینار شما گرفته شده است، نه به ویژگی ثابتی از خود فناوری.

آنچه یک امتیاز بالا ثابت می‌کند، و آنچه ثابت نمی‌کند

یک امتیاز بالای AI یک قرینه است، نه یک حکم. خود Turnitin درصد را به‌عنوان یکی از داده‌ها برای قضاوت مدرس صورت‌بندی می‌کند، نه به‌عنوان یافته‌ای درباره تخلف، و ارقام دقت بالا توضیح می‌دهند که چرا این صورت‌بندی اهمیت دارد: حتی امتیاز در سطح سند که نسبتا خوب عمل می‌کند، بخش معناداری از نوشتارهای به‌شدت ویرایش‌شده، بازنویسی‌شده یا ترکیبی را به‌اشتباه می‌خواند، و برجسته‌سازی‌های سطح جمله به‌مراتب از عدد خلاصه کم‌اعتمادترند. هیچ‌یک از این‌ها تضمین نمی‌کند که هر امتیاز منفردی نادرست است. معنایش این است که یک درصد، دلیلی برای پرسیدن پرسش‌هاست، نه یافته‌ای که بتوان آن را در نگاه اول پذیرفت. اگر می‌خواهید پیش از آنکه شخص دیگری نوشته شما را امتیازدهی کند ببینید متن خودتان در چه وضعی قرار دارد، همان الگوهای کم‌تنوع و عبارت‌پردازی کلی که یک طبقه‌بند به آن‌ها واکنش نشان می‌دهد را می‌توان مستقیما با یک free perplexity checker بررسی کرد.

TextPulse's انسان‌ساز AI برای دانشجویان بر همان مبنای آماری کار می‌کند، و بررسی‌کننده رایگان burstiness آن برای نیمه مربوط به ریتم جمله در همان سنجش نیز همین‌طور است. این ابزار یک Human Score تخمینی بر پایه پیش‌نویس خودتان به شما می‌دهد، نه پیش‌بینی این که Turnitin درباره آن چه خواهد گفت. هیچ ابزاری نمی‌تواند به‌طور مسئولانه درباره سامانه‌ای که کنترلش را در اختیار ندارد چنین وعده‌ای بدهد. آن را فقط به‌عنوان یک خوانش دوم از نوشته خودتان در نظر بگیرید، نه بیشتر.

چندین مورد از این پرسش‌ها صفحه‌های جداگانه خود را دارند. این که آیا یک استاد می‌تواند بدون هیچ آشکارسازى تشخیص دهد که از ChatGPT استفاده کرده‌اید، و نسخه صریح‌تر آن، آیا گیر می‌افتم، جداگانه پاسخ داده شده‌اند. همین‌طور رفتار Turnitin در برابر متن بازنویسی‌شده و نیز این که آیا Turnitin خروجی DeepSeek را تشخیص می‌دهد به‌طور مشخص. برای تنظیمات خاص، نوشته‌هایی درباره تشخیص AI در برنامه‌های پرستاری و درباره این که آیا دفاتر پذیرش دانشگاهی این بررسی‌ها را انجام می‌دهند وجود دارد. چارچوب کلی‌تر در نوشته‌ای جداگانه درباره یکپارچگی دانشگاهی و AI آمده است.

هیچ‌یک از این‌ها به احتمال زیاد نسخه نهایی نیست. Turnitin از 2023 تاکنون بیش از یک بار آستانه‌های خود، قواعد نمایانی خود و پوشش مدل‌هایش را بازنویسی کرده است، و August 2026 نیز آخرین سخن نخواهد بود. آنچه ثابت می‌ماند عادتی است که صرف‌نظر از این که یک درس معین از کدام آشکارساز استفاده می‌کند، ارزش داشتن دارد: آن‌قدر با جزئیات مشخص، نامنظم و واقعاً متعلق به خودتان بنویسید که آنچه یک طبقه‌بند ممکن است فکر کند، به حاشیه برود.

Frequently Asked Questions

نشانگر نگارش AI در Turnitin دقیقا برای پاسخ به همین پرسش وجود دارد. آیا Turnitin می‌تواند ChatGPT را تشخیص دهد؟ معمولا بله، وقتی یک سند شامل نگارش گسترده AI باشد: طبقه‌بند نثری را علامت‌گذاری می‌کند که از نظر آماری شبیه متن یک مدل زبانی است، و داده‌های خود Turnitin نشان می‌دهد که اکنون حدود 15 درصد از مقاله‌های اسکن‌شده امتیاز نگارش شدیدا AI را می‌گیرند. همچنین به‌طور منظم متن را از دست می‌دهد، و آزمون‌های مستقل نشان داده‌اند که دقت آن در نگارش AI بازنویسی‌شده به 63 درصد و در متن ترکیبی به 43 درصد کاهش یافته است.

Moe

PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.