AI Detection

آیا Turnitin متن بازنویسی‌شده را تشخیص می‌دهد؟

بله، Turnitin متن بازنویسی‌شده را تشخیص می‌دهد، و برای همین ساخته شده است. موتور شباهت آن بخش‌های بازنویسی‌شده‌ای را که هنوز با آثار منتشرشده و آثار پیشتر ارسال‌شده همپوشانی دارند می‌گیرد، و گزارش نگارش AI آن یک دسته‌بندی برچسب‌خورده برای متن تولیدشده با AI دارد که با یک ابزار بازنویسی یا word spinner ویرایش شده است. در ادامه، توضیح داده می‌شود که هر سامانه چگونه آن را می‌گیرد، و چرا جایگزین کردن واژه‌ها با مترادف‌ها هیچ‌کدام را دور نمی‌زند.

9 min
Diagram answering can Turnitin detect paraphrased text, comparing similarity matching against the AI writing indicator

بله. Turnitin متن بازنویسی‌شده را تشخیص می‌دهد، و برای همین ساخته شده است. دو سامانه درون همان گزارش آن را شناسایی می‌کنند. Similarity Report بخش‌هایی را علامت‌گذاری می‌کند که پس از تغییر واژگان همچنان با آثار منتشرشده یا مقاله‌های پیش‌تر ارسال‌شده همپوشانی دارند، و این همان کاری است که از مدت‌ها پیش از وجود نگارش با AI انجام می‌داد. AI Writing Report نیز دسته‌بندی برچسب‌خوردهٔ خود را برای متن تولیدشده با AI دارد که از یک ابزار بازنویسی یا word spinner عبور داده شده است. جایگزین کردن واژه‌ها با مترادف‌ها هیچ‌یک از این دو را پاک نمی‌کند.

اینکه کدام سامانه یک بخش معین را شناسایی می‌کند، به این بستگی دارد که متن از کجا آمده است. محتوای بازنویسی‌شده‌ای که از یک منبع برداشته شده، مسئلهٔ similarity است. محتوای بازنویسی‌شده‌ای که ChatGPT تولید کرده، مسئلهٔ نگارش با AI است. بسیاری از ارسال‌ها هر دو حالت را هم‌زمان دارند، و در هر صورت هر دو سامانه همهٔ ارسال‌ها را می‌خوانند.

Turnitin متن AI بازنویسی‌شده را به‌عنوان دسته‌بندی مستقل خود نام‌گذاری می‌کند

این نتیجه‌گیری از شیوهٔ کار کلی آشکارسازها نیست. AI Writing Report در Turnitin درصد خود را به دو دستهٔ برچسب‌خورده تقسیم می‌کند، و دستهٔ دوم متن AI بازنویسی‌شده است.

Turnitin AI Writing Overview page listing two categories: AI-generated only, described as likely AI-generated text from a large-language model, and AI-generated text that was AI-paraphrased, described as likely AI-generated text that was likely revised using an AI-paraphrase tool or word spinner
AI Writing Overview در Turnitin، با دستهٔ بازنویسی در محصول خود. درصد اصلی هر دو خط را با هم ترکیب می‌کند، و خط دوم متن بازنویسی‌شده با یک AI paraphraser یا word spinner را پوشش می‌دهد.

این گزارش عدد اصلی خود را چنین تعریف می‌کند: "the combined amount of likely AI-generated text as well as likely AI-generated text that was also likely AI-paraphrased". مورد دوم با برچسب "AI-generated text that was AI-paraphrased" مشخص شده و چنین توصیف می‌شود: "likely AI-generated text that was likely revised using an AI-paraphrase tool or word spinner".

مستندات پشتیبانی Turnitin این پرسش را به‌صراحت پاسخ می‌دهند. وقتی به‌طور مستقیم پرسیده می‌شود که آیا می‌تواند محتوایی را که با یک ابزار بازنویسی AI بازنویسی شده است تشخیص دهد، راهنمای آن چنین می‌گوید: "Yes, Turnitin's AI indicator includes detection of AI-generated content that may have been paraphrased using a word spinner/AI paraphrasing tool." پاسخی تقریباً یکسان درباره متنی نیز صدق می‌کند که از یک ابزار bypasser عبور داده شده است، ابزاری که به‌طور خاص برای بازنویسی خروجی AI و عبور دادن آن از یک detector ساخته شده است. هیچ‌یک نمره‌ای جداگانه تولید نمی‌کنند. هر دو همان درصد واحدی را تغذیه می‌کنند که یک instructor می‌بیند.

هر سیستم چه چیزی را شناسایی می‌کند

Similarity ReportAI Writing Report
What it checksWhether the text overlaps sources already in Turnitin's database of web content, publications and student papersWhether the prose reads as statistically typical of machine-generated writing
Catches paraphrasing ofSomeone else's published or submitted workAI-generated drafts, including ones revised by a paraphraser or bypasser
Effect of a synonym passLowers the percentage, but leaves distinctive terms, quotations and sentence structure matchingLeaves the score largely where it was, because the classifier reads sentence pattern rather than word choice
Where it shows upA percentage plus match groups naming each sourceOne percentage, split into AI-generated only and AI-paraphrased

این دو report محصولاتی جداگانه با اعداد جداگانه هستند، و یک paper می‌تواند در یکی پاک باشد و در دیگری علامت‌گذاری شود. TextPulse این شکاف را به‌طور کامل در comparison of Turnitin's similarity score against its AI score پوشش می‌دهد، و سازوکار خود classifier را نیز در how Turnitin detects AI writing توضیح می‌دهد.

مقاله خود را انسانی‌سازی کنید

متنِ کمک‌گرفته از AI خود را دگرگون کنید و کاری کنید طبیعی به نظر برسد، بدون دست زدن به واژه‌های مهم یا ارجاع‌ها.

رایگان شروع کنید

بخش Similarity: متن بازنویسی‌شده همچنان همپوشانی دارد

بررسی همانندی یک تمرین تطبیقی است. Turnitin یک ارسال را با مخزن خود از محتوای وب، انتشارات و مقاله‌های پیش‌تر ارسال‌شده مقایسه می‌کند و گزارش می‌دهد که چه مقدار از آن با چیزی که پیش‌تر نمایه شده همپوشانی دارد. اگر واژه‌پردازی را به اندازه کافی تغییر دهید، رشته‌های دقیقِ در حال مقایسه کوچک‌تر می‌شوند، بنابراین درصد کاهش می‌یابد. این واقعی است و به همین دلیل ابزارهای بازنویسی وجود دارند.

آنچه از این جابه‌جایی باقی می‌ماند، همان بخشی است که دانشجویان آن را دست‌کم می‌گیرند. اصطلاحات فنی، اسم‌های خاص، داده‌های استنادی و نقل‌قول‌های مستقیم بدون تغییر منتقل می‌شوند، زیرا برای آن‌ها مترادفی وجود ندارد. ساختار جمله نیز همین‌طور است، وقتی فقط واژه‌های پیونددهنده جایگزین می‌شوند. Turnitin همپوشانی را به صورت گروه‌های تطابق گزارش می‌کند، و هر گروه منبع خود را نام می‌برد، و همین است که یک بخش به‌درستی نقل‌شده را از بخشی که صرفا بازنویسی شده جدا می‌کند.

Turnitin similarity report showing 12% overall similarity broken into match groups: 115 matches not cited or quoted at 9%, and 41 matches with missing quotations at 3%, with top sources listed across internet, publications and student papers
گزارش همانندی، درصد را به گروه‌های تطابق تقسیم می‌کند. 115 تطابق «not cited or quoted» همان مواردی هستند که به صورت بازنویسی‌شده یا وام‌گرفته خوانده می‌شوند، نه نقل‌قولِ منسوب.

بازنویسی یک منبع در حالی که ترتیب جمله‌های آن و جزئیات پشتیبانش حفظ شود، patchwriting نام دارد، و در بیشتر سیاست‌های دانشگاهی، چه درصد همانندی کاهش یابد و چه نه، به عنوان شکلی از سرقت ادبی تلقی می‌شود. ارزیابانی که برای تشخیص آن آموزش دیده‌اند، اغلب آن را با چشم تشخیص می‌دهند، زیرا استدلالی که بند به بند از یک منبع پیروی می‌کند، صرف‌نظر از واژگان، مانند همان منبع خوانده می‌شود. عدد پایین با کار پاک و بی‌اشکال یکی نیست، و همین نکته راهنمای TextPulse درباره آنچه یک Turnitin score خوب به شمار می‌آید را توضیح می‌دهد.

بخش هوش مصنوعی: یک گذر مترادف‌سازی score را جابه‌جا نمی‌کند

شاخص نگارش AI هرگز پاراگراف شما را با یک منبع مقایسه نکرده است، بنابراین هیچ تطابقی برای شکستن با یک مترادف وجود ندارد. این شاخص نثر را جمله به جمله بر اساس این که تا چه اندازه با الگوی آماری نوشتار تولیدشده توسط ماشین سازگار است، امتیازدهی می‌کند: پیش‌بینی‌پذیری واژه‌ها، ریتم جمله، و عبارت‌بندی کلیشه‌ای که یک مدل زبانی به طور پیش‌فرض به آن روی می‌آورد.

جایگزین کردن واژه‌ها تقریباً همه این موارد را دست‌نخورده باقی می‌گذارد. جمله طول خود را حفظ می‌کند، ترتیب خود را حفظ می‌کند، و همان بافت پیوندی معمول میان بندها را دارد. به همین دلیل است که اجرای یک پیش‌نویس AI از طریق یک ابزار بازنویسی و دیدن این که امتیاز AI ثابت می‌ماند، تجربه‌ای بسیار رایج است. واژگان تغییر کرده‌اند. الگویی که طبقه‌بند امتیاز می‌دهد تغییر نکرده است، بنابراین متن همچنان به عنوان متنِ نوشته‌شده توسط ماشین خوانده می‌شود، دقیقاً همان‌طور که دسته‌بندی بازنویسی Turnitin می‌گوید باید باشد.

توزیع طول جمله در بازنویسی باقی می‌ماند

نثرِ پیش‌نویس‌شده توسط ماشین در بازه‌ای محدود از طول جمله‌ها تثبیت می‌شود، زیرا مدلی که یک توکن را در هر نوبت پیش‌بینی می‌کند دلیلی ندارد که جمله چهار را کوتاه‌تر از جمله سه بسازد. نوشتار انسانی برعکس پراکنده است: یک جمله 19 واژه‌ای، سپس یک جمله 6 واژه‌ای، سپس یک جمله 32 واژه‌ای که یک ادعا و قید آن را با هم حمل می‌کند. توضیح‌گر خود GPTZero این را به صراحت نام می‌برد و burstiness را به عنوان معیاری برای این که الگوهای نگارش و perplexities متن تا چه اندازه در سراسر یک سند تغییر می‌کنند، تعریف می‌کند.

تعویض مترادف طول یک جمله را یک یا دو واژه جابه‌جا می‌کند، و طول هر جمله را نیز به همان اندازه اندک تغییر می‌دهد، بنابراین توزیع شکل خود را حفظ می‌کند. پاراگرافی که پیش از یک گذر شامل 18، 19، 17 و 20 واژه باشد، پس از آن نیز در فاصله‌ای یک یا دو واژه‌ای از همان نمای تخت باقی می‌ماند.

این امر بدون نزدیک شدن به یک آشکارساز نیز قابل اندازه‌گیری است. یک free burstiness checker میزان تنوع در سطح جمله را که یک قطعه متن حمل می‌کند گزارش می‌دهد، و اجرای همان پاراگراف از طریق آن پیش و پس از یک گذر بازنویسی نشان می‌دهد که عدد تقریباً تکان نمی‌خورد، در حالی که واژگان کاملاً تغییر می‌کنند.

ترتیب بندها و گذارها نیز از آن جان سالم به در می‌برند

ترتیب بندها دومین ویژگی ساختاری است که یک بازنویس دست‌نخورده می‌گذارد، و برای خواننده از طول جمله آشکارتر است. نثر ماشینی معمولاً موضوع را در ابتدا می‌آورد، ادعا را بیان می‌کند، سپس در پایان یک بند مقیدکننده اضافه می‌کند، و این کار را بارها تکرار می‌کند. «در حالی که حجم نمونه محدود بود، نتایج نشان می‌دهد» و «اگرچه پژوهش بیشتری لازم است، یافته‌ها نشان می‌دهد» یک جمله‌اند که فقط با واژه‌های متفاوت پوشیده شده‌اند.

یک ابزار بازنویسی «while» را به «although» و «suggest» را به «show» تبدیل می‌کند. اما تصمیم نمی‌گیرد که این قید باید سه خط بعد در جمله‌ای کوتاه و مستقل بیاید، یا اینکه باید قید احتیاط به طور کامل حذف شود. این یک داوری ویرایشی درباره این است که بند چه استدلالی را پیش می‌برد، و یک موتور جایگزینی درباره استدلال هیچ نظری ندارد.

عبارت‌های گذار سومین و آشکارترین ویژگی‌اند. مدل‌ها در محل اتصال‌ها به مجموعه‌ای کوچک و پایدار از پیونددهنده‌ها روی می‌آورند: however، additionally، furthermore، in addition. یک بازنویس یکی از آن‌ها را با عضو دیگری از همان مجموعه عوض می‌کند، بنابراین طبقه‌بند همچنان یک گذار کلیشه‌ای را از توزیع مورد انتظار در جایگاه مورد انتظار می‌بیند. این همان نشانه‌ای است که پیش از آغاز بازنویسی می‌خواند.

ویژگی‌ای که یک طبقه‌بند می‌خواندآیا با یک گذر بازنویسی تغییر می‌کندچرا
انتخاب واژه‌های منفردبله، به طور قابل توجهتنها ویژگی‌ای که یک موتور جایگزینی برای تغییر دادن آن ساخته شده است
طول جمله و واریانس آنبه سختیواژه‌های جایگزین از نظر طول به واژه‌های اصلی نزدیک‌اند، بنابراین الگو حفظ می‌شود
ترتیب بندها درون یک جملهبه ندرتبازآرایی، تأکید را تغییر می‌دهد، و قید معنا از آن جلوگیری می‌کند
پیونددهنده‌ها در محل اتصال‌هادرون همان مجموعه کوچک جابه‌جا می‌شوندیک گذار کلیشه‌ای جای گذار کلیشه‌ای دیگری را می‌گیرد
قابلیت پیش‌بینی واژه بعدیاندکییک مترادف نادرتر کمتر مورد انتظار است، اما چارچوب پیرامون آن به همان اندازه پیش‌بینی‌پذیر می‌ماند
شواهد و جزئیات مشخصخیریک بازنویسی نمی‌تواند موادی را اضافه کند که هرگز در پیش‌نویس نبوده است

چه چیزی واقعاً نتیجه را تغییر می‌دهد

هر دو سامانه به نشانه‌های متفاوتی از همان بازنویسی سطحی واکنش نشان می‌دهند، بنابراین راه‌حل برای هر دو یکی است, نوشتن را تغییر دهید، نه واژه‌ها را. این یعنی بازسازی جمله‌ها به جای جابه‌جا کردن محتوای آن‌ها، متنوع کردن آگاهانه طول جمله‌ها، حذف پیوندهای کلیشه‌ای که یک مدل به طور پیش‌فرض به کار می‌برد، و افزودن جزئیات پشتیبان به اندازه‌ای مشخص که فقط می‌توانسته از منبعی آمده باشد که واقعاً خوانده‌اید. شباهت کاهش می‌یابد، چون ساختار دیگر با منبع هم‌ردیف نیست. امتیاز AI کاهش می‌یابد، چون الگویی که طبقه‌بند بر اساس آن امتیاز می‌دهد از میان رفته است.

یک ابزار بازنویسی نمی‌تواند این کار را انجام دهد، و تفاوت میان این دو دسته ابزار پیش از پرداخت برای هر کدام ارزش فهمیدن دارد، موضوعی که TextPulse در AI humanizer در برابر paraphraser پوشش می‌دهد. بررسی پیش‌بینی‌پذیری واژه‌به‌واژه پیش‌نویس خود با یک free perplexity checker الگو را که یک طبقه‌بند به آن واکنش نشان می‌دهد، مفیدتر از یک امتیازِ تنها نشان می‌دهد.

AI humanizer برای دانشجویان در TextPulse بر جنبه ساختاری مسئله کار می‌کند، و به جای جایگزین کردن واژه‌های منفرد، ریتم جمله، تنوع طول و ترتیب بندها را بازسازی می‌کند، و همین شکافی است که یک گذرِ صرفاً مبتنی بر مترادف آن را کاملاً باز می‌گذارد. برای کارهای درسی به طور خاص، humanizing an AI essay for college گردش کار را از ابتدا تا انتها پوشش می‌دهد، و whether Turnitin detects DeepSeek همان پرسش را برای مدلی دیگر پاسخ می‌دهد.

هیچ‌یک از این‌ها آنچه را که سیاست استفاده از AI در یک درس اجازه می‌دهد تغییر نمی‌دهد، و هیچ رویکرد بازنویسی‌ای امتیاز را پس از وقوع تعیین نمی‌کند. آزمونی که پیش از ارسال هر چیزی ارزش به کار بردن دارد این است که آیا می‌توانید جمله به جمله توضیح دهید چرا کاری که پیش روی شماست همان چیزی را می‌گوید که می‌گوید.

XLinkedInFacebook

سؤالات متداول

بله. موتور شباهت آن یک ارسال را با محتوای وب، انتشارات و مقاله‌های پیشتر ارسال‌شده مقایسه می‌کند، بنابراین بخش‌های بازنویسی‌شده‌ای که هنوز با یک منبع همپوشانی دارند، به سبب اصطلاحات متمایز، نقل‌قول‌ها و ساختار جمله همچنان تطابق پیدا می‌کنند. جدا از این، گزارش نگارش AI آن یک دسته‌بندی برچسب‌خورده برای متن تولیدشده با AI دارد که با یک ابزار بازنویسی AI یا word spinner ویرایش شده است، و مستندات خود Turnitin تأیید می‌کند که این سامانه برای علامت‌گذاری همین موارد ساخته شده است.

Moe

PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.

از تازه‌های انسان‌سازی AI باخبر بمانید

نکات مربوط به نگارش دانشگاهی، تشخیص AI و انسان‌سازی را در صندوق ورودی‌تان دریافت کنید.

بدون اسپم. هر زمان خواستید لغو اشتراک کنید.