AI Humanization

انسان‌ساز AI برای فارسی

نثر دانشگاهی فارسی نشانه‌های خاص خود را دارد، عبارت‌های پیوندی انباشته مانند «در این راستا» و «از این رو» که ChatGPT در تقریباً هر بند به کار می‌برد. این نوشته توضیح می‌دهد این الگوها از کجا می‌آیند، دانشگاه‌های ایران و آشکارسازها در حال حاضر با متن تولیدشده توسط AI چگونه برخورد می‌کنند، و یک انسان‌ساز ساخته‌شده برای نحو فارسی چگونه آن‌ها را بدون برهم زدن استنادها یا لحن حذف می‌کند.

6 min
Side-by-side comparison of AI-sounding Persian academic text and text corrected by a Persian AI humanizer

نوشتار دانشگاهی فارسی برخی از قابل‌تشخیص‌ترین نشانه‌های هوش مصنوعی را در میان همه زبان‌ها تولید می‌کند، زیرا خروجی ChatGPT به‌شدت بر مجموعه کوچکی از عبارت‌های پیوندی رسمی تکیه دارد که دانشجویان و پژوهشگران ایرانی آن‌ها را خوب می‌شناسند و به‌ندرت خودشان انتخاب می‌کنند. یک humanizer فارسی ai دقیقاً برای رفع همین مشکل وجود دارد: بازنویسی یک پاراگراف پیش‌نویس‌شده به‌گونه‌ای که ثبت زبانی، ریتم و پیوندهای آن همان‌طور خوانده شود که یک فرد تحصیل‌کرده در این حوزه واقعاً می‌نویسد، در حالی که هر ارجاع، اصطلاح فنی و عددی دست‌نخورده باقی می‌ماند. این موضوع اکنون اهمیت بیشتری دارد، زیرا Turnitin و دیگر آشکارسازها شروع کرده‌اند متن فارسی را مستقیماً بخوانند، نه فقط چکیده انگلیسیِ پیوست‌شده به آن را.

Persian نامی است که در زبان‌شناسی و در بیشتر زمینه‌های دانشگاهی به کار می‌رود، هرچند بیرون از محیط‌های دانشگاهی همان زبان معمولاً Farsi نامیده می‌شود، و بسیاری از دانشجویان به‌جای persian ai humanizer به دنبال farsi ai humanizer می‌گردند، بی‌آنکه متوجه باشند این دو اصطلاح به همان ابزار اشاره می‌کنند. ایران دسترسی مستقیم به ChatGPT را محدود می‌کند، بنابراین بیشتر پیش‌نویس‌ها از طریق VPN عبور می‌کنند، و این امر نحوه خواندن پاراگراف نهایی توسط آشکارساز را تغییر نمی‌دهد. آنچه در ادامه می‌آید، محل قرار گرفتن نشانه‌های هوش مصنوعی در نثر دانشگاهی فارسی، شیوه برخورد دانشگاه‌های ایرانی و آشکارسازها با متن علامت‌گذاری‌شده در حال حاضر، و این‌که چگونه یک humanizer ساخته‌شده برای نحو فارسی آن‌ها را حذف می‌کند، در چارچوب یک multilingual AI humanizer گسترده‌تر است که همان رویکرد را در پانزده زبان به کار می‌گیرد.

چرا متن هوش مصنوعی در فارسی علامت‌گذاری می‌شود

خروجی فارسی ChatGPT بر مجموعه‌ای محدود از پیونددهنده‌های کلیشه‌ای تکیه دارد که یک نویسنده دانشگاهی بومی آن‌ها را متنوع می‌کند یا به‌کلی کنار می‌گذارد. 'در این راستا' جمله را پشت جمله آغاز می‌کند، 'از این رو' و 'در نتیجه' به‌عنوان گذارهای کلی میان بندهایی که هیچ پیوند منطقی واقعی ندارند تکرار می‌شوند، و بندها پشت 'و همچنین' انباشته می‌شوند، به‌جای آنکه به جمله‌های جداگانه با نشانه‌گذاری مستقل خود شکسته شوند. هیچ‌یک از این عبارت‌ها به‌خودی‌خود نادرست نیست. نشانه در بسامد است: یک نویسنده انسانی گاه‌به‌گاه به سراغ یکی از آن‌ها می‌رود، در حالی که یک مدل تقریباً در هر پاراگراف به همان چند مورد محدود رجوع می‌کند.

دو ساختار دیگر نیز به‌طور مداوم ظاهر می‌شوند. آغازگرِ پُرکنندهٔ «لازم به ذکر است که» پیش از نکتهٔ اصلی، به اندازهٔ یک جمله وقت‌کشی می‌کند، و عبارتِ احتیاطیِ غیرشخصیِ «می‌توان گفت که» نویسنده را از ادعایی که یک استاد راهنما انتظار دارد به‌صورت مستقیم بیان شود، دور می‌کند. نثر دانشگاهیِ انگلیسی نسخهٔ خاص خود را از این مشکل دارد، که در نوشتهٔ TextPulse دربارهٔ words that give away ChatGPT فهرست شده است، و سازوکار زیربنایی همان است: مدلی که برای محتاط به‌نظر رسیدن در هر زبانی آموزش دیده است، به‌جای یک جملهٔ مشخص و متعهد، به‌طور پیش‌فرض به احتیاط‌ورزی و تکرار روی می‌آورد.

نثر فارسیِ شبیه به AI چه شکلی دارد

این الگو را آسان‌تر می‌توان در کنار هم دید. نمونهٔ زیر یک بند کوتاه است که کاملاً از نشانه‌های بالا ساخته شده است: یک پیونددهندهٔ آغازینِ روی‌هم‌چیده، بندِ قالبیِ «نقش مهمی ایفا می‌کند»، آغازگرِ پُرکنندهٔ «لازم به ذکر است»، و یک جملهٔ پایانی که با «می‌توان گفت که» محتاط شده است. نسخهٔ انسانی‌شده هر ادعایی را که متن اصلی مطرح می‌کند حفظ می‌کند و هیچ بخشی از محتوا را حذف نمی‌کند، اما پیونددهنده‌های روی‌هم‌چیده را برمی‌دارد، طول جمله‌ها را متنوع می‌کند، و هدف مطالعه را به‌طور مستقیم بیان می‌کند، نه این‌که به‌سوی آن احتیاط‌ورزی کند.

فارسیِ شبیه‌به‌هوش‌مصنوعیپس از انسانی‌سازی
در این راستا، فناوری‌های هوش مصنوعی در سال‌های اخیر نقش بسزایی در حوزه نگارش دانشگاهی ایفا کرده‌اند. لازم به ذکر است که پژوهشگران از این رو با چالش‌هایی در زمینه اصالت و کارایی مواجه هستند. در نتیجه، می‌توان گفت که هدف این پژوهش بررسی نظام‌مند این چالش‌ها است.فناوری‌های هوش مصنوعی در چند سال اخیر نگارش دانشگاهی را دگرگون کرده‌اند. پژوهشگران هم از مزیت سرعت بهره می‌برند و هم با دشواری‌هایی درباره اصالت متن دست‌وپنجه نرم می‌کنند. این پژوهش می‌کوشد این دشواری‌ها را به شکلی نظام‌مند بررسی کند.
English gloss: AI technologies have played a significant role in academic writing in recent years, researchers face challenges around originality and efficiency, and the study's goal is to systematically examine these challenges.English gloss: the same claims, without the stacked connector phrases, in plainer and more rhythmically varied sentences a native academic writer would actually use.

تشخیص هوش مصنوعی در ایران و دیاسپورای ایرانی

پذیرش ابزارهای تشخیص در داخل ایران با بیشتر کشورهای دیگر تفاوت دارد. Turnitin در جاهایی استفاده می‌شود که دانشگاه اشتراک دارد، اما OpenAI دسترسی مستقیم به ChatGPT را از ایران مسدود می‌کند، بنابراین بیشتر دانشجویان و پژوهشگران از طریق VPN به آن می‌رسند، و این موضوع از همان ابتدا بر این‌که متن هوش مصنوعی چگونه وارد پیش‌نویس می‌شود و بعداً ردیابی آن چقدر دشوار است اثر می‌گذارد. در کنار Turnitin، ابزاری داخلی به نام Samim Noor (سمیم نور) به‌طور گسترده برای بررسی سرقت ادبی استفاده می‌شود و به‌تدریج در حال افزودن تشخیص هوش مصنوعی است، هرچند پوشش آن برای نشانه‌های ویژه هوش مصنوعی در مقایسه با بررسی شباهت، یکنواخت نیست.

GPTZero و Originality.ai نفوذ مستقیم محدودی در نهادهای ایرانی دارند، باز هم عمدتاً به دلیل محدودیت دسترسی، هرچند پژوهشگران دیاسپورا که از ایالات متحده، کانادا یا اروپا منتشر می‌کنند با آن‌ها همان‌گونه روبه‌رو می‌شوند که هر نویسنده بین‌المللی دیگری روبه‌رو می‌شود. مقاله‌ای که به‌صورت مشترک میان یک دانشگاه ایرانی و یک نهاد غربی نوشته شده باشد، می‌تواند در همان دست‌نوشته با دو بررسی تشخیص متفاوت مواجه شود: یک سنجش شباهت داخلی در سمت ایرانی و یک گذر از Turnitin یا GPTZero وقتی به دانشگاه هم‌نویسنده یا سامانه ارسال خودِ یک مجله می‌رسد.

هیچ‌یک از این‌ها چیزی را که واقعاً علامت‌گذاری می‌شود تغییر نمی‌دهد. یک آشکارساز که متن فارسی را می‌خواند، همچنان به همان نظم آماری، پیونددهنده‌های انباشته و احتیاط‌نمای‌های تکرارشده‌ای که بالاتر توضیح داده شد، واکنش نشان می‌دهد، فارغ از این‌که کدام ابزار بررسی را اجرا کند یا بررسی در کدام کشور انجام شود. نوشتاری که پیونددهنده‌های خود را متنوع می‌کند و ادعاهایش را به‌طور مستقیم بیان می‌کند، هم برای یک دانشگاهی فارسی‌خوان و هم برای هر آشکارسازی که یک دانشگاه یا مجله معین از آن استفاده کند، انسانی به نظر می‌رسد.

مقاله خود را انسانی‌سازی کنید

متنِ کمک‌گرفته از AI خود را دگرگون کنید و کاری کنید طبیعی به نظر برسد، بدون دست زدن به واژه‌های مهم یا ارجاع‌ها.

رایگان شروع کنید

سیاست‌های دانشگاهی

UniversityPolicy stance
University of Tehranهیچ سیاست واحد و منتشرشده‌ای درباره هوش مصنوعی مولد در سطح کل دانشگاه به زبان انگلیسی یافت نشد؛ به نظر می‌رسد راهنماها بیشتر در اختیار دانشکده‌های منفرد و استادان راهنمای پایان‌نامه باشد تا یک آیین‌نامه مرکزی.
Sharif University of Technologyهیچ سیاست عمومی به زبان انگلیسی درباره هوش مصنوعی مولد یافت نشد؛ متنی که بدون افشا توسط هوش مصنوعی نوشته شده باشد، به احتمال زیاد به‌عنوان یک موضوع مربوط به یکپارچگی دانشگاهی و به‌صورت موردی رسیدگی می‌شود.
Amirkabir University of Technologyهیچ سیاست منتشرشده و قابل‌راستی‌آزمایی درباره استفاده از هوش مصنوعی یافت نشد؛ بررسی پایان‌نامه و مقاله احتمالاً بر قضاوت استاد راهنما و غربالگری استاندارد سرقت ادبی تکیه دارد.
Shahid Beheshti Universityهیچ سیاست مشخصی درباره هوش مصنوعی مولد قابل‌راستی‌آزمایی نبود؛ مقررات کلی یکپارچگی دانشگاهی احتمالاً استفاده افشا‌نشده از هوش مصنوعی را ذیل قواعد موجود سرقت ادبی پوشش می‌دهد.
Isfahan University of Technologyهیچ سیاست عمومیِ خاصِ هوش مصنوعی یافت نشد؛ فرض بر این است که نظارت از همان اختیار عمل در سطح دانشکده پیروی می‌کند که در میان دانشگاه‌های دولتی ایران رایج است.
Ferdowsi University of Mashhadهیچ سیاست اختصاصی درباره هوش مصنوعی مولد یافت نشد؛ اجرای مقررات احتمالاً بر کدهای موجود صداقت دانشگاهی استوار است، نه بر یک حکم نام‌دار درباره هوش مصنوعی.

نشریات و فرهنگ استناد

ادبیات دانشگاهی به زبان فارسی گسترده است و رشته‌های متعددی را دربر می‌گیرد، و هر رشته نشریات علمی خاص خود را با سبک ارجاع‌دهی متناظر دارد. نشریات پزشکی عمدتاً به سبک Vancouver و به‌صورت شماره‌گذاری‌شده منتشر می‌شوند، برای مثال: Journal of Isfahan Medical School (run by Isfahan University of Medical Sciences). پژوهش‌های علوم اجتماعی و انسانی عمدتاً به سبک APA منتشر می‌شوند، برای مثال: Iranian Journal of Sociology; Comparative Literature Studies Quarterly. پژوهش در مهندسی و فناوری به سبک IEEE و به‌صورت شماره‌گذاری‌شده منتشر می‌شود. مطالعات زبان‌شناسی در نشریه: نامه فرهنگستان، منتشرشده توسط Academy of Persian Language and Literature، منتشر می‌شوند.

انسانی‌سازیِ همراه با حفظ استناد در اینجا اهمیت دارد، زیرا شماره‌گذاری در Vancouver، APA و IEEE هر یک ارجاعات را به‌گونه‌ای متفاوت قالب‌بندی می‌کنند، و یک ابزار بازنویسی که نشانگر استناد شماره‌دار یا ارجاعِ درون‌پرانتزِ نویسنده-تاریخ را تشخیص ندهد، می‌تواند آن را بی‌صدا خراب کند، در حالی که جمله پیرامونی را روان‌تر می‌سازد. پژوهشگری که در موضوعات علم و سیاست به رهیافت (Rahyaft) یا به یک مجله پزشکی با سبک Vancouver مقاله می‌فرستد، باید استدلال را بازنویسی‌شده و فهرست منابع را دقیقاً همان‌گونه که ارسال شده است، دست‌نخورده باقی‌مانده، دریافت کند، و این دو باید به‌عنوان دو کار جداگانه، نه یک فرایند واحد، انجام شوند.

TextPulse چگونه به‌عنوان یک انسانی‌سازِ هوش مصنوعیِ فارسی کار می‌کند

حالت چندزبانه TextPulse متن فارسی را مستقیماً پردازش می‌کند، نه این‌که آن را به انگلیسی ترجمه کند، سپس انسانی‌سازی کند و دوباره برگرداند، چرخه‌ای رفت و برگشتی که تمایزهای سبکیِ توضیح‌داده‌شده در بالا را مخدوش می‌کند. این حالت حوزه علمی و سطح رسمیتِ متن را می‌خواند، سپس پیونددهنده‌ها، آهنگ جمله و الگوی احتیاط‌ورزی را طوری تنظیم می‌کند که با شیوه نوشتن یک پژوهشگر انسانی در آن حوزه هماهنگ شود، در حالی که اعداد، نشانگرهای استناد و اصطلاحات فنی را دقیقاً همان‌گونه که ارسال شده‌اند، باقی می‌گذارد.

این حفظ‌کردن به همان اندازه خودِ بازنویسی اهمیت دارد. یک استنادِ شماره‌گذاری‌شده به سبک Vancouver، یک جفتِ نویسنده-تاریخ در APA یا یک شماره داخل کروشه در IEEE همگی باید بدون تغییر از این فرایند عبور کنند، زیرا یک ارجاعِ خراب مسئله‌ای جدا از یک بندِ علامت‌گذاری‌شده است. پژوهشگرانی که میان نوشتار دانشگاهی فارسی و ویتنامی جابه‌جا می‌شوند، برای نمونه، با همان منطقِ آشکارساز روبه‌رو می‌شوند، هرچند AI humanizer for Vietnamese باید مجموعه متفاوتی از نشانه‌ها را، از نشانه‌های دیاکریتیک تا واژه‌های پایانیِ جمله، حل کند. نتیجه، یک متن فارسی است که استدلال، استنادها و لحنِ متناسب با حوزه خود را حفظ می‌کند، بدون پیونددهنده‌های انباشته‌ای که در وهله نخست خروجی هوش مصنوعیِ فارسی را قابل‌تشخیص می‌سازند.

XLinkedInFacebook

سؤالات متداول

بله. یک انسان‌ساز AI فارسی که برای متن دانشگاهی ساخته شده است، استدلال را از دستگاه ارجاع جدا می‌کند، نه این که همه چیز را به صورت یک بلوک بازنویسی کند. اعداد، DOIها، نام نویسندگان و نشانگرهای استناد، چه از شماره‌گذاری Vancouver پیروی کنند، چه از قالب نویسنده-تاریخ APA یا براکت‌های سبک IEEE، بدون تغییر عبور می‌کنند، در حالی که جمله فارسیِ پیرامونی از نظر لحن و آهنگ بازنویسی می‌شود.

Sara

Content planner and copywriter at TextPulse. Sara runs the blog day to day, from planning and drafting through to publishing. She writes the practical guides: clear explanations of academic writing problems, aimed at the person who actually has to hand something in.

از تازه‌های انسان‌سازی AI باخبر بمانید

نکات مربوط به نگارش دانشگاهی، تشخیص AI و انسان‌سازی را در صندوق ورودی‌تان دریافت کنید.

بدون اسپم. هر زمان خواستید لغو اشتراک کنید.