انسانساز AI برای فارسی
نثر دانشگاهی فارسی نشانههای خاص خود را دارد، عبارتهای پیوندی انباشته مانند «در این راستا» و «از این رو» که ChatGPT در تقریباً هر بند به کار میبرد. این نوشته توضیح میدهد این الگوها از کجا میآیند، دانشگاههای ایران و آشکارسازها در حال حاضر با متن تولیدشده توسط AI چگونه برخورد میکنند، و یک انسانساز ساختهشده برای نحو فارسی چگونه آنها را بدون برهم زدن استنادها یا لحن حذف میکند.
نوشتار دانشگاهی فارسی برخی از قابلتشخیصترین نشانههای هوش مصنوعی را در میان همه زبانها تولید میکند، زیرا خروجی ChatGPT بهشدت بر مجموعه کوچکی از عبارتهای پیوندی رسمی تکیه دارد که دانشجویان و پژوهشگران ایرانی آنها را خوب میشناسند و بهندرت خودشان انتخاب میکنند. یک humanizer فارسی ai دقیقاً برای رفع همین مشکل وجود دارد: بازنویسی یک پاراگراف پیشنویسشده بهگونهای که ثبت زبانی، ریتم و پیوندهای آن همانطور خوانده شود که یک فرد تحصیلکرده در این حوزه واقعاً مینویسد، در حالی که هر ارجاع، اصطلاح فنی و عددی دستنخورده باقی میماند. این موضوع اکنون اهمیت بیشتری دارد، زیرا Turnitin و دیگر آشکارسازها شروع کردهاند متن فارسی را مستقیماً بخوانند، نه فقط چکیده انگلیسیِ پیوستشده به آن را.
Persian نامی است که در زبانشناسی و در بیشتر زمینههای دانشگاهی به کار میرود، هرچند بیرون از محیطهای دانشگاهی همان زبان معمولاً Farsi نامیده میشود، و بسیاری از دانشجویان بهجای persian ai humanizer به دنبال farsi ai humanizer میگردند، بیآنکه متوجه باشند این دو اصطلاح به همان ابزار اشاره میکنند. ایران دسترسی مستقیم به ChatGPT را محدود میکند، بنابراین بیشتر پیشنویسها از طریق VPN عبور میکنند، و این امر نحوه خواندن پاراگراف نهایی توسط آشکارساز را تغییر نمیدهد. آنچه در ادامه میآید، محل قرار گرفتن نشانههای هوش مصنوعی در نثر دانشگاهی فارسی، شیوه برخورد دانشگاههای ایرانی و آشکارسازها با متن علامتگذاریشده در حال حاضر، و اینکه چگونه یک humanizer ساختهشده برای نحو فارسی آنها را حذف میکند، در چارچوب یک multilingual AI humanizer گستردهتر است که همان رویکرد را در پانزده زبان به کار میگیرد.
چرا متن هوش مصنوعی در فارسی علامتگذاری میشود
خروجی فارسی ChatGPT بر مجموعهای محدود از پیونددهندههای کلیشهای تکیه دارد که یک نویسنده دانشگاهی بومی آنها را متنوع میکند یا بهکلی کنار میگذارد. 'در این راستا' جمله را پشت جمله آغاز میکند، 'از این رو' و 'در نتیجه' بهعنوان گذارهای کلی میان بندهایی که هیچ پیوند منطقی واقعی ندارند تکرار میشوند، و بندها پشت 'و همچنین' انباشته میشوند، بهجای آنکه به جملههای جداگانه با نشانهگذاری مستقل خود شکسته شوند. هیچیک از این عبارتها بهخودیخود نادرست نیست. نشانه در بسامد است: یک نویسنده انسانی گاهبهگاه به سراغ یکی از آنها میرود، در حالی که یک مدل تقریباً در هر پاراگراف به همان چند مورد محدود رجوع میکند.
دو ساختار دیگر نیز بهطور مداوم ظاهر میشوند. آغازگرِ پُرکنندهٔ «لازم به ذکر است که» پیش از نکتهٔ اصلی، به اندازهٔ یک جمله وقتکشی میکند، و عبارتِ احتیاطیِ غیرشخصیِ «میتوان گفت که» نویسنده را از ادعایی که یک استاد راهنما انتظار دارد بهصورت مستقیم بیان شود، دور میکند. نثر دانشگاهیِ انگلیسی نسخهٔ خاص خود را از این مشکل دارد، که در نوشتهٔ TextPulse دربارهٔ words that give away ChatGPT فهرست شده است، و سازوکار زیربنایی همان است: مدلی که برای محتاط بهنظر رسیدن در هر زبانی آموزش دیده است، بهجای یک جملهٔ مشخص و متعهد، بهطور پیشفرض به احتیاطورزی و تکرار روی میآورد.
نثر فارسیِ شبیه به AI چه شکلی دارد
این الگو را آسانتر میتوان در کنار هم دید. نمونهٔ زیر یک بند کوتاه است که کاملاً از نشانههای بالا ساخته شده است: یک پیونددهندهٔ آغازینِ رویهمچیده، بندِ قالبیِ «نقش مهمی ایفا میکند»، آغازگرِ پُرکنندهٔ «لازم به ذکر است»، و یک جملهٔ پایانی که با «میتوان گفت که» محتاط شده است. نسخهٔ انسانیشده هر ادعایی را که متن اصلی مطرح میکند حفظ میکند و هیچ بخشی از محتوا را حذف نمیکند، اما پیونددهندههای رویهمچیده را برمیدارد، طول جملهها را متنوع میکند، و هدف مطالعه را بهطور مستقیم بیان میکند، نه اینکه بهسوی آن احتیاطورزی کند.
| فارسیِ شبیهبههوشمصنوعی | پس از انسانیسازی |
|---|---|
| در این راستا، فناوریهای هوش مصنوعی در سالهای اخیر نقش بسزایی در حوزه نگارش دانشگاهی ایفا کردهاند. لازم به ذکر است که پژوهشگران از این رو با چالشهایی در زمینه اصالت و کارایی مواجه هستند. در نتیجه، میتوان گفت که هدف این پژوهش بررسی نظاممند این چالشها است. | فناوریهای هوش مصنوعی در چند سال اخیر نگارش دانشگاهی را دگرگون کردهاند. پژوهشگران هم از مزیت سرعت بهره میبرند و هم با دشواریهایی درباره اصالت متن دستوپنجه نرم میکنند. این پژوهش میکوشد این دشواریها را به شکلی نظاممند بررسی کند. |
| English gloss: AI technologies have played a significant role in academic writing in recent years, researchers face challenges around originality and efficiency, and the study's goal is to systematically examine these challenges. | English gloss: the same claims, without the stacked connector phrases, in plainer and more rhythmically varied sentences a native academic writer would actually use. |
تشخیص هوش مصنوعی در ایران و دیاسپورای ایرانی
پذیرش ابزارهای تشخیص در داخل ایران با بیشتر کشورهای دیگر تفاوت دارد. Turnitin در جاهایی استفاده میشود که دانشگاه اشتراک دارد، اما OpenAI دسترسی مستقیم به ChatGPT را از ایران مسدود میکند، بنابراین بیشتر دانشجویان و پژوهشگران از طریق VPN به آن میرسند، و این موضوع از همان ابتدا بر اینکه متن هوش مصنوعی چگونه وارد پیشنویس میشود و بعداً ردیابی آن چقدر دشوار است اثر میگذارد. در کنار Turnitin، ابزاری داخلی به نام Samim Noor (سمیم نور) بهطور گسترده برای بررسی سرقت ادبی استفاده میشود و بهتدریج در حال افزودن تشخیص هوش مصنوعی است، هرچند پوشش آن برای نشانههای ویژه هوش مصنوعی در مقایسه با بررسی شباهت، یکنواخت نیست.
GPTZero و Originality.ai نفوذ مستقیم محدودی در نهادهای ایرانی دارند، باز هم عمدتاً به دلیل محدودیت دسترسی، هرچند پژوهشگران دیاسپورا که از ایالات متحده، کانادا یا اروپا منتشر میکنند با آنها همانگونه روبهرو میشوند که هر نویسنده بینالمللی دیگری روبهرو میشود. مقالهای که بهصورت مشترک میان یک دانشگاه ایرانی و یک نهاد غربی نوشته شده باشد، میتواند در همان دستنوشته با دو بررسی تشخیص متفاوت مواجه شود: یک سنجش شباهت داخلی در سمت ایرانی و یک گذر از Turnitin یا GPTZero وقتی به دانشگاه همنویسنده یا سامانه ارسال خودِ یک مجله میرسد.
هیچیک از اینها چیزی را که واقعاً علامتگذاری میشود تغییر نمیدهد. یک آشکارساز که متن فارسی را میخواند، همچنان به همان نظم آماری، پیونددهندههای انباشته و احتیاطنمایهای تکرارشدهای که بالاتر توضیح داده شد، واکنش نشان میدهد، فارغ از اینکه کدام ابزار بررسی را اجرا کند یا بررسی در کدام کشور انجام شود. نوشتاری که پیونددهندههای خود را متنوع میکند و ادعاهایش را بهطور مستقیم بیان میکند، هم برای یک دانشگاهی فارسیخوان و هم برای هر آشکارسازی که یک دانشگاه یا مجله معین از آن استفاده کند، انسانی به نظر میرسد.
مقاله خود را انسانیسازی کنید
متنِ کمکگرفته از AI خود را دگرگون کنید و کاری کنید طبیعی به نظر برسد، بدون دست زدن به واژههای مهم یا ارجاعها.
سیاستهای دانشگاهی
| University | Policy stance |
|---|---|
| University of Tehran | هیچ سیاست واحد و منتشرشدهای درباره هوش مصنوعی مولد در سطح کل دانشگاه به زبان انگلیسی یافت نشد؛ به نظر میرسد راهنماها بیشتر در اختیار دانشکدههای منفرد و استادان راهنمای پایاننامه باشد تا یک آییننامه مرکزی. |
| Sharif University of Technology | هیچ سیاست عمومی به زبان انگلیسی درباره هوش مصنوعی مولد یافت نشد؛ متنی که بدون افشا توسط هوش مصنوعی نوشته شده باشد، به احتمال زیاد بهعنوان یک موضوع مربوط به یکپارچگی دانشگاهی و بهصورت موردی رسیدگی میشود. |
| Amirkabir University of Technology | هیچ سیاست منتشرشده و قابلراستیآزمایی درباره استفاده از هوش مصنوعی یافت نشد؛ بررسی پایاننامه و مقاله احتمالاً بر قضاوت استاد راهنما و غربالگری استاندارد سرقت ادبی تکیه دارد. |
| Shahid Beheshti University | هیچ سیاست مشخصی درباره هوش مصنوعی مولد قابلراستیآزمایی نبود؛ مقررات کلی یکپارچگی دانشگاهی احتمالاً استفاده افشانشده از هوش مصنوعی را ذیل قواعد موجود سرقت ادبی پوشش میدهد. |
| Isfahan University of Technology | هیچ سیاست عمومیِ خاصِ هوش مصنوعی یافت نشد؛ فرض بر این است که نظارت از همان اختیار عمل در سطح دانشکده پیروی میکند که در میان دانشگاههای دولتی ایران رایج است. |
| Ferdowsi University of Mashhad | هیچ سیاست اختصاصی درباره هوش مصنوعی مولد یافت نشد؛ اجرای مقررات احتمالاً بر کدهای موجود صداقت دانشگاهی استوار است، نه بر یک حکم نامدار درباره هوش مصنوعی. |
نشریات و فرهنگ استناد
ادبیات دانشگاهی به زبان فارسی گسترده است و رشتههای متعددی را دربر میگیرد، و هر رشته نشریات علمی خاص خود را با سبک ارجاعدهی متناظر دارد. نشریات پزشکی عمدتاً به سبک Vancouver و بهصورت شمارهگذاریشده منتشر میشوند، برای مثال: Journal of Isfahan Medical School (run by Isfahan University of Medical Sciences). پژوهشهای علوم اجتماعی و انسانی عمدتاً به سبک APA منتشر میشوند، برای مثال: Iranian Journal of Sociology; Comparative Literature Studies Quarterly. پژوهش در مهندسی و فناوری به سبک IEEE و بهصورت شمارهگذاریشده منتشر میشود. مطالعات زبانشناسی در نشریه: نامه فرهنگستان، منتشرشده توسط Academy of Persian Language and Literature، منتشر میشوند.
انسانیسازیِ همراه با حفظ استناد در اینجا اهمیت دارد، زیرا شمارهگذاری در Vancouver، APA و IEEE هر یک ارجاعات را بهگونهای متفاوت قالببندی میکنند، و یک ابزار بازنویسی که نشانگر استناد شمارهدار یا ارجاعِ درونپرانتزِ نویسنده-تاریخ را تشخیص ندهد، میتواند آن را بیصدا خراب کند، در حالی که جمله پیرامونی را روانتر میسازد. پژوهشگری که در موضوعات علم و سیاست به رهیافت (Rahyaft) یا به یک مجله پزشکی با سبک Vancouver مقاله میفرستد، باید استدلال را بازنویسیشده و فهرست منابع را دقیقاً همانگونه که ارسال شده است، دستنخورده باقیمانده، دریافت کند، و این دو باید بهعنوان دو کار جداگانه، نه یک فرایند واحد، انجام شوند.
TextPulse چگونه بهعنوان یک انسانیسازِ هوش مصنوعیِ فارسی کار میکند
حالت چندزبانه TextPulse متن فارسی را مستقیماً پردازش میکند، نه اینکه آن را به انگلیسی ترجمه کند، سپس انسانیسازی کند و دوباره برگرداند، چرخهای رفت و برگشتی که تمایزهای سبکیِ توضیحدادهشده در بالا را مخدوش میکند. این حالت حوزه علمی و سطح رسمیتِ متن را میخواند، سپس پیونددهندهها، آهنگ جمله و الگوی احتیاطورزی را طوری تنظیم میکند که با شیوه نوشتن یک پژوهشگر انسانی در آن حوزه هماهنگ شود، در حالی که اعداد، نشانگرهای استناد و اصطلاحات فنی را دقیقاً همانگونه که ارسال شدهاند، باقی میگذارد.
این حفظکردن به همان اندازه خودِ بازنویسی اهمیت دارد. یک استنادِ شمارهگذاریشده به سبک Vancouver، یک جفتِ نویسنده-تاریخ در APA یا یک شماره داخل کروشه در IEEE همگی باید بدون تغییر از این فرایند عبور کنند، زیرا یک ارجاعِ خراب مسئلهای جدا از یک بندِ علامتگذاریشده است. پژوهشگرانی که میان نوشتار دانشگاهی فارسی و ویتنامی جابهجا میشوند، برای نمونه، با همان منطقِ آشکارساز روبهرو میشوند، هرچند AI humanizer for Vietnamese باید مجموعه متفاوتی از نشانهها را، از نشانههای دیاکریتیک تا واژههای پایانیِ جمله، حل کند. نتیجه، یک متن فارسی است که استدلال، استنادها و لحنِ متناسب با حوزه خود را حفظ میکند، بدون پیونددهندههای انباشتهای که در وهله نخست خروجی هوش مصنوعیِ فارسی را قابلتشخیص میسازند.
سؤالات متداول
بله. یک انسانساز AI فارسی که برای متن دانشگاهی ساخته شده است، استدلال را از دستگاه ارجاع جدا میکند، نه این که همه چیز را به صورت یک بلوک بازنویسی کند. اعداد، DOIها، نام نویسندگان و نشانگرهای استناد، چه از شمارهگذاری Vancouver پیروی کنند، چه از قالب نویسنده-تاریخ APA یا براکتهای سبک IEEE، بدون تغییر عبور میکنند، در حالی که جمله فارسیِ پیرامونی از نظر لحن و آهنگ بازنویسی میشود.
Content planner and copywriter at TextPulse. Sara runs the blog day to day, from planning and drafting through to publishing. She writes the practical guides: clear explanations of academic writing problems, aimed at the person who actually has to hand something in.