سوءاستفاده از محتوای مقیاسپذیر: گوگل دقیقاً چه چیزی را جریمه میکند
تعریف گوگل فقط یک جمله است، و تقریباً هر خلاصهای از آن نیمهای را که اهمیت دارد حذف میکند. این سیاست صفحاتی را توصیف میکند که با هدف اصلی دستکاری رتبهبندیها و نه کمک به کاربران تولید شدهاند، و این یعنی هدف محرک است و حجم فقط یک پیامد جانبی. در اینجا عبارت دقیق، 5 رویهای که گوگل فهرست میکند، و روشی برای آزمون یک طرح انتشار پیش از آنکه چیزی پیشنویس شود آمده است.
یک برند خدمات محلی نود صفحه شهری منتشر میکند و سهماهه بعد را با این نگرانی میگذراند که شاید از خطی عبور کرده باشد. در همان نزدیکی، یک رقیب چهار هزار صفحه را بر پایه همان نوع قالب اجرا میکند. هر دو تیم در حال شمارش حجم هستند. تنها چیزی که سیاست Google اندازهگیری نمیکند، حجم است.
سوءاستفاده از محتوای مقیاسپذیر که Google در سیاستهای اسپم خود نام میبرد، یک تعریف یکجملهای دارد و هر واژه عملیاتی در آن، قصد را توصیف میکند. متن صفحه زنده چنین است: "Scaled content abuse is when many pages are generated for the primary purpose of manipulating search rankings and not helping users." آن را آهسته بخوانید. دو شرط باید همزمان برقرار باشند و شمارش صفحات بهتنهایی هیچیک از آنها را برآورده نمیکند.
این تمایز تعیین میکند که آیا یک برنامه انتشار، تصمیمی تجاری است یا الگوی اسپم، و بیشتر توضیحهای این سیاست مستقیماً از آن میگذرند و به بحثی درباره اینکه چه مقدار محتوا زیاد است میرسند. موضع گستردهتر Google درباره محتوای تولیدشده با AI در همان مجموعه اسناد قرار دارد و بر منطق یکسانی استوار است. آنچه در ادامه میآید خودِ سیاست اسپم است: متن آن، شیوههایی که Google زیر آن فهرست کرده است، و آزمونی که میتوانید پیش از آنکه حتی یک واژه پیشنویس شود، بر یک طرح اعمال کنید.
سوءاستفاده از محتوای مقیاسپذیر که Google مجازات میکند: متن دقیق
تعریف Google به سه بند تقسیم میشود و هر سه بند کارکرد دارند. بسیاری از صفحات تولید میشوند، که بخش مربوط به حجم است و تنها بخشی است که بیشتر خلاصهها نقل میکنند. برای هدف اصلی دستکاری رتبهبندی جستوجو، که ادعایی درباره این است که این صفحات اصلاً چرا وجود دارند. و نه برای کمک به کاربران، که ادعایی درباره کاری است که پس از ورود کسی به آنها انجام میدهند. صفحهای که این جمله را در خود دارد، آخرین بار در May 2026 بهروزرسانی شده است، بنابراین متن جاری است نه تصویری از اعلامیه 2024.
اصلی واژهای است که بیشترین بار را بر دوش میکشد. تقریباً هر صفحه تجاری تا حدی با در نظر داشتن رتبهبندی ساخته میشود، و این سیاست از ناشر نمیخواهد که خلاف این را وانمود کند. این سیاست میپرسد هدف اصلی صفحه چیست. صفحهای که اگر فردا موتورهای جستجو خاموش شوند باز هم ارزش انتشار داشته باشد، هدف اصلیای دارد که بهراحتی از این آزمون عبور میکند. صفحهای که همان بعدازظهر حذف میشود، چنین نیست.
پنج رویهای که Google فهرست میکند
Google پنج رویه را ذیل این سیاست نام میبرد، و هوش مصنوعی مولد دقیقاً در یکی از آنها ظاهر میشود. چهار مورد دیگر درباره استخراج، سرهمکردن، سایتهای ماهوارهای پنهان و صفحات کلیدواژهای است که هیچکس نمیتواند آنها را بخواند، و هیچیک به یک مدل زبانی نیاز ندارد. هر مدخل در فهرست با همان قید درباره ارزش برای کاربران پایان مییابد، و همین بخش است که به شما میگوید Google در واقع چه چیزی را اندازهگیری میکند.
| رویه، به گفته Google | این مدخل چه چیزی را میسنجد |
|---|---|
| "Using generative AI tools or other similar tools to generate many pages without adding value for users" | اینکه آیا چیزی افزوده شده است یا نه، نه اینکه کدام ابزار آن را تایپ کرده است |
| "Scraping feeds, search results, or other content to generate many pages (including through automated transformations like synonymizing, translating, or other obfuscation techniques), where little value is provided to users" | اینکه آیا ماده منبع به چیزی تازه تبدیل شده است یا صرفاً برچسبی تازه خورده است |
| "Stitching or combining content from different web pages without adding value" | اینکه آیا سرهمکردن بهعنوان تألیف محسوب میشود یا نه |
| "Creating multiple sites with the intent of hiding the scaled nature of the content" | اینکه آیا ناشر از پیش مانند کسی رفتار میکند که انتظار دارد دستگیر شود |
| "Creating many pages where the content makes little or no sense to a reader but contains search keywords" | اینکه آیا اصلاً یک خواننده انسانی مخاطب مورد نظر بوده است یا نه |
چهار مورد از پنج مورد، شیوههایی را توصیف میکنند که یک دهه پیش از هوش مصنوعی مولد وجود داشتهاند. خوراکهای استخراجشده، بازنویسیهای مترادفسازیشده، صفحات درگاهی پر از اصطلاحات، و تجمیعهای بههمدوخته، مدتها پیش از آنکه یک مدل بتواند پاراگرافی قابل استفاده بنویسد، اسپم بودند. اما اکنون این کار ارزان است. پیشتر، صفحه پانصدم تقریباً همانقدر هزینه داشت که صفحه اول هزینه داشت، بنابراین اکنون با قاعدهای روبهرو هستیم که Google سالهاست به شکلی آن را اجرا کرده است. این موضوع شبیه یک تهدید تازه به نظر میرسد.
مقاله خود را انسانیسازی کنید
متنِ کمکگرفته از AI خود را دگرگون کنید و کاری کنید طبیعی به نظر برسد، بدون دست زدن به واژههای مهم یا ارجاعها.
چرا صرف حجم، محرک نیست
Google هیچ آستانهای برای شمار صفحات منتشر نمیکند، و هیچ تعداد صفحهای بهتنهایی این سیاست را فعال نمیکند. یک خردهفروش با 200000 صفحه محصول، یک تابلوی شغلی که برای هر فرصت شغلی یک فهرست زنده دارد، یک سایت مرجع با یک مدخل برای هر ترکیب شیمیایی، هر یک از آنها در مقیاسی عظیم منتشر میکنند، و هیچیک با جملهای درباره صفحاتی که برای دستکاری رتبهبندی تولید شدهاند و در عین حال در کمک به کاربران ناکام میمانند، مطابقت ندارد. مقیاس، پیامدِ فهرست است، نه دلیلِ پروژه.
عکس این نیز به همان اندازه صادق است. 40 صفحه میتوانند بدون دشواری این سیاست را نقض کنند، اگر هر 40 صفحه همان یک صفحه باشند که فقط نام یک مکان در آن عوض شده و هیچ چیز در هیچیک از آنها برای خوانندهای در آن مکان مفید نباشد. حجم زیاد، الگوی نازک را آسانتر قابل مشاهده و آسانتر قابل شناساییِ نظاممند میکند، و به همین دلیل است که این سیاست اصلاً به مقیاس اشاره میکند. مقیاس، زمینهای است که مسئله در آن ظاهر میشود، و مسئله همان چیزی است که این صفحات برای آن ساخته شدهاند.
چگونه تشخیص دهیم یک طرح در کدام سوی خط قرار میگیرد
بپرسید هر صفحه چه چیزی خواهد داشت که هیچ صفحه دیگری در این مجموعه ندارد، و این پرسش را پیش از آنکه چیزی پیشنویس شود مطرح کنید. اگر پاسخ، نامی، عددی و کدپستیای باشد که از یک صفحهگسترده گرفته شده است، آن مجموعه یک الگو با متغیرهاست و جمله Google آن را بهدرستی توصیف میکند.
- ورودیای را که هر صفحه دارد و هیچ صفحه دیگری در دسته آن را ندارد، پیش از آنکه پیشنویس نخست وجود داشته باشد، نام ببرید. یک ستون صفحهگسترده بهعنوان ورودی محسوب نمیشود.
- بپرسید آیا هر صفحه همچنان سفارش داده میشد اگر هرگز نمیتوانست برای هیچ چیزی رتبه بگیرد. پاسخ مثبت یعنی پرسشِ هدف اصلی از پیش پاسخ داده شده است.
- بررسی کنید که آیا خوانندهای که روی هر صفحه منفرد فرود میآید، چیزی مییابد که نمیتوانست از نتیجه بالاتر از شما به دست آورد.
- تأیید کنید که صفحات روی یک سایت و تحت یک نام قرار دارند. پخش کردن آنها میان دامنههای ماهوارهای در فهرست نمونههای خود Google دیده میشود.
آخرین مورد از پنج مدخل Google صفحاتی را پوشش میدهد که محتوای آنها برای خواننده، در حالی که واژگان جستوجوی درست را حمل میکنند، اندک یا هیچ معنایی ندارد، و این ارزانترین خطا برای آزمودن است. سه صفحه را از میانه یک دسته بیرون بکشید و آنها را با صدای بلند، چنانکه یک مشتری میخواند، بخوانید. اجرای یکی از آنها از طریق یک ابزار رایگان سنجش خوانایی یک نظر دوم صریح درباره این میدهد که آیا آن جملهها اصلاً برای یک انسان ساخته شده بودند یا نه.
جایی که یک دسته واقعاً از نظر محتوا متمایز است و فقط از نظر لحن کلی است، اصلاح آن ویرایشی است نه ساختاری. An AI humanizer شیوه خوانده شدن یک مجموعه صفحه را در سراسر دسته تغییر میدهد، و یک راهنمای گامبهگام برای انسانیسازی متن AI همان کار را بهصورت دستی پوشش میدهد. هیچیک مشکل ورودی را حل نمیکند. آن باید در بالادستِ نوشتن، در نقطهای که کسی تصمیم میگیرد هر صفحه برای چه چیزی است، اصلاح شود.
آیا سوءاستفاده از محتوای مقیاسپذیر همان سوءاستفاده از اعتبار سایت است؟
خیر، و این دو پیوسته با هم اشتباه گرفته میشوند، زیرا Google آنها را در مارس 2024 با هم اعلام کرد. سوءاستفاده از محتوای مقیاسپذیر صفحات کمارزش و انبوهتولیدشده خودِ یک سایت را دربر میگیرد. سوءاستفاده از اعتبار سایت اصطلاح Google برای محتوای شخص ثالثی است که در یک سایت میزبان منتشر میشود، عمدتاً به این دلیل که سیگنالهای رتبهبندیای را که آن میزبان پیشتر از کار نخستدست خود به دست آورده است، با خود دارد، و بخش کوپن که به یک سایت خبری الصاق شده نمونهای است که همه آن را میشناسند. یکی از این سیاستها توصیف میکند که یک سایت از ظرفیت انتشار خود سوءاستفاده میکند. دیگری توصیف میکند که یک سایت اعتباری را که برای چیزی کاملاً متفاوت ساخته است، اجاره میدهد.
آنچه Google میگوید بهجای آن میخواهد، در E-E-A-T، که صفحهٔ جداگانهٔ خود را دارد آمده است. در بخش تولید، انسانیسازی یک پست وبلاگ AI برای SEO بهطور جداگانه پوشش داده شده است.
جملهٔ Google را در بالای brief محتوایی بعدی بگذارید و پیش از آنکه کسی شروع به پیشنویسنویسی کند، آن را بهصورت مکتوب برای کل batch پاسخ دهید. تیمی که نتواند بگوید هر صفحه چه چیزی اضافه میکند، معمولاً این را در مرحلهٔ برنامهریزی درمییابد، که ارزانترین زمان ممکن برای فهمیدن آن است.
سؤالات متداول
گوگل آن را به صورت صفحات فراوانی تعریف میکند که با هدف اصلی دستکاری رتبهبندیهای جستجو و نه کمک به کاربران تولید شدهاند. هر دو بخش این جمله باید برقرار باشند. سوءاستفاده از محتوای مقیاسپذیر که گوگل توصیف میکند، گزارهای درباره این است که صفحات چرا وجود دارند و برای خواننده چه میکنند، و این سیاست هیچ شمار صفحهای را که به تنهایی آن را فعال کند نام نمیبرد.
Content strategist at TextPulse, here since the company started. Mark writes the product and technical coverage: how the humanizer works under the hood, what changes in each release, and what a specification actually means for your writing. His reviews of writing software come from using them on real documents rather than reading a feature list.