AI Detection

একাডেমিক গদ্যে বাক্যের ছন্দ: কেন একরকম লেখা যান্ত্রিক মনে হয়

বাক্যের দৈর্ঘ্য একরকম হওয়া ব্যাকরণের সমস্যা নয়, এটি গতি-ছন্দের সমস্যা, এবং কোনো detector কী ভাবে তা নির্বিশেষে এটি পাঠককে ক্লান্ত করে। এই পোস্টে ব্যাখ্যা করা হয়েছে কেন একাডেমিক গদ্য সমতল হয়ে যায়, পাঠকের জন্য ছন্দ আসলে কী করে, এবং বাস্তব আগে ও পরে উদাহরণসহ কীভাবে একটি অনুচ্ছেদের মধ্যে বৈচিত্র্য ফিরিয়ে আনা যায়।

6 min
How to vary sentence length in academic writing: a paragraph rewritten from uniform sentences into a varied rhythm.

একজন তত্ত্বাবধায়ক একবার একটি খসড়া ফেরত দিয়েছিলেন, মার্জিনে একটি পুরো পৃষ্ঠার পাশে একটিমাত্র মন্তব্যসহ: "This reads like a checklist." পৃষ্ঠার কোনো কিছুই ব্যাকরণগতভাবে ভুল ছিল না। প্রতিটি বাক্য ছিল সম্পূর্ণ, সঠিক যতিচিহ্নযুক্ত একটি দাবি, প্রায় পঁচিশটি শব্দের, একটির পর একটি, টানা নয়টি অনুচ্ছেদ জুড়ে। বিষয়বস্তু ঠিক ছিল। সমস্যা ছিল ছন্দে, আর ছন্দ এমন কিছু নয় যা কোনো grammar check কখনো ধরতে পারবে।

একাডেমিক লেখায় বাক্যের দৈর্ঘ্য কীভাবে ভিন্ন করা যায়, তা শেখা মানে স্বয়ংক্রিয়ভাবে ছোট বাক্য যোগ করা নয়, বরং লক্ষ্য করা যে একটি বাক্যের দৈর্ঘ্য কোথায় ইতিমধ্যে কাজ করছে, বা ব্যর্থ হচ্ছে। তিনটি দীর্ঘ বাক্যের পরে ফেলে দেওয়া একটি ছোট বাক্য এমন ওজন নিয়ে নেমে আসে, যা অন্যথায় তার থাকত না। যে দীর্ঘ বাক্য কখনো ভাঙে না, পৃষ্ঠা থেকে পৃষ্ঠায় বারবার পুনরাবৃত্ত হলে, তার ভেতরের যুক্তি যতই শক্ত হোক না কেন, পাঠককে ক্লান্ত করে তোলে। ছন্দ একটি উপকরণ, আর অধিকাংশ একাডেমিক লেখা সেটিকে অব্যবহৃতই রেখে দেয়।

একাডেমিক লেখায় বাক্যের দৈর্ঘ্য কীভাবে ভিন্ন করবেন

একাডেমিক লেখায় বাক্যের দৈর্ঘ্য ভিন্ন করুন, ইচ্ছাকৃতভাবে একটি ধারা ভেঙে, যখন তা দুই বা তিনটির বেশি বাক্য ধরে চলতে থাকে, শব্দ গুনে লক্ষ্য নির্ধারণ করে নয়। আগে যুক্তিটি লিখুন। তারপর তা আবার পড়ে দেখুন এবং সমান দৈর্ঘ্যে নামা প্রতিটি বাক্যধারা চিহ্নিত করুন। এরপর একটি ভেঙে দিন, দুটি পাতলা বাক্যকে একত্র করে এমন একটি একক বাক্য বানান যা তার আকারের যোগ্যতা অর্জন করে, অথবা একটি দীর্ঘ বাক্যকে সেই স্থানে কাটুন, যেখানে পাঠকের মনোযোগ স্বাভাবিকভাবেই সরে যেতে পারে।

এর কোনো মানে এই নয় যে পৃষ্ঠাজুড়ে ছোট, বড়, ছোট, বড় করে একটি ভিন্ন সেটিংয়ের metronome-এর মতো চলতে হবে। যান্ত্রিক ধারা তবু ধারা-ই থাকে, আর প্রশিক্ষিত পাঠক প্রথমটির মতোই দ্রুত দ্বিতীয় ছন্দটিও টের পান। লক্ষ্য হলো এমন ভিন্নতা, যা যুক্তির গতিপথ অনুসরণ করে, নিজের জন্য ভিন্নতা নয়।

একাডেমিক গদ্য কেন সমতল হয়ে যায়

কয়েকটি সাধারণ অভ্যাস একাডেমিক বাক্যকে একই দৈর্ঘ্যের দিকে ঠেলে দেয়, এবং এগুলোর কোনোটিই আলস্য নয়। Hedging তার একটি উদাহরণ, "it could be argued that" বা "the findings appear to suggest" ধরনের বাক্যাংশ পরপর অনেক বাক্যের শুরুতে প্রায় একই ধরনের একটি উপবাক্য যোগ করে, ফলে প্রকৃত বিষয়বস্তু শুরু হওয়ার আগেই পরের অংশটি একই রকম গঠন পেয়ে যায়। দ্বিতীয়টি হলো topic-sentence template, যা অধিকাংশ লেখক শুরুতেই অনুশীলন করেন, একটি দাবি, তারপর প্রায় একই দৈর্ঘ্যের সমর্থনমূলক বাক্যের একটি ধারাবাহিকতা।

তৃতীয় কারণটি অভ্যাসের চেয়েও গভীরে যায়। একটি খসড়াকে এমনভাবে সংশোধন করা যাতে তা সর্বত্র সমানভাবে আনুষ্ঠানিক শোনায়, তা আগের, বেশি অমসৃণ খসড়ায় থাকা দৈর্ঘ্যের বৈচিত্র্যটিকেই মুছে ফেলতে পারে, কারণ ছেঁড়া ছেঁড়া এবং অসমান গঠনই প্রায়ই সেই প্রথম জিনিস যা একজন লেখক সুরের জন্য পরিমার্জন করতে গিয়ে বাদ দেন। ফলাফলটি সতর্ক বলে মনে হয়। এটি সমতলও শোনায়, এবং এই দুইটি একই প্রশংসা নয়।

ছন্দ আসলে পাঠকের জন্য কী করে

একটি সংক্ষিপ্ত বাক্য কয়েকটি দীর্ঘ বাক্যের ঠিক পরে এলে বেশি ওজন বহন করে, এবং এই প্রভাবটি প্রায় পুরোপুরি বিষয়বস্তুর চেয়ে বৈপরীত্যের বিষয়। ত্রিশটি শব্দের তিনটি বাক্য চতুর্থটির জন্য একটি প্রত্যাশা তৈরি করে। সেই প্রত্যাশা ভেঙে পাঁচ শব্দের একটি বাক্য ইচ্ছাকৃত বলে মনে হয়, প্রায় যেন লেখক থেমে গিয়েছিলেন, এবং পাঠক সেই থামাকে জোর হিসেবে অনুভব করেন, কেন তা বলতে না হয়েও।

এর বিপরীত খরচও সমান বাস্তব, এবং এটির প্রতি অনেক কম মনোযোগ দেওয়া হয়। যে প্রবন্ধে টানা ছয় পৃষ্ঠা ধরে প্রতি বাক্যে প্রায় আটাশটি শব্দ থাকে, তা একবার পড়তে কঠিন নয়। কিন্তু ছয় পৃষ্ঠা ধরে পড়তে কঠিন, কারণ ছন্দে এমন কিছু থাকে না যা জানায় কোথায় একটি ধারণা শেষ হচ্ছে এবং পরেরটি শুরু হচ্ছে, আর পাঠককে সেই কাঠামোটি নিজেই যোগ করতে হয়, বাক্য থেকে বাক্যে, পুরো অধ্যায়ের দৈর্ঘ্য জুড়ে। এমন ক্লান্তির সঙ্গে শব্দভান্ডার বা যুক্তির মানের খুব কম সম্পর্ক আছে। এটি গতি-নিয়ন্ত্রণের সমস্যা।

আপনার নিজস্ব পেপারকে মানবসদৃশ করুন

আপনার AI-সহায়তাপ্রাপ্ত লেখাকে রূপান্তর করুন এবং গুরুত্বপূর্ণ শব্দ বা উদ্ধৃতি স্পর্শ না করে সেটিকে মানবসদৃশ শোনান।

বিনামূল্যে শুরু করুন

আগে এবং পরে, দুটি সমতল অনুচ্ছেদ, পুনর্লিখিত

দুটি সংক্ষিপ্ত অংশ এই প্রক্রিয়াটিকে স্পষ্ট করে। কোনো উদাহরণেই কী দাবি করা হচ্ছে তা বদলায় না, শুধু দাবিটি কীভাবে ছন্দে উপস্থাপিত হচ্ছে তা বদলায়।

পূর্বেপরেকী বদলেছে
হস্তক্ষেপটি তিনটি কোহর্ট জুড়ে উদ্বেগের স্কোর কমিয়েছিল, এবং এই হ্রাসটি বয়স নির্বিশেষে সামঞ্জস্যপূর্ণ ছিল, যা গবেষণার শুরুতে প্রত্যাশিত ছিল না এবং ইঙ্গিত দেয় যে প্রক্রিয়াটি বয়স-নির্ভর নাও হতে পারে, এমন একটি সম্ভাবনা যা মূল অনুমান বিবেচনায় নেয়নি।হস্তক্ষেপটি তিনটি কোহর্ট জুড়ে উদ্বেগের স্কোর কমিয়েছিল। বয়স নির্বিশেষে সেটি বজায় ছিল, যা দলের কেউই শুরুতে আশা করেনি। শেষ পর্যন্ত প্রক্রিয়াটি বয়স-নির্ভর নাও হতে পারে।একটি 60-শব্দের বাক্য তিনটি ভিন্ন দৈর্ঘ্যের বাক্যে পরিণত হয়েছে। দাবি বদলায়নি। গতি পাঠককে কী ঘটেছে তা নিবন্ধনের জন্য তিনটি পৃথক স্থান দেয়।
অংশগ্রহণকারীদের চারটি ক্লিনিক থেকে নিয়োগ করা হয়েছিল। নৈতিক অনুমোদন আগেই নেওয়া হয়েছিল। সম্মতি লিখিতভাবে নথিভুক্ত করা হয়েছিল। তথ্য সংগ্রহ 6 মাস ধরে চলেছিল। বিশ্লেষণ একটি পূর্ব-নিবন্ধিত পরিকল্পনা অনুসরণ করেছিল।অংশগ্রহণকারীদের চারটি ক্লিনিক থেকে নিয়োগ করা হয়েছিল, যেখানে নৈতিক অনুমোদন আগেই নেওয়া হয়েছিল এবং তথ্য সংগ্রহ শুরু হওয়ার আগে সম্মতি লিখিতভাবে নথিভুক্ত করা হয়েছিল, এরপর তা 6 মাস ধরে একটি পূর্ব-নিবন্ধিত বিশ্লেষণ পরিকল্পনার অধীনে চলেছিল।পাঁচটি সমানধর্মী বাক্য দুইটি দীর্ঘ বাক্যে পরিণত হয়েছে। এটি প্রথম উদাহরণের বিপরীত পথে যায়, প্রক্রিয়াগত ধাপগুলোকে কৃত্রিমভাবে একটি চেকলিস্টে কেটে ফেলার বদলে সেগুলোকে স্বাভাবিকভাবে একত্র করা বেশি উপযুক্ত পড়ে, কারণ এগুলো পাঁচটি পৃথক ঘটনার বদলে একটি ধারাবাহিক প্রক্রিয়া বর্ণনা করে।

বৈচিত্র্য গঠনের কৌশল

একটি পৃষ্ঠা জোরে পড়ুন, অথবা অন্তত নিচু স্বরে গুনগুন করে পড়ুন, এবং যেখানে আপনার কণ্ঠ থামতে চায় কিন্তু যতিচিহ্ন তা অনুমতি দেয় না, সেই প্রতিটি স্থান চিহ্নিত করুন। এই অমিল সাধারণত এমন একটি বাক্যকে নির্দেশ করে যা দুটি ধারণা ধরে রাখতে চাইছে, অথচ সেগুলো আসলে দুইটি বাক্য হতে চায়।

গণনা যতটা শোনায়, তার চেয়ে বেশি সাহায্য করে। পাঠকেরা ইতিমধ্যেই অচেতনভাবে এর মতো কিছু করে। 2023 সালের একটি উপলব্ধি-সংক্রান্ত গবেষণায়, গবেষকেরা দেখেছেন যে মানুষ একটি বাক্যের দৈর্ঘ্য অনুমান করে পৃষ্ঠায় সেটি কতটি লাইনের জায়গা নেয় তার ভিত্তিতে, শব্দগুলো আসলে গুনে নয়। তারা এটি অর্ধ সেকেন্ডেরও কম সময়ে করে। তাই একটি পৃষ্ঠা বেছে নিন, সেটি পড়ে যান এবং প্রতিটি বাক্যের শব্দসংখ্যা মার্জিনে লিখে রাখুন। গড়ের দিকে মনোযোগ দিতে প্রলুব্ধ হবেন না, তার বদলে বিস্তারের দিকে তাকান। যে পৃষ্ঠায় প্রতিটি সংখ্যা অন্যগুলোর থেকে তিন বা চার শব্দের মধ্যে থাকে, সেটিই প্রথমে পুনর্গঠন করার পৃষ্ঠা, সেই গড় যা-ই বলুক না কেন।

একটি অনুচ্ছেদের সবচেয়ে ছোট বাক্যটি মনে রাখার জন্য নির্ধারিত বক্তব্যের জন্য সংরক্ষণ করুন, যে উপবাক্যটি কেবল বলার মতো আর কিছু না পেয়ে শেষ হয়ে গেছে তার জন্য নয়। সেই অবস্থান একটি পছন্দ, এবং ইচ্ছাকৃতভাবে তা করা-ই মূলত একটি সচেতনভাবে বিন্যস্ত অনুচ্ছেদকে একটি আকস্মিক অনুচ্ছেদ থেকে আলাদা করে।

TextPulse-এর free burstiness checker একই গণনার অনুশীলন স্বয়ংক্রিয়ভাবে চালায়, পেস্ট করা খসড়ার প্রতিটি বাক্যকে দৈর্ঘ্য অনুযায়ী চিত্রিত করে, যাতে প্যাটার্নটি হাতে বাক্য ধরে পড়ার বদলে এক পৃষ্ঠাতেই দৃশ্যমান হয়। এটি detector-এর এই একই সমতলতার সংস্করণ ধরার জন্য তৈরি করা হয়েছিল, কিন্তু এর নিচের পরিমাপটি সেই একই ছন্দ, যা এই অংশটি বর্ণনা করছে।

এই একই প্যাটার্নের detection দিকটির নিজস্ব একটি নাম আছে। এই সাইটের একটি সহগামী লেখা burstiness আসলে কী পরিমাপ করে তা ব্যাখ্যা করে, detection দিকটি সম্পূর্ণভাবে আলোচনা করে, যাতে এই পোস্টটি প্রথমেই বাক্য লেখার বিষয়েই থাকতে পারে।

কোথায় একরূপতা এখনও সঠিক পছন্দ

এর কোনোটিই এমন নিয়ম নয় যা বিচার-বিবেচনা ছাড়া সর্বত্র প্রয়োগ করতে হবে। পাঁচটি ধারাবাহিক ধাপের একটি নম্বরযুক্ত methods section এমনভাবে পড়ার কথা, যেন তা পাঁচটি সংক্ষিপ্ত, সদৃশ নির্দেশনা, কারণ পাঠককে সেগুলো ক্রমানুসারে সম্পাদন করতে হবে, কাজ করার সময় গদ্যের সৌন্দর্য উপভোগ করতে নয়। একটি appendix-এ checklist বা verbatim পুনরুত্পাদিত interview questions-এর একটি সেট তার একরূপতার যোগ্য, এবং কোনো rewrite-ই যেখানে বৈচিত্র্যের প্রয়োজন নেই সেখানে তা তৈরি করা উচিত নয়।

এর কোনোটিই লক্ষ্য করতে বিশেষ সফটওয়্যার লাগে না, শুধু একটি পৃষ্ঠা এমন গতিতে আবার পড়ার ইচ্ছা লাগে, যেভাবে একজন পাঠক বাস্তবে পড়বে। TextPulse-এর free tools collection পুরো খসড়াজুড়ে, শুধু এক অনুচ্ছেদ করে নয়, ছন্দ, শব্দভান্ডার এবং গঠন যাচাইয়ের জন্য যে পরীক্ষা চালানো উচিত, তা কভার করে।

ছন্দ কেবল একটি classifier যা পড়ে তারই অংশ। why AI text gets flagged-এর আরও পূর্ণ বিবরণ বাকি সবকিছু কভার করে, এবং Turnitin's own method আলাদাভাবে বর্ণনা করা হয়েছে, যাঁদের সময়সীমা সেই নির্দিষ্ট system-এর মধ্য দিয়ে যায় তাঁদের জন্য।

পাঠককে ক্লান্ত করে এমন একই সমতলতা, যান্ত্রিকভাবে, detector যখন কোনো document জুড়ে কম variation রিপোর্ট করে তখন সেটি যে বিষয় মাপে তারও বেশির ভাগ, এই site-এর pillar guide to how AI detectors actually work তা নিজস্ব পরিভাষায় কভার করে। যেভাবেই হোক, পাঠকই আগে সেখানে পৌঁছে যায়। এটি statistic হয়ে ওঠার আগে ছন্দ সবসময়ই পাঠকের সমস্যা ছিল।

XLinkedInFacebook

সচরাচর জিজ্ঞাসিত প্রশ্ন

একাডেমিক লেখায় বাক্যের দৈর্ঘ্য কীভাবে বদলাতে হয়, তা মূলত একটি ধারা চতুর্থবার পুনরাবৃত্তি করার আগে সেটি লক্ষ করার মধ্যে নিহিত: একটি অনুচ্ছেদ জোরে পড়ুন, একই মাপের তিনটি বা তার বেশি বাক্যের ধারাবাহিকতা চিহ্নিত করুন, তারপর একটি বাক্য ভেঙে দিন, দুটি ছোট বাক্য একত্র করুন, অথবা একটি দীর্ঘ বাক্যকে তার স্বাভাবিক বিরতিতে কেটে দিন। লক্ষ্য হিসেবে শব্দ গোনা সাধারণত কোনো ধারাকে ইচ্ছাকৃতভাবে ভাঙার মতো কার্যকর হয় না।

Moe

PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.