Compilatio AI Detector পর্যালোচনা: ইউরোপের প্রাতিষ্ঠানিক ডিটেক্টর
Compilatio হলো সেই ডিটেক্টর, যেটি ইউরোপীয় বিশ্ববিদ্যালয়গুলো লাইসেন্স করে, যেখানে আমেরিকান সংকলনগুলো Turnitin ধরে নেয়: ফ্রান্সে নির্মিত, 50টিরও বেশি দেশে 1,100টিরও বেশি স্কুলে ব্যবহৃত, এবং একমাত্র প্রধান প্রাতিষ্ঠানিক ডিটেক্টর, যা একজন শিক্ষার্থী নিজের কাজ জমা দেওয়ার আগে নিজেই চালাতে পারে। এটি AI পাঠ্য ধরার ক্ষেত্রে 94 to 99% নির্ভরযোগ্যতার হার এবং 1% এর কম false positives দাবি করে। এটিকে অন্তর্ভুক্ত করা একমাত্র peer-reviewed গবেষণায় এটি 14টি টুলের মধ্যে দ্বিতীয় স্থান পেয়েছিল, এবং উপসংহারে বলা হয়েছিল যে পরীক্ষিত টুলগুলো neither accurate nor reliable। এখানে প্রমাণ কী সমর্থন করে তা দেওয়া হলো।
Compilatio হলো সেই AI detector যা ইউরোপীয় বিশ্ববিদ্যালয়গুলো লাইসেন্স করে, যেমন আমেরিকান roundups Turnitin-কে ধরে নেয়। এটি ফরাসি নির্মিত, এটি বিশ বছরেরও বেশি সময় ধরে plagiarism ব্যবসায় আছে, এবং এর নিজস্ব সাইটে 50টিরও বেশি দেশে 1,100টিরও বেশি স্কুল সজ্জিত আছে বলে উল্লেখ করা হয়েছে। আপনি যদি France, Belgium, Switzerland বা Spain-এ একটি thesis লিখছেন, তবে প্রায়ই এটিই সেই software যা সেটি পড়ে।
এর accuracy claim নির্দিষ্ট: AI-generated passages শনাক্ত করতে "94 to 99% reliability rate", সঙ্গে "less than 1% false positives"। Compilatio অন্তর্ভুক্ত করা একমাত্র peer-reviewed study এটিকে চৌদ্দটি tool-এর মধ্যে দ্বিতীয় স্থানে রেখেছে, Turnitin-এর পরে, এবং উপসংহারে বলেছে যে এটি যে tool-গুলো পরীক্ষা করেছে সেগুলো "neither accurate nor reliable"।
গবেষকেরা যাকে unreliable বলে বিচার করেছেন, সেই ক্ষেত্রে দ্বিতীয় স্থান এই review-এর মূল tension। Compilatio আরেকটি কাজও করে, যা এর কোনো institutional rival করে না, এটি মূল্যায়িত হওয়া students-দের কাছেও একই detector বিক্রি করে, 4.99 euros থেকে শুরু করে।
Compilatio কী, এবং আসলে কে এটি ব্যবহার করে?
Compilatio চারটি product বিক্রি করে, document কার হাতে আছে তার ভিত্তিতে ভাগ করা। Magister হলো teacher-facing similarity checker। Magister+ এর সঙ্গে AI detection, deep rephrasing detection, multilingual and translation detection, এবং grammar checking যোগ করে। Studium হলো student version, credits-এ বিক্রি হয়। Compilatio Copyright professional writers এবং editors-দের লক্ষ্য করে, যারা publication-এর আগে কাজ পরীক্ষা করেন।

কোম্পানিটি 10 লক্ষেরও বেশি ব্যবহারকারী, 50টিরও বেশি দেশে উপস্থিতি, এবং প্রতি বছর 95% স্কুল পুনরায় সাবস্ক্রাইব করে বলে জানায়। এর সার্ভারগুলো ফ্রান্সে অবস্থিত, যা ইউরোপীয় প্রতিষ্ঠানগুলোর জন্য একটি বাস্তব বিক্রয়-যুক্তি, কারণ তারা ছাত্রদের কাজ কোনো US প্রসেসরে পাঠানোর আগে GDPR বাধ্যবাধকতা বিবেচনা করে, এবং এটাই একটি কারণ যে Compilatio ফরাসিভাষী সিস্টেমগুলোর মধ্যে যে অবস্থান ধরে রাখে, Turnitin ইংরেজিভাষী সিস্টেমগুলোর মধ্যে ঠিক সেই অবস্থান ধরে রাখে।
Compilatio নিজের নির্ভুলতা সম্পর্কে কী দাবি করে
বিক্রেতার AI detector page এ বলা হয়েছে, AI-উৎপাদিত অংশ শনাক্ত করার জন্য "94 to 99% reliability rate" এবং "less than 1% false positives", যেখানে এই পরিসরটি নথির দৈর্ঘ্য, ভাষা এবং একাডেমিক বিষয়বস্তুর ধরন অনুযায়ী পরিবর্তিত হয়। এতে বলা হয়েছে, detectorটি 35টিরও বেশি ভাষা কভার করে এবং ChatGPT থেকে GPT-5.2, GPT-5.1, GPT-5, GPT-4.5, GPT-4o এবং GPT-4o Mini পর্যন্ত, পাশাপাশি Gemini, Claude, DeepSeek এবং Copilot এর আউটপুট শনাক্ত করে। ফলাফলটি শিক্ষকের কাছে 0 থেকে 100 এর মধ্যে একটি শতাংশ হিসেবে পৌঁছে, যা অনুমান করে নথিটির কত অংশ মেশিন-উৎপাদিত ছিল।
নিজস্ব ব্লগে কোম্পানিটি এই সংখ্যাটিকে প্রেক্ষাপটে রাখে, এটি 2023 সালের detector-এর নির্ভুলতা "over 70%" বলে জানায় এবং বলে যে তখন থেকে নির্ভরযোগ্যতা "increased by more than 20%"। detector-এর ওয়েবসাইটে এটি একটি বিরল বিষয়, একটি বিক্রেতা নিজের পণ্যের আগের স্কোর প্রকাশ করছে।
দাবিত্যাগগুলোও অস্বাভাবিকভাবে সরাসরি। Compilatio বলে যে "the percentage of AI-generated content should always be interpreted with caution and complemented by human analysis", যে "AI detectors can't pretend to be 100% accurate", এবং যে "the final judgment should always rest with educators and students"। এটিকে এমন প্রতিদ্বন্দ্বীদের সঙ্গে তুলনা করুন, যারা কোনো সতর্কতা ছাড়াই 99% certainty বিজ্ঞাপন দেয়, তাহলে এটি এই শ্রেণিতে তুলনামূলকভাবে বেশি সৎ উপস্থাপন। তবু এটি বিক্রেতার পরীক্ষা, যা পণ্য বিক্রি করা কোম্পানিই চালায় এবং প্রতিবেদন করে।
স্বাধীন প্রমাণ কী দেখায়
যে গবেষণাটি গুরুত্বপূর্ণ, তা হলো Weber-Wulff এবং সহকর্মীরা International Journal for Educational Integrity-এ, যেখানে চৌদ্দটি সিস্টেম পরীক্ষা করা হয়েছিল, বারোটি সর্বসাধারণের জন্য উপলভ্য টুলের সঙ্গে বাণিজ্যিক জুটি Turnitin এবং PlagiarismCheck। নির্ভুলতার ক্ষেত্রে, প্রবন্ধটি জানায় যে "Turnitin নির্ভুলতা শ্রেণিবিন্যাসের সব পদ্ধতি ব্যবহার করে সর্বোচ্চ স্কোর পেয়েছে, তার পরে ছিল Compilatio এবং GPT-2 Output Detector"। চৌদ্দটির মধ্যে দ্বিতীয় স্থান হলো Compilatio-এর পাওয়া সেরা স্বতন্ত্র অবস্থান।
সমগ্র শ্রেণি সম্পর্কে প্রবন্ধটির সিদ্ধান্ত এই র্যাঙ্কিং যতটা শোনায়, তার চেয়ে বেশি কঠোর। এর লেখকেরা উপসংহারে বলেছেন যে "উপলভ্য শনাক্তকরণ টুলগুলো না নির্ভুল, না নির্ভরযোগ্য, এবং এগুলোর প্রধান পক্ষপাত হলো AI-generated text শনাক্ত করার বদলে আউটপুটকে human-written হিসেবে শ্রেণিবদ্ধ করা", এবং যে "বিষয়বস্তু আড়াল করার কৌশলগুলো টুলগুলোর কর্মক্ষমতাকে উল্লেখযোগ্যভাবে খারাপ করে"। যে ডিটেক্টর টেক্সটকে human-written বলে চিহ্নিত করার দিকে ঝোঁকে, সেটি false positives-এর ক্ষেত্রে চমৎকার দেখাবে এবং যে AI text ধরা উচিত তা মিস করবে, আর sub-1% false positive দাবির পেছনে থাকা trade-off এটাই।
| প্রশ্ন | Compilatio কী প্রকাশ করে | স্বতন্ত্র পরীক্ষায় কী প্রতিষ্ঠিত হয়েছে |
|---|---|---|
| AI passage-এর ক্ষেত্রে নির্ভরযোগ্যতা | 94 to 99%, বিক্রেতার নিজস্ব পরীক্ষার ভিত্তিতে | চৌদ্দটি টুলের মধ্যে দ্বিতীয় স্থানে, এমন একটি গবেষণায় যার সামগ্রিক ফল ছিল যে এই শ্রেণি নির্ভরযোগ্য নয় |
| false positives | 1% এর নিচে | Compilatio-এর জন্য কোনো স্বতন্ত্র সংখ্যা নেই; পরীক্ষিত টুলগুলো টেক্সটকে human-written বলার দিকে পক্ষপাতী ছিল |
| paraphrased বা obfuscated AI | Magister+ "deep rephrasing" শনাক্তকরণ বাজারজাত করে | পরীক্ষিত টুলগুলোর মধ্যে obfuscation "উল্লেখযোগ্যভাবে" কর্মক্ষমতা খারাপ করেছে |
| ভাষা | 35 এর বেশি | প্রতি ভাষা অনুযায়ী স্বতন্ত্রভাবে benchmark করা হয়নি |
দুটি সতর্কতা বিপরীত দিকে টানে, এবং সৎ পাঠে দুটিই অন্তর্ভুক্ত হওয়া উচিত। ওই গবেষণা 2023-যুগের মডেলের বিরুদ্ধে করা হয়েছিল, তাই এটি বর্তমান ডিটেক্টর GPT-5 আউটপুট কীভাবে সামলায়, সে সম্পর্কে কিছুই বলে না, এবং তখন থেকে Compilatio-এর নিজস্ব দাবি করা 20-পয়েন্ট উন্নতিও তাতে দেখা যাবে না। এর বিপরীতে, সবচেয়ে সাম্প্রতিক বৃহৎ প্রাতিষ্ঠানিক সরাসরি তুলনা, 2026 Vrije Universiteit Brussel গবেষণা, যেখানে Pangram, GPTZero, Copyleaks এবং Turnitin-কে 160টি দীর্ঘ একাডেমিক পেপারের মধ্য দিয়ে পরীক্ষা করা হয়েছিল, তাতে Compilatio অন্তর্ভুক্ত ছিল না। ফলে এর 94 থেকে 99% হার সম্পর্কে বর্তমান বাহ্যিক নিশ্চিতকরণ কোনো দিক থেকেই নেই।
আপনার নিজস্ব পেপারকে মানবসদৃশ করুন
আপনার AI-সহায়তাপ্রাপ্ত লেখাকে রূপান্তর করুন এবং গুরুত্বপূর্ণ শব্দ বা উদ্ধৃতি স্পর্শ না করে সেটিকে মানবসদৃশ শোনান।
পুনর্লিখন-সংক্রান্ত দাবি হলো সবচেয়ে আকর্ষণীয়টি
বেশিরভাগ ডিটেক্টর একটি সংখ্যা বিক্রি করে। Magister+ একাধিক সংখ্যা বিক্রি করে, এবং অতিরিক্তগুলো সরাসরি এড়িয়ে যাওয়ার কৌশলকে লক্ষ্য করে। এটি "deep rephrasing-এর detection" বিজ্ঞাপন দেয়, যাকে এটি semantic plagiarism হিসেবে ব্যাখ্যা করে, এবং এর সঙ্গে "multilingual similarities/translations-এর detection"ও দেয়, যা এক ভাষায় খসড়া তৈরি করে পরে অন্য ভাষায় অনুবাদ করে লেখা কাজের জন্য। এটি "unrecognised language" অংশগুলোর "percentage and location"ও জানায়, যা হলো নথির ভেতরে অক্ষর লুকিয়ে এমন কৌশল, যাতে খালি চোখে লেখা পড়া না যায়।
এই বৈশিষ্ট্যসমষ্টি সরাসরি লক্ষ্য করে সেই দুইটি সবচেয়ে সাধারণ উপায়কে, যেগুলো দিয়ে শিক্ষার্থীরা similarity check এড়াতে চেষ্টা করে, একটি উৎসকে paraphrase করা এবং একটি অনুবাদ করা। এটি দাবি করা হারে কাজ করে কি না, সেটিই ঠিক সেই বিষয় যা স্বাধীনভাবে পরীক্ষা করা হয়নি, এবং Weber-Wulff-এর এই অনুসন্ধান যে obfuscation detection-কে উল্লেখযোগ্যভাবে খারাপ করে, তা এই নির্দিষ্ট বৈশিষ্ট্যের নয়, বরং সেই যুগের টুলগুলোর ক্ষেত্রে প্রযোজ্য। যাই হোক, বোঝার মতো বিষয় হলো paraphrasing এবং AI detection পৃথক সমস্যা, যা whether Turnitin detects paraphrased text-এ আলোচিত হয়েছে, এবং classifier আসলে যে সংকেতগুলো পড়ে, সেগুলো how AI detectors work-এ ব্যাখ্যা করা হয়েছে। একটি খসড়ার নিজস্ব বাক্যবৈচিত্র্যকে free burstiness checker দিয়ে পরীক্ষা করলে বোঝা যায়, একটি vendor-এর শিরোনাম-সংখ্যার চেয়ে ডিটেক্টর কীসে প্রতিক্রিয়া জানায়।
মূল্য নির্ধারণ ও প্রবেশাধিকার, Turnitin যে অংশটি দেয় না সেটিও অন্তর্ভুক্ত
Studium বিশ্লেষণ ক্রেডিট হিসেবে বিক্রি হয়, প্রতি 250 শব্দে 1 ক্রেডিট, যা 6 মাসের জন্য বৈধ এবং একাধিক নথিতে ব্যবহারযোগ্য। প্যাকগুলো হলো, 5,000 শব্দের জন্য 4.99 ইউরোতে 20 ক্রেডিট, 20,000 শব্দের জন্য 12.99 ইউরোতে 80 ক্রেডিট, 40,000 শব্দের জন্য 19.99 ইউরোতে 160 ক্রেডিট, এবং 100,000 শব্দের জন্য 34.99 ইউরোতে 400 ক্রেডিট। প্রথম আংশিক বিশ্লেষণ বিনামূল্যে, যেখানে শীর্ষ তিনটি মিলে যাওয়া উৎসের পূর্বরূপ দেখা যায়। যেসব শিক্ষার্থীর প্রতিষ্ঠান ইতিমধ্যে সাবস্ক্রাইব করেছে, তারা বছরে 40টি বিনামূল্যের ক্রেডিট পায়, প্রায় 10,000 শব্দের সমান।
Magister এবং Magister+ এর কোনো প্রকাশ্য মূল্য নেই। প্রতিষ্ঠানগুলো কোটেশন চায়, যা বাজারের এই অর্ধাংশে স্বাভাবিক।
প্রবেশাধিকার বিন্দুটি মূল্যের চেয়েও বেশি গুরুত্বপূর্ণ। Turnitin দ্বারা মূল্যায়িত একজন শিক্ষার্থী নিজের খসড়ায় আগে Turnitin চালাতে পারে না, এবং Copyleaks দ্বারা LMS-এর মাধ্যমে মূল্যায়িত একজন শিক্ষার্থী সাধারণত যে স্কোর থেকে পূর্ণ প্রতিবেদনটি এসেছে, তা দেখতে পারে না। Compilatio প্রতিষ্ঠানে থাকা একজন শিক্ষার্থী এক কাপ কফির দামে একই AI পরীক্ষা কিনতে পারে এবং কিছু জমা দেওয়ার আগে ফলাফল পড়তে পারে। এই পর্যালোচনায় এটিই সবচেয়ে ব্যবহারিকভাবে উপযোগী তথ্য।
ডিটেক্টর পরিসরে Compilatio কোথায় অবস্থান করে
Compilatio হলো বিশ্বাসযোগ্য ইউরোপীয় প্রাতিষ্ঠানিক বিকল্প, এবং এটি তার অধিকাংশ প্রতিদ্বন্দ্বীর তুলনায় বেশি সতর্কভাবে নিজেকে উপস্থাপন করে, একটি একক সংখ্যার বদলে একটি পরিসর, কী কী ব্যবহার করে স্কোর নির্ধারণ করেছে তার প্রকাশিত বিবরণ, এবং স্পষ্ট নির্দেশনা যে শতাংশটি কোনো চূড়ান্ত রায় নয়। এগুলো এর পক্ষে ইতিবাচক দিক।
প্রমাণভিত্তি এখনো স্থাপনার পরিসরের তুলনায় পাতলা। একটি peer-reviewed অবস্থান, 14টির মধ্যে 2য়, 2023 মডেলের বিরুদ্ধে, এমন একটি গবেষণায় যা পুরো শ্রেণিটিকেই অবিশ্বস্ত বলে গণ্য করেছে, এ সম্পর্কিত স্বাধীনভাবে প্রতিষ্ঠিত সবকিছু এটুকুই। 94 থেকে 99% সংখ্যাটি বিক্রেতার নিজস্ব, এবং Magister+ কে স্বতন্ত্র করে এমন পুনর্লিখন ও অনুবাদ শনাক্তকরণের কোনো বাইরের পরীক্ষা একেবারেই নেই। এর কোনোটিই টুলটিকে খারাপ করে না। এটি Compilatio শতাংশকে কোনো কিছুর প্রমাণ না হয়ে আরও ঘনিষ্ঠভাবে দেখার একটি কারণ করে তোলে, আর তাদের নিজস্ব নথিতেও সেটাই বলা আছে।
ন্যায্যতার প্রশ্নটি এখানে যেমন প্রযোজ্য, তেমনি এই শ্রেণির সর্বত্রও প্রযোজ্য, এবং এটি দ্বিতীয় ভাষায় লেখা শিক্ষার্থীদের ওপর সবচেয়ে বেশি আঘাত করে, একটি ধারা যা why AI detectors are biased against non-native English writers-এ নথিভুক্ত করা হয়েছে। যদি আপনার নিজের লেখা কাজে একটি স্কোর আপনার বিরুদ্ধে ব্যবহার করা হয়, তবে ব্যবহারিক প্রতিক্রিয়া how to prove you didn't use AI-এ বর্ণিত আছে, এবং বিস্তৃত নির্ভুলতার চিত্র are AI detectors accurate-এ রয়েছে।
সম্পূর্ণ তুলনা
Compilatio হল এমন দশটি ডিটেক্টরের একটি, যেগুলোর মুখোমুখি একজন শিক্ষার্থী, গবেষক বা মূল্যায়নকারী হওয়ার সম্ভাবনা থাকে, এবং এই পর্যালোচনায় যে ধারা পাওয়া গেছে, সামনে আত্মবিশ্বাসী বিক্রেতার পরিসংখ্যান এবং পেছনে দুর্বল স্বাধীন নথি, তা এদের সবার ক্ষেত্রেই পুনরাবৃত্ত হয়। Turnitin, GPTZero, Copyleaks, Pangram, Originality.ai এবং বাকি সবার সঙ্গে এটি একই প্রমাণ-প্রথম মানদণ্ডে কীভাবে তুলনীয়, তা দেখতে পূর্ণ AI detectors compared নির্দেশিকা দেখুন।
সচরাচর জিজ্ঞাসিত প্রশ্ন
Compilatio নিজস্ব পরীক্ষার ভিত্তিতে AI-generated অনুচ্ছেদ শনাক্তকরণে 94 to 99% নির্ভরযোগ্যতার হার এবং 1% এর কম false positives দাবি করে, এবং বলে যে এই পরিসরটি নথির দৈর্ঘ্য, ভাষা এবং বিষয়বস্তুর ধরনের সঙ্গে পরিবর্তিত হয়। স্বাধীনভাবে, এটিকে অন্তর্ভুক্ত করা একমাত্র peer-reviewed গবেষণা, Weber-Wulff এবং সহকর্মীরা International Journal for Educational Integrity-এ, এটিকে 14টির মধ্যে দ্বিতীয় স্থান দেয়, Turnitin-এর পরে, যদিও উপসংহারে বলা হয় যে পরীক্ষিত টুলগুলো neither accurate nor reliable এবং মানব-লিখিত পাঠ্য হিসেবে শ্রেণিবদ্ধ করার দিকে ঝুঁকেছিল। সেই গবেষণায় 2023-era মডেল ব্যবহার করা হয়েছিল, এবং Compilatio-এর কোনো বর্তমান স্বাধীন পরীক্ষা প্রকাশিত হয়নি।
PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.