Đánh giá Copyleaks AI Detector: Bộ phát hiện được tích hợp trong LMS của bạn
Copyleaks là bộ phát hiện AI mà nhiều sinh viên gặp phải mà không tự chọn, được gói kèm kiểm tra đạo văn trong Canvas, Moodle và Blackboard. Nhà cung cấp quảng cáo độ chính xác trên 99 phần trăm và tỷ lệ dương tính giả .03 phần trăm. Trong nghiên cứu của Vrije Universiteit Brussel tháng 6 năm 2026, nó đã không gắn nhãn đầy đủ cho dù chỉ một trong 40 bài hoàn toàn do AI tạo ra. Đây là những gì bằng chứng thực sự cho thấy.
Hầu hết sinh viên không bao giờ tự chọn Copyleaks. Công cụ này được cài sẵn, được tích hợp vào hộp nộp bài bởi một cơ sở giáo dục đã ký hợp đồng từ nhiều năm trước, và lần đầu tiên nhiều người viết nghe đến tên nó là khi một tỷ lệ phần trăm xuất hiện bên cạnh bài nộp của họ. Vì vậy, câu hỏi quan trọng không phải là Copyleaks có phổ biến hay không. Câu hỏi là liệu bộ phát hiện mà trường đại học của bạn gắn vào hệ thống quản lý học tập có đủ chính xác để gánh vác trọng lượng mà các cơ sở đặt lên nó hay không.
Câu trả lời của nhà cung cấp rất dứt khoát, trang sản phẩm của họ quảng cáo độ chính xác trên 99 phần trăm và tỷ lệ dương tính giả thấp nhất ngành là .03 phần trăm. Bài kiểm tra học thuật độc lập nghiêm ngặt nhất được công bố cho đến nay lại trả lời khác. Trong một nghiên cứu được bình duyệt từ Vrije Universiteit Brussel, công bố vào tháng 6 năm 2026, Copyleaks đã không gắn cờ đầy đủ một bài nào trong số 40 bài báo học thuật hoàn toàn do AI tạo ra.
Cả hai phát biểu đó đều đúng cùng lúc, và khoảng cách giữa chúng chính là điều bài đánh giá này bàn đến, Copyleaks là gì, công ty tuyên bố điều gì, kiểm tra độc lập thực sự đã phát hiện gì, và một điểm số từ công cụ này có thể, hoặc không thể, chứng minh điều gì.
Copyleaks là gì, và ai thực sự sử dụng nó?
Copyleaks khởi đầu là một công cụ kiểm tra đạo văn và bổ sung phát hiện AI khi các mô hình sinh sinh xuất hiện, và đó chính là lý do các cơ sở giáo dục thích nó, một lần nộp bài tạo ra một báo cáo tổng hợp duy nhất bao gồm cả các đối sánh đạo văn lẫn nội dung AI bị nghi ngờ. Trang web của chính công ty liệt kê các tích hợp gốc cho Canvas, D2L, Moodle, Blackboard, Schoology, Edsby, và Sakai, bao phủ phần lớn thị trường LMS mà một sinh viên có khả năng đang sử dụng. Công ty cũng tuyên bố hỗ trợ hơn 30 ngôn ngữ và phát hiện đầu ra từ GPT-5, GPT-4, Claude, Gemini, DeepSeek, Llama, và các hệ thống khác.
Mô hình triển khai đó là факт quan trọng nhất về Copyleaks. Cùng với Turnitin và GPTZero, đây là một trong số ít bộ phát hiện AI mà các cơ sở thực sự triển khai ở quy mô lớn, điều đó có nghĩa là những người bị chấm điểm bởi nó hiếm khi là những người đã chọn nó, và hiếm khi là những người có thể xem toàn bộ báo cáo.

Copyleaks Tự Khẳng Định Gì Về Độ Chính Xác Của Chính Mình?
Tiêu đề trên trang công cụ phát hiện AI của công ty ghi rằng "99% accuracy backed by independent third-party studies", và ở phía dưới cùng trang đó, tuyên bố được nhấn mạnh thành "over 99% accuracy and an industry-low .03% false positive rate." Trang này công bố các số liệu theo từng ngôn ngữ cho mô hình mới nhất của mình, nêu tiếng Anh đạt 99.97 percent trên văn bản do con người viết và 99.20 percent trên văn bản do AI viết, còn tiếng Pháp, tiếng Đức, tiếng Ý, tiếng Bồ Đào Nha và tiếng Tây Ban Nha đều trên 93 percent. Trang cũng nói rằng công cụ duy trì "low false-positive rates for non-native English text," và dẫn một nghiên cứu trên arXiv của các nhà nghiên cứu Cornell Tech, nghiên cứu này gọi Copyleaks là bộ phát hiện chính xác nhất trong số các công cụ được thử nghiệm.
Hãy đọc kỹ những tuyên bố đó. Các con số theo từng ngôn ngữ đến từ phương pháp thử nghiệm của chính nhà cung cấp, và các nghiên cứu bên thứ ba mà họ trích dẫn là những nghiên cứu họ đã chọn. Điều đó không làm cho các con số trở thành sai, nhưng nó khiến chúng mang tính tiếp thị cho đến khi một bên ngoài tái tạo được chúng trên loại tài liệu mà các trường đại học thực sự phải phân xử. Về mặt cơ chế, Copyleaks mô tả một mô hình được huấn luyện trên văn bản do con người viết, mô hình này gắn cờ các sai lệch so với các mẫu của con người, cùng họ tín hiệu thống kê mà phần giải thích của TextPulse về cách các công cụ phát hiện AI hoạt động đề cập cho toàn bộ nhóm công cụ này.
Bằng Chứng Độc Lập Cho Thấy Điều Gì?
Bài kiểm tra độc lập mạnh nhất cho đến nay là nghiên cứu của Vrije Universiteit Brussel được công bố trên International Journal for Educational Integrity vào tháng 6 năm 2026. Các nhà nghiên cứu xây dựng một tập hợp gồm 160 bài báo học thuật dài, mỗi bài trên 4,000 từ, được chia đều thành bốn nhóm: hoàn toàn do con người viết bởi các nghiên cứu sinh không phải người bản ngữ tiếng Anh, hoàn toàn do AI tạo ra, lai, và do AI tạo ra rồi cố ý được nhân hóa. Họ đưa cả 160 bài qua bốn bộ phát hiện của các cơ sở: Pangram, GPTZero, Copyleaks, và Turnitin.
Copyleaks loại bỏ sạch cả 40 bài do con người viết, một kết quả thực sự tốt. Mọi thứ còn lại đều diễn ra tệ. Với 40 bài hoàn toàn do AI tạo ra, nó không phân loại bài nào là hoàn toàn do AI viết, chỉ gắn cờ 10 trong số 40 bài là ít nhất một phần, và tỷ lệ AI trung vị mà nó báo cáo vẫn dưới 20 phần trăm trên các tài liệu được tạo ra 100 phần trăm bởi máy. Trên các bài AI đã được nhân hóa, nó phát hiện 22.5 phần trăm. Pangram, công cụ có kết quả tốt nhất trong nghiên cứu, gắn cờ 97.5 phần trăm bộ bài hoàn toàn do AI tạo ra và 92.5 phần trăm bộ bài đã được nhân hóa trên cùng các tài liệu đó.
| Bộ bài (40 bài mỗi nhóm) | Copyleaks | Turnitin | Pangram |
|---|---|---|---|
| Hoàn toàn do con người viết | 100% được loại bỏ đúng | 100% được loại bỏ đúng | 100% được loại bỏ đúng |
| Hoàn toàn do AI tạo ra | 25% bị gắn cờ ít nhất một phần, 0% hoàn toàn | 0% bị gắn cờ | 97.5% bị gắn cờ, 65% hoàn toàn |
| AI đã được nhân hóa | 22.5% được xác định | 50% được xác định | 92.5% được xác định |
Kết luận của các tác giả rất thẳng thắn: trong bốn công cụ được nghiên cứu, "ở thời điểm này chỉ có một công cụ cho kết quả thỏa đáng", và đó không phải là Copyleaks. Đối với văn bản học thuật dài từ các mô hình hiện tại, tức những tài liệu mà các cơ sở quan tâm nhất, dạng thất bại chủ yếu của Copyleaks trong thử nghiệm này là bỏ sót văn bản AI, chứ không phải buộc tội nhầm con người.
Còn về các dương tính giả, và ai bị tổn hại?
Dương tính giả làm hỏng uy tín của một nhà cung cấp. Dương tính giả phá hỏng cả một học kỳ của sinh viên, vì vậy tuyên bố .03 percent xứng đáng được xem xét riêng. Trong cuộc điều tra năm 2024 của Bloomberg Businessweek, các phóng viên đã đưa 500 bài luận nộp đơn vào Texas A&M, tất cả đều được viết vào mùa hè năm 2022, trước khi ChatGPT tồn tại, qua Copyleaks và GPTZero. Hai dịch vụ này đã gắn nhãn sai cho 1 đến 2 percent trong số đó, trong một số trường hợp với mức chắc chắn được nêu gần 100 percent. 1 đến 2 percent nghe có vẻ nhỏ cho đến khi nhân nó với khối lượng bài nộp của một trường đại học, và con số này cao gấp 30 đến 60 lần tỷ lệ mà Copyleaks quảng cáo.
Bức tranh về tính công bằng thực sự là pha trộn. Trong nghiên cứu của VUB, 40 bài viết do con người viết mà Copyleaks loại bỏ đều do những người không phải người bản ngữ tiếng Anh viết, đây là bằng chứng thực sự có lợi cho nhà cung cấp trên mẫu đó. Nhưng tài liệu học thuật được bình duyệt rộng hơn đã nhiều lần cho thấy các bộ phát hiện hoạt động sai trên đúng nhóm này, một khuôn mẫu được trình bày sâu trong trang của TextPulse về vì sao các bộ phát hiện AI thiên lệch chống lại người nói không phải bản ngữ, và báo cáo của Bloomberg đã khắc họa những sinh viên có hồ sơ bị tổn hại bởi các điểm số mà họ không thể xem hoặc phản biện. Nếu điều đó xảy ra với bạn, cách xử lý thực tiễn đã được ghi lại riêng: cách chứng minh bạn không dùng AI.
Nhân hóa bài viết của bạn
Biến đổi văn bản có hỗ trợ AI của bạn và làm cho nó nghe tự nhiên như do con người viết, mà không chạm vào các từ quan trọng hoặc trích dẫn.
Giá cả và khả năng tiếp cận, đối với những người không tự chọn nó
Các trang riêng của nhà cung cấp nêu rõ mức giá cho từng cá nhân: quyền quét miễn phí tối đa 25,000 ký tự, gói Personal ở mức 16.99 dollars mỗi tháng, 13.99 nếu thanh toán theo năm, kèm giới hạn tín dụng, gói Pro ở mức 99.99 dollars mỗi tháng, và các hợp đồng Education và Enterprise có giá tùy chỉnh, được bán thông qua đội ngũ kinh doanh của họ. Sinh viên hầu như không bao giờ trả bất kỳ khoản nào trong số này. Cơ sở giáo dục mua giấy phép, giảng viên xem báo cáo, và người viết bị chấm điểm thường không thấy gì cả trừ khi ai đó chia sẻ cho họ. Sự bất đối xứng đó, chứ không phải giá niêm yết, mới là thực tế về khả năng tiếp cận đáng quan tâm.
Copyleaks nằm ở đâu trong bức tranh các bộ phát hiện
Điểm mạnh thực sự của Copyleaks là ở vận hành: một báo cáo gộp phát hiện đạo văn và phát hiện AI, phạm vi hỗ trợ LMS rộng nhất trong nhóm, và số ngôn ngữ được hỗ trợ nhiều hơn hầu hết các đối thủ. Với tư cách là một sản phẩm quy trình làm việc cho doanh nghiệp, nó có độ tin cậy. Với tư cách là một công cụ đo lường, cơ sở bằng chứng công khai của nó mỏng hơn dấu chân triển khai của nó. Trong nghiên cứu đối đầu trực tiếp được bình duyệt duy nhất trên các tài liệu học thuật dài, nó kém công cụ tốt nhất trong lớp với khoảng cách rất lớn, và ngay cả Turnitin, vốn có phương pháp phát hiện hoạt động khác, cũng phát hiện được nhiều hơn trong bộ đã được nhân hóa. Một tỷ lệ phần trăm của Copyleaks, dù cao hay thấp, chỉ là ước tính của một mô hình trong những điều kiện mà nhà cung cấp của nó kiểm soát việc báo cáo. Đó là lý do để xem xét kỹ hơn, chứ không bao giờ là một phán quyết tự thân.
So sánh đầy đủ
Copyleaks là một bên tham gia trong một lĩnh vực đông đúc, và khuôn mẫu mà bài đánh giá này nhận thấy, sự chắc chắn của nhà cung cấp ở phía trước, bằng chứng độc lập mỏng hơn ở phía sau, lặp lại xuyên suốt. Để xem nó so sánh với Turnitin, GPTZero, Pangram, ZeroGPT, và các công cụ còn lại theo cùng một tiêu chuẩn ưu tiên bằng chứng, hãy xem hướng dẫn đầy đủ so sánh các công cụ phát hiện AI.
Nghiên cứu của chính chúng tôi cho thấy gì
Trong nghiên cứu về mức đồng thuận giữa các công cụ phát hiện của TextPulse Research, chín công cụ phát hiện AI thương mại đã chấm cùng 90 văn bản học thuật. Một trong số đó là văn bản lai 455 từ: phần mở và kết do con người viết, kẹp giữa là đoạn 168 từ do AI tạo. Copyleaks chấm văn bản này 0% AI, trong khi phán quyết của các công cụ khác trên cùng những từ đó trải từ 0% đến 95.7% AI. Toàn văn bài báo, kho ngữ liệu và ma trận điểm từng công cụ được mở tại TextPulse Research.

Câu hỏi thường gặp
Trang sản phẩm của nhà cung cấp tuyên bố độ chính xác trên 99 phần trăm và tỷ lệ dương tính giả .03 phần trăm, dựa trên phương pháp thử nghiệm của chính họ. Kết quả độc lập yếu hơn: trong một nghiên cứu được bình duyệt tháng 6 năm 2026 từ Vrije Universiteit Brussel, Copyleaks không phân loại bất kỳ bài báo học thuật nào trong số 40 bài hoàn toàn do AI tạo ra là hoàn toàn do AI viết và chỉ xác định đúng 22.5 phần trăm các bài AI đã được nhân bản hóa, trong khi loại bỏ đúng cả 40 bài do con người viết trong cùng bài kiểm tra.
PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.