AI Detection

Đánh giá Scribbr AI Detector: Điểm 78% thực sự có nghĩa gì

Trình kiểm tra AI miễn phí của Scribbr đưa ra các con số tốt nhất trong nhóm miễn phí: độ chính xác 78%, đồng hạng nhất, trong so sánh được Scribbr công bố của chính mình, còn tầng cao cấp đạt 84%. Điểm đáng chú ý là từ "chính mình": bài kiểm tra được thiết kế, thực hiện và chấm bởi nhà cung cấp, và công cụ miễn phí đứng đầu còn lại thuộc cùng công ty mẹ. Sau đây là cơ sở của các con số đó, những gì tầng cao cấp bổ sung, và vì sao một lần kiểm tra trước bằng Scribbr không thể dự báo kết quả Turnitin.

7 min
Scribbr AI Detector Review: What a 78% Score Actually Means

Trình phát hiện AI của Scribbr có các con số tiêu đề tốt nhất trong gói miễn phí: độ chính xác 78 phần trăm cho trình kiểm tra miễn phí và 84 phần trăm cho phiên bản cao cấp. Cả hai con số đều là thật, đã được công bố và còn hiệu lực. Cả hai cũng xuất phát từ một bài kiểm tra do chính Scribbr thiết kế, thực hiện và chấm điểm, và chính một तथ्य đó nên định hình mức độ tin cậy mà bạn dành cho chúng trước khi dán một chương vào ô nhập.

Scribbr không phải là một startup phát hiện ngẫu nhiên. Công ty bắt đầu vào năm 2012 như một dịch vụ chỉnh sửa luận văn, và trình tạo trích dẫn cùng các hướng dẫn APA đã khiến nó trở thành một cái tên quen thuộc với sinh viên nhiều năm trước khi việc phát hiện AI tồn tại. Chính uy tín đó là lý do vì sao trình kiểm tra AI của nó thường là công cụ đầu tiên mà sinh viên thử, và vì sao điểm số của nó nhận được sự tin cậy gần như tự động hơn một con số từ một trang web không quen thuộc. Câu hỏi hữu ích hẹp hơn câu hỏi "Scribbr có tốt không": 78 phần trăm đó thực sự dựa trên điều gì, và một lần kiểm tra trước bằng Scribbr có dự đoán được những gì Turnitin sẽ hiển thị cho giảng viên của bạn sau này không? Câu trả lời lần lượt là "một chuẩn đánh giá nhỏ do chính công ty thực hiện" và "không", và cả hai đều đáng để hiểu chi tiết.

Trình phát hiện AI của Scribbr là gì, và ai thực sự sử dụng nó

Trình phát hiện AI miễn phí của Scribbr chạy trên trình duyệt mà không cần tài khoản. Trang sản phẩm của Scribbr quảng cáo các lượt kiểm tra không giới hạn với tối đa 1,200 từ cho mỗi lần nộp, hỗ trợ tiếng Anh, tiếng Tây Ban Nha, tiếng Đức và tiếng Pháp, cùng một phân loại ba hướng gắn nhãn các đoạn văn là do con người viết, được AI chỉnh sửa, hoặc do AI tạo ra, kèm phản hồi ở cấp độ đoạn văn. Bài viết so sánh của chính Scribbr lại liệt kê giới hạn miễn phí là 500 từ cho mỗi lần kiểm tra, đây là một trong số ít nơi mà các trang của công ty hiện đang không thống nhất với nhau.

Câu hỏi thường gặp của sản phẩm thẳng thắn một cách hiếm thấy về giới hạn của gói miễn phí. Phần này nêu rằng trình phát hiện miễn phí bắt được các văn bản được viết bằng GPT-2, GPT-3 và GPT-3.5 "với độ chính xác trung bình", trong khi khả năng phát hiện độ chính xác cao, bao gồm cả GPT-4, được dành cho phiên bản cao cấp. Cách phân loại đó rất quan trọng, vì phần lớn văn bản mà bất kỳ ai kiểm tra vào năm 2026 đều đến từ các mô hình mới hơn GPT-3.5. Người dùng chính của công cụ miễn phí là sinh viên thực hiện một lần kiểm tra trước khi nộp bài luận.

Scribbr free AI detector scoring an academic paragraph 100% AI-generated, with the QuillBot engine version visible in the result panel
Giao diện kết quả mà bài đánh giá này đề cập đến: một phán quyết 100% AI đối với một đoạn văn học thuật, với thẻ công cụ QuillBot hiển thị trong bảng.

Scribbr tuyên bố gì: 78 phần trăm miễn phí, 84 phần trăm cao cấp

Con số 78 phần trăm xuất phát từ so sánh do chính Scribbr thực hiện đối với 12 công cụ phát hiện AI, được công bố vào tháng 4 năm 2026 và sửa đổi vào tháng 7 năm 2026. Về mặt tích cực, phương pháp được công bố chi tiết: 30 văn bản thử nghiệm thuộc sáu nhóm, hoàn toàn do con người viết, GPT-3.5, GPT-4, hỗn hợp giữa con người và AI, cùng hai bộ được diễn đạt lại, mỗi văn bản dài 1.000 đến 1.500 ký tự, được chấm điểm có tính đến phần điểm cho các trường hợp gần đúng. Trong thử nghiệm đó, công cụ phát hiện cao cấp của Scribbr dẫn đầu với 84 phần trăm, và công cụ phát hiện miễn phí của Scribbr ngang bằng với công cụ phát hiện miễn phí của QuillBot ở mức 78 phần trăm, với không ghi nhận dương tính giả nào cho cả ba.

Cùng bài viết đó còn có phần chữ nhỏ ít đáng trích dẫn hơn. Công cụ cao cấp, công cụ có kết quả tốt nhất trong thử nghiệm, vẫn chỉ phát hiện được 60 phần trăm văn bản AI đã được trộn với văn bản do con người viết hoặc đã qua công cụ diễn đạt lại, tức là loại văn bản mà các bài nộp thực tế thường chứa nhất. Và phần FAQ trên trang sản phẩm của Scribbr vẫn chưa theo kịp chính so sánh của họ, khi vẫn nói với người truy cập rằng "độ chính xác cao nhất mà chúng tôi tìm thấy là 84% ở một công cụ cao cấp hoặc 68% ở công cụ miễn phí tốt nhất", đồng thời thừa nhận rằng "không có mô hình AI nào trên thị trường có thể bảo đảm độ chính xác 100%, kể cả của chúng tôi".

Vấn đề của bài kiểm tra do chính bên bán tự thực hiện

Tất cả những điều trên đều là một chuẩn so sánh do nhà cung cấp tự đặt ra. Scribbr tự chọn văn bản, tự xác định các mức chấm điểm, tự chạy quét và tự chấm sản phẩm của mình, rồi công bố một bảng xếp hạng trong đó sản phẩm của chính họ đứng đầu. Điều đó không làm cho các con số trở thành sai, và phương pháp được công bố còn minh bạch hơn đa số những gì ngành này làm được. Nhưng điều đó khiến đây là một bài kiểm tra do chính bên bán tự thực hiện, và nó nên được đọc theo cách bạn đọc các số liệu nội bộ của bất kỳ công ty nào, tức là một tuyên bố cần được kiểm chứng, chứ không phải một kết quả đã được người khác kiểm chứng.

Hai chi tiết làm cho cảnh báo này rõ hơn. Thứ nhất, mẫu rất nhỏ: tổng cộng 30 văn bản, chỉ có năm văn bản hoàn toàn do con người viết, vì vậy đường ranh giới không có dương tính giả dựa trên năm tài liệu. Thứ hai, hai công cụ miễn phí đứng đầu trong bảng xếp hạng của Scribbr là các sản phẩm cùng công ty mẹ. Trang giới thiệu của Scribbr nêu rằng công ty là "a part of QuillBot, within the broader Learneo family of businesses," cùng với LanguageTool, và trang sản phẩm của chính bộ phát hiện này còn khuyến nghị trình kiểm tra AI của QuillBot như một lựa chọn bổ sung. Việc "đồng hạng nhất" ở tầng miễn phí đã xảy ra trong cùng một gia đình doanh nghiệp, trong một bài kiểm tra do chính gia đình đó công bố.

Bằng chứng độc lập còn mỏng, chủ yếu vì các bộ đánh giá chuẩn được bình duyệt hiếm khi bao gồm Scribbr. Bài kiểm tra học thuật được trích dẫn nhiều nhất về loại công cụ này, một nghiên cứu liên trường năm 2023 của Weber-Wulff và các cộng sự, bao quát 14 hệ thống phát hiện bao gồm Turnitin, kết luận rằng các công cụ được thử nghiệm "neither accurate nor reliable," cho thấy một thiên lệch có hệ thống theo hướng gán văn bản là do con người viết, và mất đáng kể độ chính xác ngay khi văn bản bị chỉnh sửa hoặc diễn đạt lại. Scribbr không nằm trong số các công cụ được thử nghiệm, điều này có hai mặt: nó tránh được điểm kém trong nghiên cứu đó, nhưng đồng thời cũng có nghĩa là những con số đã công bố mạnh nhất về bộ phát hiện của Scribbr vẫn là những con số do chính Scribbr tạo ra về bản thân mình. Đó cũng chính là khoảng cách giữa các tuyên bố của nhà cung cấp và bằng chứng độc lập xuyên suốt toàn bộ nhóm sản phẩm này.

Nhân hóa bài viết của bạn

Biến đổi văn bản có hỗ trợ AI của bạn và làm cho nó nghe tự nhiên như do con người viết, mà không chạm vào các từ quan trọng hoặc trích dẫn.

Bắt đầu miễn phí

Dương tính giả, và ai bị tổn hại

Trong thử nghiệm riêng của Scribbr, cả năm văn bản do con người viết đều không bị gắn cờ, ở cả công cụ miễn phí lẫn công cụ cao cấp. Năm văn bản không thể xác lập tỷ lệ dương tính giả, ở mức tốt nhất, kết quả chỉ phù hợp với một tỷ lệ thấp. Phát hiện của nghiên cứu Weber-Wulff rằng các bộ phát hiện có xu hướng gọi văn bản là do con người viết cho thấy nhóm này thường sai theo hướng bỏ sót AI hơn là buộc tội con người, nhưng những lời buộc tội mới là các sai sót có thể khiến một người phải ra điều trần, và chúng không phân bố đồng đều. Văn xuôi học thuật theo khuôn mẫu và văn bản của những người viết bằng ngôn ngữ thứ hai nhận một tỷ lệ cờ cao không tương xứng trên các bộ phát hiện, một mô hình được trình bày chi tiết trong trang của chúng tôi về vì sao các bộ phát hiện AI thiên lệch chống lại người không phải người bản ngữ. Một lần kiểm tra sơ bộ bằng Scribbr cho kết quả 0 phần trăm chỉ là sự trấn an, không phải bằng chứng: đó là ước tính của một nhà cung cấp, từ một công cụ mà cơ sở của bạn không sử dụng, và nó không chứng minh gì về điều mà một bộ phân loại khác sẽ kết luận.

Giá cả và thực tế truy cập

Công cụ kiểm tra miễn phí thực sự miễn phí: có quảng cáo, không cần đăng ký, chạy không giới hạn. Bộ phát hiện AI cao cấp không được bán riêng. Bài viết so sánh của Scribbr mô tả nó như một tiện ích bổ sung cho dịch vụ kiểm tra đạo văn cao cấp, có giá từ $19.95 đến $39.95 tùy theo kích thước tài liệu, với không giới hạn số từ khi tải lên.

Việc gộp chung này che khuất một khác biệt đáng biết. Hai sản phẩm là các hệ thống riêng biệt. Câu hỏi thường gặp của Scribbr nêu rằng phần kiểm tra đạo văn của họ sử dụng "công nghệ tương tự với phần mềm được hầu hết các trường đại học và nhà xuất bản sử dụng", trong khi "bộ phát hiện AI bổ sung được vận hành bởi phần mềm độc quyền của Scribbr." Một điểm số tương đồng và một điểm số AI xuất hiện trong cùng một báo cáo đến từ các cơ chế không liên quan, và sự tin cậy vào một bên không nói gì về bên còn lại.

Vì sao điểm số Scribbr của bạn sẽ không khớp với Turnitin's

Cách phổ biến nhất mà sinh viên sử dụng công cụ này là như một buổi thử trước Turnitin, và đó lại là cách mà nó hỗ trợ ít nhất. Mỗi bộ phát hiện AI là một bộ phân loại được huấn luyện bởi một nhóm khác nhau, trên một tập ngữ liệu khác nhau, với các ngưỡng quyết định khác nhau và mức chấp nhận dương tính giả khác nhau. Sự khác biệt về hiệu chỉnh có nghĩa là cùng một bài luận có thể đạt 2 percent trên một công cụ và 60 percent trên một công cụ khác mà không công cụ nào bị trục trặc, và nghiên cứu của Weber-Wulff đã ghi nhận chính xác kiểu bất đồng này giữa các hệ thống. Mô hình của Turnitin, vốn hoạt động khác và chỉ các cơ sở giáo dục mới có thể nhìn thấy, đã được tinh chỉnh theo những ưu tiên mà nhóm của Scribbr không có khả năng quan sát, và các lỗi của nó theo một mô thức riêng, được phân tích riêng trong phần phân tích của chúng tôi về tỷ lệ dương tính giả của Turnitin. Một điểm số thấp của Scribbr vào đêm trước hạn nộp là một dữ liệu về Scribbr, không phải là một dự báo về Turnitin.

Kết luận, và so sánh đầy đủ

Công cụ kiểm tra AI miễn phí của Scribbr là một trong những công cụ được tài liệu hóa tốt hơn trong gói miễn phí, từ một công ty có thành tích học thuật thực sự, và phương pháp luận được công bố của nó minh bạch hơn những gì đa số đối thủ cung cấp. Tuy nhiên, độ chính xác được nêu bật của nó vẫn là một điểm số tự chấm trong một bài kiểm tra nội bộ với 30 văn bản, trong đó công ty chị em của nó đứng ở vị trí cao nhất còn lại, gói miễn phí của nó theo chính lời nhà cung cấp là yếu hơn rõ rệt đối với các mô hình hiện tại, và đầu ra của nó không thể được hiệu chỉnh đối chiếu với công cụ cấp cơ sở giáo dục vốn sẽ thực sự đánh giá bài làm của bạn. Hãy dùng nó như một tín hiệu sớm tương đối trên bản nháp, và xem bất kỳ tỷ lệ phần trăm đơn lẻ nào, từ bất kỳ bộ phát hiện nào, là một ước lượng chứ không phải là một phán quyết. Để xem các con số của Scribbr so sánh ra sao với GPTZero, ZeroGPT, Copyleaks, và phần còn lại của lĩnh vực dưới cùng một lăng kính nhất quán, hãy bắt đầu với so sánh đầy đủ các bộ phát hiện AI của chúng tôi.

XLinkedInFacebook

Câu hỏi thường gặp

Trong so sánh được Scribbr công bố của chính mình, được sửa đổi vào tháng 7 năm 2026, trình kiểm tra miễn phí xác định đúng 78 phần trăm trong số 30 văn bản thử nghiệm, còn phiên bản cao cấp đạt 84 phần trăm, là các điểm số cao nhất trong bài kiểm tra đó. Cả hai con số đều đến từ một chuẩn đánh giá do Scribbr tự thiết kế, tự thực hiện và tự chấm, vì vậy đó là các tuyên bố của nhà cung cấp chứ không phải kết quả độc lập. Chưa có chuẩn đánh giá máy phát hiện nào được bình duyệt quy mô lớn đưa Scribbr vào, và phần FAQ của công ty cũng nêu rằng không có mô hình AI nào có thể bảo đảm độ chính xác 100 phần trăm.

Moe

PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.

Cập nhật về AI humanization

Nhận mẹo về viết học thuật, phát hiện AI và humanization được gửi thẳng vào hộp thư của bạn.

Không spam. Có thể hủy đăng ký bất cứ lúc nào.