AI Detection

Turnitin có phát hiện ChatGPT không? Những gì nó bắt được và những gì nó bỏ sót

Báo cáo viết bằng AI của Turnitin và báo cáo đạo văn của nó là những sản phẩm khác nhau, với đối tượng khác nhau và hồ sơ độ chính xác khác nhau. Đây là điều mà điểm AI thực sự đo lường, nơi thử nghiệm độc lập cho thấy nó thất bại, và vì sao báo cáo của bạn có thể không giống của bạn cùng phòng.

8 min
Illustration answering can Turnitin detect ChatGPT, showing the AI writing report displayed separately from the similarity report

Có, nhưng chỉ đối với một kiểu sử dụng AI cụ thể, và trong một báo cáo mà hầu hết sinh viên không bao giờ nhìn thấy. Chỉ báo viết bằng AI của Turnitin gắn cờ những đoạn văn xuôi có vẻ điển hình về mặt thống kê của một mô hình ngôn ngữ, và nó làm như vậy đối với một phần ngày càng tăng của các bài luận mà nó quét, khoảng 15 percent cho thấy 80 percent hoặc hơn là văn bản do AI tạo ra trong khoảng thời gian từ October 2025 đến February 2026, tăng từ khoảng 3 percent khi công cụ này ra mắt vào April 2023. Việc nó gắn cờ bài nộp cụ thể của bạn hay không phụ thuộc vào những chi tiết mà hầu hết các câu trả lời cho can Turnitin detect ChatGPT bỏ qua, cách báo cáo AI khác với báo cáo đạo văn, ai thực sự được hiển thị con số đó, và tần suất con số đó hóa ra là sai.

Bài viết này trình bày cơ chế của riêng sản phẩm đó, chứ không bàn về tính liêm chính học thuật nói chung. Nó nêu rõ báo cáo viết bằng AI đo lường điều gì, kiểm thử độc lập đã cho thấy nó đúng và sai ở đâu, và vì sao hai sinh viên nộp bài giống hệt nhau có thể nhận kết quả khác nhau tùy theo trường đại học mà họ theo học. Không điều gì trong số đó làm thay đổi những gì sổ tay môn học của bạn nói về việc sử dụng AI được chấp nhận. Nó thay thế một phỏng đoán về một hộp đen bằng một mô tả về những gì thực sự ở bên trong nó.

Can Turnitin Detect ChatGPT? Báo cáo thực sự hiển thị điều gì

Báo cáo viết bằng AI của Turnitin là một sản phẩm riêng biệt với báo cáo độ tương đồng, vốn kiểm tra đạo văn. Chúng chạy trên các mô hình khác nhau và được hiển thị trên các tab khác nhau trong cùng một giao diện. Điểm độ tương đồng xem xét bài nộp của bạn và so sánh nó với cơ sở dữ liệu các nguồn đã xuất bản trước đó và các bài làm của sinh viên khác để trả về phần trăm trùng khớp. Điểm AI làm một việc hoàn toàn khác, đó là một bộ phân loại đọc văn xuôi của bạn theo từng câu, gán cho mỗi câu một xác suất được tạo bởi AI, rồi gộp các điểm ở cấp câu đó thành một phần trăm của toàn bộ tài liệu. Vì chúng đo những thứ khác nhau, một bài nộp có thể có điểm độ tương đồng là 2 percent và điểm AI là 60 percent, hoặc ngược lại.

Tỷ lệ phần trăm này thực ra hẹp hơn nghe có vẻ. Đây là tỷ lệ của phần văn xuôi đủ điều kiện mà mô hình dự đoán là do AI viết, không phải toàn bộ tài liệu, vì họ loại bỏ những thứ như khối mã, gạch đầu dòng, tiêu đề và văn bản ngắn khi tính điểm. Bộ phát hiện chỉ có thể áp dụng cho các tài liệu có ít nhất 300 từ văn xuôi dài, và tính đến thời điểm viết này thì mới chỉ dành cho văn bản tiếng Anh, tiếng Tây Ban Nha và tiếng Nhật. Như có thể dự đoán, đặt cạnh cách các bộ phát hiện AI tính điểm đó nói chung, mô hình ở đây quen thuộc, một con số cấp tài liệu trông có vẻ chính xác được xây dựng từ một lát cắt hẹp hơn của văn bản so với điều mà con số tiêu đề ngụ ý.

Điều gì xuất hiện như AI: ChatGPT và các hệ thống còn lại

Turnitin nói rằng bộ phân loại của mình tìm kiếm một mẫu viết chứ không phải tên thương hiệu, và phạm vi của nó đã được mở rộng nhiều lần kể từ lần ra mắt ban đầu của GPT-3.5 và GPT-4 vào năm 2023. Hướng dẫn hiện tại nêu tên dòng GPT-5, Gemini và Claude trong số các hệ thống mà nó được huấn luyện để đối chiếu, với các bản phát hành mô hình mới được bổ sung liên tục. Điều đó bao gồm cả văn bản chưa từng chạm tới ChatGPT cụ thể. Một sinh viên dùng Gemini, Claude hoặc DeepSeek thay vào đó không thể lách bộ phát hiện chỉ bằng cách chọn một công ty khác, mô tả của chính Turnitin về mô hình nói rõ rằng nó không dựa vào nhà cung cấp nào đã tạo ra văn bản, mà chỉ dựa vào cách văn bản được đọc.

Văn bản AI được diễn đạt lại có một hạng mục riêng, chứ không được miễn trừ. Tài liệu của Turnitin tách riêng văn bản mà nó đánh giá là chỉ do AI tạo ra khỏi văn bản mà nó đánh giá là do AI tạo ra rồi được AI diễn đạt lại, và vào tháng 8 năm 2025, nó đã bổ sung khả năng phát hiện nhắm cụ thể vào các công cụ AI bypasser được xây dựng để viết lại đầu ra của máy sao cho qua mặt bộ phát hiện. Điều đó không có nghĩa là diễn đạt lại là vô ích hoặc mọi đoạn được viết lại đều bị phát hiện. Nó có nghĩa là giả định rằng việc diễn đạt lại là vô hình đối với Turnitin theo mặc định đã lỗi thời từ khá lâu.

Điểm AI của Turnitin chính xác đến mức nào?

Khẳng định về độ chính xác của Turnitin quy về một con số chính: công ty nói rằng mình duy trì tỷ lệ dương tính giả dưới 1 phần trăm đối với các tài liệu mà hơn 20 phần trăm văn bản bị gắn cờ. Công ty cũng nói rằng họ kiểm tra mỗi phiên bản mới của các mô hình của mình đối với 700,000 bài báo học thuật được viết trước khi ChatGPT tồn tại để xác minh độ chính xác này. Đây là một khẳng định cụ thể, có thể kiểm chứng, về một tập hợp hoàn cảnh nhất định. Nó đáng được đọc đúng như vậy. Turnitin đã đưa ra các khẳng định khác về độ chính xác vào năm 2023, ngay sau khi ra mắt. Giám đốc sản phẩm của công ty đã công khai thừa nhận rằng thử nghiệm trong phòng thí nghiệm không dự đoán được sẽ có bao nhiêu dương tính giả xuất hiện trong sử dụng thực tế, đặc biệt là trong các bài nộp ngắn, và nói rằng tỷ lệ dương tính giả trong thực tế cao hơn trong thử nghiệm. Ông báo cáo tỷ lệ dương tính giả ở cấp câu vào khoảng 4 phần trăm và lưu ý rằng Turnitin đã tăng độ dài tối thiểu của các bài nộp có thể được chấm từ 150 lên 300 từ như một kết quả. Mức tối thiểu hiện tại vẫn là 300 từ.

Thử nghiệm độc lập bổ sung chi tiết mà con số của nhà cung cấp không có. Trung tâm Phát triển Giảng dạy của Temple University đã tiến hành một trong những cuộc khảo sát cẩn trọng hơn hiện có, theo cùng tinh thần với thử nghiệm độc lập các công cụ phát hiện AI vốn liên tục cho thấy những khoảng cách giữa điều kiện phòng thí nghiệm và các bài nộp thực tế. Các nhà nghiên cứu đã nộp 120 mẫu viết, chia đều giữa văn bản hoàn toàn do con người viết, văn bản hoàn toàn do AI tạo ra, văn bản do AI tạo ra rồi chạy qua một công cụ diễn đạt lại, và các văn bản lai kết hợp đóng góp của con người và AI, rồi ghi lại kết quả Turnitin trả về cho từng mẫu. Công cụ này xác định đúng 93 phần trăm các mẫu hoàn toàn do con người viết và 77 phần trăm các mẫu hoàn toàn do AI tạo ra.

Ở những câu hỏi khó hơn, độ chính xác còn giảm thêm. Turnitin chỉ xác định chính xác 63 phần trăm các mẫu AI đã được diễn đạt lại là do AI tạo ra và chỉ 43 phần trăm các mẫu lai là không hoàn toàn do con người cũng không hoàn toàn do AI, đây là những nhóm gần nhất với cách mà văn bản có hỗ trợ AI thực sự được tạo ra. Đặc biệt, văn bản lai được các nhà nghiên cứu quan tâm vì họ cho rằng nó có khả năng sẽ chiếm một phần lớn, có thể là phần lớn, trong các bài nộp thực tế trong thời gian tới khi ngày càng nhiều môn học giao các nhiệm vụ yêu cầu sinh viên dùng AI cho một phần công việc.

Những gì được kiểm traKết quả của Turnitin
Các mẫu do con người viết 100%93% được xác định đúng là do con người
Các mẫu do AI tạo ra 100%77% được xác định đúng là do AI
Văn bản AI được đưa qua một công cụ diễn đạt lại63% được xác định đúng là do AI
Các mẫu lai, một phần do con người và một phần do AI43% được xác định đúng là không phải 0% cũng không phải 100%
Tài liệu có hơn 20% bị gắn cờ (con số riêng của Turnitin)Tỷ lệ dương tính giả dưới 1%

Humanize your own paper

Transform your AI-assisted text and make it sound human, without touching important words or citations.

Get started free

Nơi nó thất bại ngay cả khi con số trông có vẻ đúng

Điểm số ở cấp độ tài liệu không phải là điều duy nhất giảng viên có thể thấy, và góc nhìn còn lại thì kém tin cậy hơn. Một số giao diện cho phép giảng viên mở báo cáo gắn cờ, trong đó làm nổi bật các câu cụ thể là có khả năng do AI viết. Các nhà nghiên cứu của Temple đã đối chiếu những phần được làm nổi bật đó với các câu nào trong các mẫu lai của họ thực sự do AI viết, và không thấy mối liên hệ nào giữa hai bên. Điều này quan trọng nếu một giáo sư gửi cho bạn ảnh chụp màn hình của một đoạn văn được làm nổi bật thay vì tỷ lệ tóm tắt, vì điểm số tổng thể của tài liệu cho kết quả tốt hơn đáng kể so với các phần làm nổi bật ở cấp độ câu.

Các điểm số thấp lại được xử lý theo cách khác, và thận trọng hơn trước đây. Kể từ tháng 7 năm 2024, Turnitin đã hiển thị dấu hoa thị thay cho một con số bất cứ khi nào mô hình của nó ước tính dưới 20 percent của một tài liệu là do AI viết, vì khoảng này là nơi công cụ có khả năng sai lệch theo cả hai hướng cao nhất. Một chỉnh sửa nhẹ có hỗ trợ AI, chẳng hạn một đoạn được viết lại với sự trợ giúp và phần còn lại được viết mà không có hỗ trợ, thường sẽ không tạo ra bất kỳ phần trăm hiển thị nào, thay vì một con số nhỏ, điều này đáng lưu ý trước khi xem việc không có con số là bằng chứng cho bất cứ điều gì.

Ai Thực Sự Nhìn Thấy Con Số

Điểm AI không mặc định nằm trong báo cáo dành cho sinh viên. Nó nằm ở một tab riêng, hiển thị cho giảng viên và quản trị viên, và sinh viên chỉ nhìn thấy nó nếu giảng viên chọn chia sẻ báo cáo hoặc nêu trực tiếp. Đây là một khác biệt cấu trúc thực sự so với điểm tương đồng, vốn thường sinh viên có thể tự xem trong cùng hệ thống sau khi bài nộp đã được xử lý.

Điều tương tự cũng áp dụng cho việc tính năng này có tồn tại hay không đối với một học phần cụ thể, vì đây là một quyết định ở cấp cơ sở, vượt lên trên giảng viên. Các quản trị viên ở cấp tài khoản có thể bật hoặc tắt tính năng phát hiện AI của Turnitin cho toàn bộ cơ sở. Một giảng viên có thể không thể bật nó nếu trường đại học của họ đã tắt nó, và ngược lại. Một sinh viên từ một trường đại học nộp một bài tương tự cho một sinh viên khác từ một trường đại học khác có thể có trải nghiệm rất khác về công cụ này, vì những lý do hoàn toàn không liên quan đến những gì bất kỳ người nào trong số họ đã viết.

Tại Sao Một Số Trường Đại Học Đã Tắt Nó

University of Waterloo đã ngừng tính năng phát hiện AI của Turnitin vào tháng 9 năm 2025, và lý do được công bố của trường là đặc biệt trực tiếp. Trường viện dẫn độ không đáng tin cậy đã được ghi nhận của công cụ này, sự thiên lệch của nó đối với sinh viên có ngôn ngữ mẹ đẻ không phải là tiếng Anh, và các thử nghiệm nội bộ của chính trường, trong đó có ít nhất một trường hợp văn bản hoàn toàn do con người viết nhưng bị chấm 100 phần trăm là do AI tạo ra. Khi cân nhắc với chi phí của công cụ, trường kết luận rằng chi phí lớn hơn lợi ích và thay vào đó chuyển nỗ lực sang thiết kế lại đánh giá và đào tạo hiểu biết về AI.

Waterloo là một ví dụ có thể nhìn thấy của một sự phân hóa rộng hơn, chứ không phải là một ngoại lệ. Các trường đại học vẫn bật tính năng này thường đã bổ sung các biện pháp bảo vệ thay vì coi điểm số như một phán quyết độc lập, yêu cầu trao đổi với sinh viên trước khi bắt đầu bất kỳ quy trình chính thức nào và xem con số đó là lý do để mở cuộc trao đổi ấy chứ không phải kết thúc nó. Đọc thêm về cách các trường đại học đang xử lý chính sách AI trên phạm vi rộng hơn sẽ làm cho mô hình này rõ hơn: việc một điểm số có đến được với bạn hay không phụ thuộc vào một quyết định được đưa ra ở cấp cao hơn nhiều so với phòng seminar của bạn, chứ không phụ thuộc vào một thuộc tính cố định của chính công nghệ.

Điểm số cao chứng minh điều gì, và không chứng minh điều gì

Một điểm AI cao là bằng chứng, không phải là phán quyết. Chính Turnitin cũng trình bày tỷ lệ phần trăm này như một dữ liệu để giảng viên cân nhắc, chứ không phải là một kết luận về hành vi sai phạm, và các con số về độ chính xác ở trên giải thích vì sao cách trình bày đó quan trọng: ngay cả một điểm ở cấp độ toàn văn bản, vốn hoạt động tương đối tốt, vẫn đọc sai một phần đáng kể các bài viết đã được chỉnh sửa nhiều, diễn đạt lại hoặc mang tính lai ghép, và các phần được tô sáng ở cấp độ câu thì kém đáng tin cậy hơn rõ rệt so với con số tổng hợp. Không điều nào trong số đó bảo đảm rằng bất kỳ điểm số riêng lẻ nào cũng sai. Nó có nghĩa là một tỷ lệ phần trăm là lý do để đặt câu hỏi, chứ không phải là một kết luận để chấp nhận ngay khi nhìn thấy. Nếu bạn muốn xem bài viết của chính mình đang ở đâu trước khi ai đó chấm điểm, thì các mẫu ít biến thiên và cách diễn đạt chung chung mà một bộ phân loại phản ứng có thể được kiểm tra trực tiếp bằng một free perplexity checker.

TextPulse's công cụ nhân hóa AI cho sinh viên hoạt động trên cùng cơ sở thống kê đó, và công cụ kiểm tra burstiness miễn phí của nó cũng vậy, đối với nửa phép đo liên quan đến nhịp câu của cùng phép đo đó. Nó cung cấp cho bạn một Human Score ước tính dựa trên bản nháp của chính bạn, chứ không phải là một dự đoán về điều Turnitin sẽ nói về nó. Không công cụ nào có thể một cách có trách nhiệm hứa điều đó đối với một hệ thống mà nó không kiểm soát. Hãy xem nó như một lần đọc lại thứ hai đối với chính bài viết của bạn, không hơn.

Một số câu hỏi này có các trang riêng. Việc một giáo sư có thể nhận ra bạn đã dùng ChatGPT mà không cần bất kỳ bộ phát hiện nào, và phiên bản trực diện hơn của câu hỏi đó, liệu tôi có bị phát hiện không, được trả lời riêng. Hành vi của Turnitin đối với văn bản diễn đạt lại cũng vậy, và liệu Turnitin có phát hiện đầu ra của DeepSeek hay không cũng được xem xét cụ thể. Đối với các bối cảnh cụ thể, có các bài viết về phát hiện AI trong các chương trình điều dưỡng và về liệu văn phòng tuyển sinh đại học có thực hiện các kiểm tra này hay không. Khung nhìn rộng hơn nằm trong một bài viết riêng về tính liêm chính học thuật và AI.

Không điều nào trong số này có khả năng là phiên bản cuối cùng. Turnitin đã viết lại các ngưỡng của mình, các quy tắc hiển thị của mình và phạm vi mô hình của mình hơn một lần kể từ 2023, và August 2026 cũng sẽ không phải là lời cuối cùng. Điều giữ nguyên là thói quen đáng có, bất kể một khóa học cụ thể sử dụng bộ phát hiện nào: viết với đủ chi tiết cụ thể, không đồng đều, thực sự là của riêng bạn, để cho điều mà một bộ phân loại tình cờ nghĩ trở nên không còn quan trọng.

Frequently Asked Questions

Chỉ báo viết bằng AI của Turnitin tồn tại để trả lời đúng câu hỏi này. Turnitin có phát hiện ChatGPT không? Thường là có, khi một tài liệu chứa lượng lớn văn bản do AI tạo ra: bộ phân loại gắn cờ đoạn văn có vẻ là kiểu thống kê điển hình của một mô hình ngôn ngữ, và dữ liệu riêng của Turnitin cho thấy khoảng 15 phần trăm bài luận được quét hiện nay đạt mức được viết nặng bởi AI. Nó cũng thường xuyên bỏ sót văn bản, với thử nghiệm độc lập cho thấy độ chính xác giảm xuống 63 percent đối với văn bản AI đã được diễn đạt lại và 43 percent đối với văn bản lai.

Moe

PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.