AI Detection

Turnitin Similarity Score กับ AI Score: รายงานสองแบบที่ต่างกัน

คะแนนความคล้ายคลึงและคะแนน AI ตอบคำถามคนละแบบ ดังนั้นบทความหนึ่งอาจได้คะแนนต่ำในค่าใดค่าหนึ่งและสูงในอีกค่าหนึ่ง โดยที่ตัวเลขทั้งสองไม่ได้ผิดพลาด สิ่งที่แต่ละค่าวัด สิ่งที่กระตุ้นค่า และสิ่งที่คะแนนสูงพิสูจน์ได้และพิสูจน์ไม่ได้

อัปเดตล่าสุดเมื่อ 5 min
Turnitin similarity vs AI score comparison chart showing two independent report numbers

รายงานฉบับหนึ่งปรากฏพร้อมตัวเลขสองค่า คือคะแนนความคล้ายคลึง 3 เปอร์เซ็นต์ และคะแนน AI 88 เปอร์เซ็นต์ ความเข้าใจตามธรรมชาติคือ ทั้งสองค่านี้ต้องกำลังวัดสิ่งเดียวกัน ดังนั้นตัวเลขที่ต่ำจึงน่าจะหมายความว่าตัวเลขที่สูงก็น่าจะผิดเช่นกัน แต่ไม่ได้เป็นเช่นนั้น Turnitin similarity vs AI score เป็นการเปรียบเทียบระหว่างสองระบบที่แยกจากกัน ซึ่งตรวจสอบคนละสิ่ง และงานที่ส่งสามารถได้คะแนนต่ำในระบบหนึ่งและสูงในอีกระบบหนึ่งได้ โดยที่ตัวเลขใดตัวเลขหนึ่งไม่ได้เป็นความผิดพลาด

ระบบนี้เก่ากว่าระบบ AI ถูกสร้างขึ้นเพื่อตรวจจับข้อความที่ตรงกับสิ่งที่มีอยู่แล้ว ระบบ AI ใหม่กว่า ถูกเพิ่มเข้าไปใน Similarity Report เดียวกันในฐานะการวัดที่เป็นอิสระของตนเอง ถูกสร้างขึ้นเพื่อประเมินว่าร้อยแก้วอ่านดูเหมือนสร้างโดยเครื่องหรือไม่ โดยไม่คำนึงว่ามันจะตรงกับสิ่งใดเลยหรือไม่ ทั้งสองระบบเป็นอิสระต่อกันโดยสิ้นเชิง และไม่ส่งผลต่อกัน ตามที่ระบุไว้ใน เอกสารประกอบของ Turnitin เอง ส่วนที่เหลือทั้งหมดในบทความนี้

Turnitin similarity report showing 12% overall similarity, with match groups of 115 not cited or quoted at 9% and 41 missing quotations at 3%, top sources across internet, publications and student papers, and zero integrity flags
Similarity Report ตอบคำถามหนึ่งข้อ, คือข้อความนี้ตรงกับสิ่งใดที่มีอยู่แล้วในฐานข้อมูลของ Turnitin มากเพียงใด ที่นี่คือ 12%, แบ่งออกเป็นกลุ่มการตรงกันและแหล่งที่มา โดยไม่มีการตั้งค่าสัญญาณด้านความซื่อสัตย์ทางวิชาการ
ภาพรวมการเขียนด้วย AI ของ Turnitin แสดง 71% ถูกตรวจพบว่าเป็น AI ประกอบด้วย 18 ส่วนที่ถูกทำเครื่องหมายว่าเป็น AI-generated only ที่ 71% และศูนย์ส่วนที่ถูกทำเครื่องหมายว่าเป็น AI-paraphrased พร้อมคำเตือนว่าผู้ประเมินควรเข้าใจข้อจำกัดของการตรวจจับ AI
รายงานการเขียนด้วย AI เป็นเอกสารแยกต่างหากที่มีหมายเลขของตนเอง เอกสารฉบับเดียวกันระบุว่า 71% ถูกตรวจพบว่าเป็น AI แบ่งเป็นข้อความที่เป็น AI-generated only และ AI-paraphrased พร้อมคำเตือนของ Turnitin เองเกี่ยวกับข้อจำกัดของการตรวจจับพิมพ์อยู่ควบคู่กันไป

Similarity ของ Turnitin เทียบกับ AI Score, ตัวเลขแต่ละค่าแสดงอะไร

Turnitin ถือว่าทั้งสองเป็นการวัดที่แตกต่างกันซึ่งถูกรวมไว้ในผลิตภัณฑ์เดียว มากกว่าจะเป็นสองมุมมองของผลลัพธ์เดียวกัน Similarity Report เปรียบเทียบงานที่ส่งกับฐานข้อมูลของเนื้อหาเว็บ สิ่งพิมพ์ทางวิชาการ และงานของนักศึกษาที่ส่งมาก่อนหน้า แล้วส่งกลับเป็นร้อยละของข้อความในงานที่ตรงกับบางสิ่งที่มีอยู่แล้วในฐานข้อมูลนั้น การตรวจจับการเขียนด้วย AI ใช้แบบจำลองอีกชุดหนึ่งโดยสิ้นเชิง ซึ่งถูกเพิ่มเข้าไปในรายงานเดียวกันนั้นในฐานะคะแนนอิสระของตนเอง แบบจำลองนี้ได้รับการฝึกเพื่อประเมินว่าร้อยแก้วของข้อความช่วงหนึ่งมีลักษณะคล้ายงานเขียนที่สร้างโดยเครื่องมากเพียงใด โดยไม่อ้างอิงฐานข้อมูลภายนอกใด ๆ เลย กลไกที่ละเอียดกว่าของ วิธีที่ตัวจำแนก AI ของ Turnitin ไปถึงตัวเลขนั้น ได้อธิบายแยกไว้แล้ว สิ่งสำคัญในที่นี้คือมันตอบคำถามคนละข้อกับเครื่องมือ similarity ที่อยู่ภายในรายงานเดียวกัน

Similarity Score วัดอะไรจริง ๆ

Similarity คือการจับคู่ ไม่ใช่การตัดสิน คำแนะนำของ Turnitin เองระบุชัดเจนว่าเครื่องมือนี้ไม่ได้ตรวจการคัดลอกผลงาน มันตรวจการซ้อนทับของข้อความ และปล่อยให้ผู้สอนที่อ่านรายงานเป็นผู้ตีความ การอ้างคำพูดที่จัดวางอย่างถูกต้อง วลีในส่วนวิธีวิจัยที่ใช้ร่วมกันทั่วทั้งสาขาย่อยหนึ่ง รายการอ้างอิงที่จัดรูปแบบเหมือนกับที่บทความทุกชิ้นในวารสารนั้นจัดรูปแบบรายการอ้างอิงของตน ทั้งหมดนี้อาจถูกบันทึกเป็นการจับคู่ได้ เพราะระบบนับสตริงของข้อความที่ซ้อนทับกัน มากกว่าจะตัดสินว่าการซ้อนทับนั้นชอบด้วยเหตุผลหรือไม่

นั่นก็เป็นเหตุผลด้วยว่าทำไมคะแนนความคล้ายคลึงเท่ากับศูนย์จึงพิสูจน์ได้น้อยกว่าที่ดูเหมือน มันหมายความว่างานที่ส่งไม่มีช่วงข้อความยาวต่อเนื่องที่พบในแหล่งข้อมูลที่จัดทำดัชนีของ Turnitin ที่อื่นเลย มันไม่ได้บอกอะไรเกี่ยวกับวิธีที่ประโยคที่มีอยู่ถูกสร้างขึ้น เพราะการสร้างประโยคที่ไม่ตรงกับสิ่งใดในฐานข้อมูลไม่ใช่ทักษะเดียวกับการสร้างประโยคที่แบบจำลองภาษาไม่น่าจะคาดการณ์ได้

ทำให้บทความของคุณเป็นธรรมชาติมากขึ้น

ปรับข้อความที่ช่วยโดย AI ของคุณให้ฟังดูเป็นธรรมชาติ, โดยไม่แตะต้องคำสำคัญหรือการอ้างอิง

เริ่มต้นฟรี

คะแนน AI วัดอะไรจริง ๆ

คะแนน AI ไม่มีฐานข้อมูลให้ตรวจสอบเทียบ เครื่องมือจำแนกอ่านข้อความร้อยแก้วที่ส่งมา และประเมินจากรูปแบบที่มันเรียนรู้จากตัวอย่างงานเขียนของมนุษย์และงานเขียนที่สร้างโดย AI ว่าข้อความร้อยแก้วนั้นมีแนวโน้มมาจากแบบจำลองมากกว่ามนุษย์เพียงใด ไม่มีสิ่งใดในค่าประเมินนั้นขึ้นอยู่กับว่าประโยคที่ตรงตัวเคยปรากฏที่ใดมาก่อนหรือไม่ ประโยคหนึ่งอาจมีลักษณะเฉพาะทั้งหมด ไม่เคยมีใครพิมพ์มาก่อนจนถึงงานที่ส่งฉบับนี้ และยังคงอ่านได้ว่าเป็นผลลัพธ์ของ AI ตามสถิติ หากการเลือกคำและจังหวะของมันเป็นไปตามรูปแบบที่แบบจำลองภาษามักสร้างขึ้น

นี่คือพื้นที่ทางสถิติเดียวกันกับที่อธิบายไว้อย่างครบถ้วนในภาพรวมที่กว้างกว่าเกี่ยวกับ วิธีที่เครื่องตรวจจับ AI ทำงานจริง, คือความสามารถในการคาดเดาในระดับคำและจังหวะในระดับประโยค รวมเข้าเป็นคะแนนของเอกสารหนึ่งฉบับ Turnitin ในรูปแบบของเครื่องมือจำแนกนี้เป็นกรรมสิทธิ์เฉพาะ แต่สมมติฐานพื้นฐาน, คือข้อความที่สร้างขึ้นมักมีลักษณะตามสถิติที่เป็นแบบฉบับมากกว่างานเขียนของมนุษย์, เป็นสมมติฐานเดียวกันที่อยู่เบื้องหลังเครื่องมือทุกชนิดในหมวดนี้

คะแนนความคล้ายคลึงคะแนน AI
สิ่งที่วัดสัดส่วนของข้อความที่ส่งซึ่งตรงกับเอกสารอื่นที่ถูกจัดทำดัชนีไว้มากเพียงใดร้อยแก้วมีลักษณะคล้ายกับงานเขียนที่ AI สร้างขึ้นตามรูปแบบทางสถิติทั่วไปมากเพียงใด
สิ่งที่ทำให้ตัวเลขสูงคำอ้างอิงยาว, ถ้อยคำเฉพาะสาขาที่ใช้กันทั่วไป, เนื้อหาที่นำกลับมาใช้ซ้ำ, หรือการตรงกับงานที่ส่งก่อนหน้าจังหวะประโยคที่สม่ำเสมอและการเลือกคำที่คาดเดาได้อย่างต่อเนื่องตลอดทั้งเอกสาร
สิ่งที่ตัวเลขสูงไม่ได้พิสูจน์ว่าข้อความที่ตรงกันนั้นถูกนำมาใช้อย่างไม่เหมาะสม เนื้อหาที่อ้างอิงอย่างถูกต้องก็ยังอาจถูกนับเป็นการตรงกันได้ว่าประโยคใดประโยคหนึ่งถูกสร้างโดย AI เอกสารตรวจรูปแบบโดยรวมของเอกสาร ไม่ได้พิจารณาเพียงบรรทัดเดียวโดยแยกจากบริบท

บทความหนึ่งชิ้นจะมีความคล้ายคลึง 0 Percent และคะแนน AI 90 Percent ได้หรือไม่?

ได้ และการที่ทั้งสองคะแนนปรากฏร่วมกันไม่ใช่ความผิดปกติ คะแนนทั้งสองตอบคำถามคนละแบบ ดังนั้นการจับคู่ของค่าที่สูงและต่ำทั้งสี่แบบจึงเป็นไปได้ และแต่ละแบบบ่งชี้สิ่งที่แตกต่างกันเกี่ยวกับวิธีที่ข้อความถูกสร้างขึ้น

  • ความคล้ายคลึงต่ำ, คะแนน AI ต่ำ: งานเขียนต้นฉบับทั่วไปที่อ่านแล้วมีความแปรผันแบบมนุษย์ตามปกติด้วย กรณีที่พบได้บ่อยสำหรับงานของนักศึกษาที่เป็นของแท้ส่วนใหญ่
  • ความคล้ายคลึงต่ำ, คะแนน AI สูง: ประโยคต้นฉบับที่ไม่ได้คัดลอกจากที่ใด แต่มีลักษณะอ่านได้อย่างคาดเดาได้ในเชิงสถิติในแบบที่ข้อความที่สร้างขึ้นมักเป็น ลักษณะเฉพาะของงานเขียน AI ที่ไม่ได้แก้ไข ซึ่งไม่มีใครนำมาถอดความจากแหล่งที่มีอยู่เดิม
  • ความคล้ายคลึงสูง, คะแนน AI ต่ำ: ข้อความที่ตรงกับแหล่งที่เขียนโดยมนุษย์ที่มีอยู่เดิมอย่างใกล้ชิด โดยไม่มีความแบนราบทางสถิติที่ตัวจำแนกเชื่อมโยงกับการสร้างข้อความ ข้อความที่คัดลอกมา ซึ่งถูกจับได้ด้วยเครื่องมือเก่ามากกว่าเครื่องมือใหม่
  • ความคล้ายคลึงสูง, คะแนน AI สูง: ข้อความที่ตรงกับแหล่งที่มีอยู่เดิมซึ่งตัวแหล่งนั้นเองก็ถูกสร้างโดย AI เช่น บทความที่เขียนโดย AI ซึ่งเคยส่งมาก่อน หรือหน้าข้อความที่ AI สร้างซึ่งถูกจัดทำดัชนีไว้แล้วจากเว็บสาธารณะ

ไม่มีการผสมผสานใดเหล่านี้ที่ต้องการสิ่งผิดปกติในฝั่งซอฟต์แวร์ พวกมันเกิดขึ้นจากข้อเท็จจริงที่ว่าระบบหนึ่งตรวจหาการตรงกัน และอีกระบบหนึ่งตรวจหารูปแบบ และข้อความชิ้นหนึ่งสามารถมีคุณสมบัติอย่างใดอย่างหนึ่ง ทั้งสองอย่าง หรือไม่มีก็ได้

สิ่งที่คะแนน AI สูงพิสูจน์ได้ และพิสูจน์ไม่ได้

คะแนน AI ที่สูงเป็นการประมาณเชิงสถิติ ไม่ใช่คำรับสารภาพที่ดึงออกมาจากข้อความ มันบอกว่าร้อยแก้วที่อยู่ตรงหน้าตัวจำแนกมีลักษณะคล้าย ในด้านการเลือกคำและจังหวะ กับงานเขียนประเภทที่โมเดลได้รับการฝึกให้เชื่อมโยงกับการสร้างโดย AI มันไม่ได้ระบุว่าประโยคใดประโยคหนึ่งเป็นงานเขียนของเครื่องอย่างแน่นอน และมันไม่รู้อะไรเกี่ยวกับวิธีที่เอกสารถูกผลิตขึ้นจริง รู้เพียงว่ามันอ่านอย่างไรเมื่อเสร็จสมบูรณ์ TextPulse มีจุดยืนเดียวกันเกี่ยวกับตัวเลขของตนเอง สิ่งที่รายงานคือ Human Score ที่ประมาณจากข้อความที่อยู่ตรงหน้า ไม่ใช่ข้อวินิจฉัยว่าเครื่องมือใด หากมี ได้แตะต้องเอกสารนั้น

การตอบสนองเชิงปฏิบัติต่อทั้งสองตัวเลข ไม่ว่าจะเป็นคะแนนความคล้ายคลึงที่ต่ำหรือคะแนน AI ที่สูง คือเหมือนกัน, ให้ถือว่าเป็นเหตุผลให้ตรวจดูใกล้ขึ้น ไม่ใช่ข้อค้นพบที่ต้องยอมรับหรือปฏิเสธทันที ร่าง บันทึก และประวัติการแก้ไขบอกได้ว่าเอกสารถูกเขียนขึ้นจริงอย่างไรในแบบที่เปอร์เซ็นต์ไม่อาจบอกได้ ไม่ว่าจะเป็นรายงานใดก็ตาม ผู้ที่อยากรู้ว่าตัวจำแนกกำลังตอบสนองต่ออะไรในร่างของตนเอง สามารถเห็นรูปแบบระดับคำเดียวกันนั้นได้ด้วยตนเองผ่าน free perplexity checker ก่อนที่จะมีการสร้างรายงานใด ๆ

free tools collection ของ TextPulse ครอบคลุมชั้นเชิงสถิติอื่น ๆ ที่ควรตรวจสอบก่อนที่ร่างจะถูกส่งไปถึงผู้สอน ไม่ใช่เพียงสองรายการที่เปรียบเทียบกันที่นี่

เมื่อแยกตัวเลขทั้งสองออกจากกันแล้ว คำถามถัดไปคือ คะแนน Turnitin เท่าใดจึงถือว่าดี สำหรับตัวตรวจจับอีกตัวที่นักศึกษาพบเห็นบ่อยที่สุด GPTZero ทำงานอย่างไร ได้อธิบายไว้ในหน้าเฉพาะของมัน

ตัวเลขทั้งสองจะยังคงอยู่ติดกันในรายงานฉบับเดียวกัน และจะยังคงถูกอ่านเป็นตัวเลขเดียวโดยผู้ที่รีบเร่ง การรู้ว่าแต่ละตัวกำลังตอบคำถามใดอยู่จริง คือสิ่งที่เปลี่ยนคู่เปอร์เซ็นต์ที่ชวนสับสนให้กลายเป็นข้อมูลที่เป็นประโยชน์สองส่วนแยกจากกัน

XLinkedInFacebook

คำถามที่พบบ่อย

Turnitin similarity vs AI score ขึ้นอยู่กับว่าค่าใดตรวจสอบอะไร คะแนนความคล้ายคลึงรายงานว่ามีส่วนใดของงานที่ตรงกับข้อความซึ่งมีอยู่แล้วในฐานข้อมูลของ Turnitin ที่ประกอบด้วยหน้าเว็บ สิ่งพิมพ์ และงานของนักศึกษาที่ส่งมาก่อนหน้า คะแนน AI เป็นการวัดแยกต่างหากและเป็นอิสระ ซึ่งประเมินว่าร้อยแก้วอ่านคล้ายข้อความที่สร้างโดยเครื่องมากเพียงใด โดยไม่อ้างอิงฐานข้อมูลใดเลย เอกสารของ Turnitin ระบุเองว่าตัวเลขทั้งสองไม่ส่งผลต่อกัน

Moe

PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.

ติดตามข่าวสารเกี่ยวกับการทำให้ AI เป็นธรรมชาติมากขึ้น

รับเคล็ดลับเกี่ยวกับการเขียนเชิงวิชาการ การตรวจจับ AI และการทำให้ข้อความเป็นธรรมชาติ ส่งตรงถึงกล่องจดหมายของคุณ

ไม่มีสแปม ยกเลิกการสมัครได้ทุกเมื่อ