AI Humanizer जो उद्धरणों को सुरक्षित रखता है (APA, MLA, IEEE)
एक rewriter जो (Smith, 2020, p. 44) को साधारण गद्य मानता है, उसे विकृत कर देगा। यहाँ बताया गया है कि जब किसी अनुच्छेद को humanized किया जाता है, तब APA, MLA और IEEE उद्धरणों में वास्तव में क्या टूटता है, और एक citation-safe pass को अलग क्या करना पड़ता है।
एक citation-safe पुनर्लेखन (Smith, 2020, p. 44) को ठीक उसी रूप में छोड़ देता है जैसा वह टाइप किया गया था: कॉमा, पृष्ठ संक्षेप, कोष्ठक, और सब कुछ। एक सामान्य पुनर्लेखन उसी स्ट्रिंग को सुधारने योग्य शब्दों की एक शृंखला मानता है, और वह अक्सर इसे (Smith 2020, page 44) के रूप में लौटा देता है, या इसे वाक्य में इस तरह मिला देता है, 'according to Smith's 2020 study on page 44.' यही अंतर उस पूरी समस्या का मूल है जिसे citations को सुरक्षित रखते हुए काम करने वाले AI humanizer को हल करना होता है, और यह अधिकांश academic writing सलाह की तुलना में अधिक संकीर्ण, अधिक यांत्रिक समस्या है।
एक citation ऐसा वाक्य नहीं है जिसे कोई model सुधार सके। यह एक वाक्य के भीतर रखा हुआ एक स्वरूपित स्ट्रिंग है, एक लेखक का उपनाम, एक वर्ष, कभी-कभी एक पृष्ठ संख्या, जो एक style के सटीक विराम-चिह्न नियमों के अनुसार व्यवस्थित होते हैं। एक सामान्य-उद्देश्य पुनर्लेखन model के पास ऐसा कोई संकेत नहीं होता जो उसे बताए कि वे तत्व एक स्थिर इकाई हैं, न कि साधारण शब्द जिन्हें वह स्वतंत्र रूप से हिला, पुनर्व्यवस्थित या किसी पर्याय से बदल सकता है। पूरे अनुच्छेद के साथ अकेला छोड़ दिए जाने पर, वह उस वाक्य के बीच विश्वसनीय रूप से अंतर नहीं कर पाएगा जिसे उसे सुधारना चाहिए और उस citation के बीच जिसे उसे अपरिवर्तित छोड़ना चाहिए।
खंड दर खंड AI score कम करना, abstract, literature review, methodology और discussion के across, एक व्यापक प्रश्न है जिसका अपना उत्तर कहीं और है। यह लेख इसके नीचे की यांत्रिक परत पर केंद्रित रहता है: जब कोई rewrite किसी citation को छूती है, तब वास्तव में क्या होता है, और किसी tool को एक citation को अकेला छोड़ने के लिए अलग तरह से क्या करना पड़ता है।
जब कोई rewriter किसी citation को गद्य के रूप में मानता है, तब क्या बिगड़ता है
जब किसी अनुच्छेद को एक सतत गद्य-खंड मानकर उसे सहज बनाया जाता है, तब पाँच स्थान पूर्वानुमेय तरीकों से बिगड़ते हैं।
- पाठ के भीतर के पृष्ठ संख्याएँ खिसक जाती हैं या गायब हो जाती हैं: (Smith, 2020, p. 44) में पृष्ठ सूचक पूरी तरह हट जाता है, या संख्या बनी रहती है जबकि संक्षेप उस रूप में बदल जाता है जिसे लक्ष्य शैली उपयोग नहीं करती।
- Et al. की स्ट्रिंग में पूर्ण विराम जुड़ जाता है या हट जाता है: सही रूप में केवल al के बाद एक पूर्ण विराम होता है, क्योंकि et अपने आप में एक पूर्ण लैटिन शब्द है, और पुनर्लेखन चरण अक्सर et के बाद भी दूसरा पूर्ण विराम जोड़ देता है।
- कोष्ठकीय उद्धरण कथात्मक गद्य में समा जाते हैं: (Jones, 2021) 'Jones द्वारा 2021 का एक अध्ययन' बन जाता है, जो उद्धरण को एक अध्ययन के बारे में पुनर्परिभाषित दावे में बदल देता है, न कि उस उद्धरण में जिसे पाठक संदर्भ सूची से मिलान करने की अपेक्षा करता है।
- संख्यात्मक IEEE कोष्ठक अपनी स्थिति बदल लेते हैं या पुनः क्रमांकित हो जाते हैं: किसी विशिष्ट संदर्भ-सूची प्रविष्टि से जुड़ा एक कोष्ठक स्थानांतरित हो जाता है, या पुनर्लिखित वाक्य दो कोष्ठकबद्ध स्रोतों का क्रम बदल देता है, जिससे कोष्ठक और उस प्रविष्टि के बीच का संबंध टूट जाता है जिसकी ओर वह संकेत करने वाला है।
- संदर्भ-सूची प्रविष्टियाँ वाक्यों की तरह समतल कर दी जाती हैं: किसी पत्रिका के शीर्षक की इटैलिक शैली हट जाती है, DOI छोटा कर दिया जाता है, या प्रारंभिक अक्षरों से शुरू होने वाली IEEE लेखक-सूची को पूरे प्रथम नामों में विस्तारित कर दिया जाता है, क्योंकि वह सामान्य गद्य की तरह अधिक पढ़ा जाता है।
यह सब केवल बाहरी सजावट का मामला नहीं है। किसी पृष्ठ संख्या को उद्धरण से मिलाने वाला जाँचकर्ता, किसी IEEE कोष्ठक को उसके संदर्भ से सत्यापित करने वाला समीक्षक, या किसी अनुपस्थित DOI के लिए संदर्भ सूची को देखने वाला सहलेखक, इन सभी में से हर एक को पाएगा, और इनमें से प्रत्येक एक 5-मिनट का सुधार है जिसकी पहली जगह पर आवश्यकता ही नहीं होनी चाहिए थी।
| उद्धरण तत्व | एक सामान्य पुनर्लेखन इसका क्या करता है | एक उद्धरण-सुरक्षित प्रक्रिया इसके बजाय क्या करती है |
|---|---|---|
| APA कोष्ठकीय, उदाहरण के लिए (Smith, 2020, p. 44) | पृष्ठ संख्या हटा देती है, या अल्पविराम के पैटर्न को ऐसे रूप में बदल देती है जिसका संदर्भ में उपयोग नहीं होता | पूरी स्ट्रिंग को एक इकाई के रूप में पहचानती है और अल्पविराम, ampersand तथा पृष्ठ रूप को ठीक उसी तरह छोड़ देती है जैसा लिखा है |
| MLA लेखक-पृष्ठ, उदाहरण के लिए (Chen 517) | एक वर्ष या ऐसा अल्पविराम जोड़ देती है जिसका MLA पाठ में कभी उपयोग नहीं करता | पहचानती है कि MLA पाठ में कोई वर्ष नहीं रखता और दो-शब्दीय रूप को ज्यों का त्यों छोड़ देती है |
| IEEE कोष्ठक, उदाहरण के लिए [3] | जब वाक्य का पुनर्गठन होता है, तो कोष्ठक की पुनःसंख्या करती है या उसका क्रम बदल देती है | अंक को स्थिर रखती है और केवल उसके आसपास के शब्दों का संपादन करती है |
| Et al. स्ट्रिंग | et के बाद एक अनावश्यक पूर्ण विराम जोड़ देती है, या al के बाद आवश्यक पूर्ण विराम हटा देती है | et al. को एक स्थिर दो-शब्दीय इकाई के रूप में मानती है, न कि दो सामान्य शब्दों के रूप में |
| संदर्भ-सूची प्रविष्टि | शीर्षक को फिर से शब्दबद्ध करती है, जर्नल के नाम को छोटा करती है, या इटैलिक हटाती है | हर संदर्भ प्रविष्टि को अपरिवर्तित छोड़ देती है, केवल चलती हुई गद्य का संपादन किया जाता है |
उद्धरणों को सुरक्षित रखने वाला AI Humanizer क्या अलग तरीके से करना होता है
जो तंत्र काम करता है, वह पुनर्लेखन के बाद सुधार नहीं, बल्कि पुनर्लेखन से पहले पहचान है। एक उद्धरण-सुरक्षित प्रक्रिया को हर पाठ्य-उद्धरण, हर संदर्भ-सूची प्रविष्टि और हर ऐसी रिपोर्टिंग वाक्यांश का पता लगाना होता है जो इनमें से किसी एक को वहन करती हो, प्रत्येक को स्थिर सामग्री के रूप में चिह्नित करना होता है, फिर केवल उन चिह्नों के बाहर के शब्दों को पुनर्लेखित करना होता है। TextPulse का humanizer यह उद्धरणों को उसी तरह स्थिर करके करता है जैसे वह किसी नामित उपकरण या तकनीकी पद को स्थिर करता है, स्थिर खंड पुनर्लेखन से अपरिवर्तित होकर गुजरता है और आउटपुट में हाइलाइट किया जाता है, ताकि लेखक यह ठीक-ठीक देख सके कि क्या अकेला छोड़ा गया था, बजाय इसके कि वह उसके बारे में किसी दावे को बिना जाँचे मान ले।
इन-टेक्स्ट उद्धरणों और संदर्भ-सूची प्रविष्टियों की समस्याएँ एक-दूसरे के विपरीत हैं। इन-टेक्स्ट उद्धरण उस वाक्य के भीतर होता है जिसे कोई मॉडल सक्रिय रूप से पुनर्लेखित कर रहा होता है। इसलिए जोखिम यह है कि उद्धरण गलती से पुनर्लेखन में खिंच जाए। संदर्भ-सूची की प्रविष्टि अपने अलग खंड में होती है, और उसकी संरचना वाक्य की तुलना में डेटा अभिलेख जैसी अधिक होती है, इसलिए जोखिम दूसरी दिशा में होता है, मॉडल अपरिचित विराम-चिह्नों को त्रुटि मान लेता है, और ऐसे स्वरूपण को सुधार देता है जो कभी गलत था ही नहीं।
अपने पेपर को मानवीय बनाइए
अपने AI-सहायता प्राप्त पाठ को रूपांतरित करें और उसे मानवीय ध्वनि दें, महत्वपूर्ण शब्दों या उद्धरणों को छेड़े बिना।
APA, MLA और IEEE प्रत्येक अलग तरीके से विफल होते हैं
APA उद्धरणों में तीनों में सबसे अधिक आंतरिक विराम-चिह्न होते हैं, जिससे पुनर्लेखन के गलत होने की सबसे अधिक संभावनाएँ बनती हैं। उदाहरण के लिए, एक कोष्ठकीय उद्धरण में लेखक और वर्ष के बीच अल्पविराम होता है, (Smith, 2020). एक वर्णनात्मक उद्धरण अल्पविराम हटा देता है: Smith (2020) found. तीन या अधिक लेखकों के साथ, एक उद्धरण में et al. पहले संदर्भ से ही शामिल होना चाहिए, न कि दूसरे उल्लेख से शुरू होना चाहिए, जैसा कि कोई पुराना संस्करण या पुराना टेम्पलेट निर्देश दे सकता है। 2020 से लागू यह संस्करण अलग है। यदि आप लेखकों की संख्या सही रखने में सक्षम हैं, तब भी कोई मॉडल गलत विराम-चिह्न जोड़कर चूक सकता है। APA शैली मार्गदर्शिका यह अपेक्षा करती है कि जब लेखक कोष्ठक के भीतर सूचीबद्ध हों, तब ampersand को कोष्ठकों के भीतर रखा जाए, लेकिन जैसे ही वही नाम किसी वाक्य के भीतर आते हैं, 'and' शब्द पूरा लिखा जाए।
MLA इन-टेक्स्ट उद्धरण से वर्ष को पूरी तरह हटा देता है और पूरी संरचना को लेखक के उपनाम और पृष्ठ संख्या तक सीमित कर देता है: (Chen 517), कोई अल्पविराम नहीं, अंक से पहले कोई संक्षेप नहीं। मुख्यतः APA-आकृति वाले उदाहरणों पर प्रशिक्षित एक पुनर्लेखन चरण अक्सर दोनों को वापस जोड़ देता है, क्योंकि केवल उपनाम के बाद संख्या वाला रूप उस मॉडल को त्रुटि जैसा लगता है जिसने MLA की तुलना में कहीं अधिक APA उद्धरण देखे हैं। MLA तब भी et al. पर स्विच करता है जब किसी स्रोत में तीन या अधिक लेखक हों, Works Cited प्रविष्टि में भी और पाठ में भी, और यह कहीं भी ampersand का उपयोग नहीं करता।
IEEE वह शैली है जिसमें एक भी गलत जगह किया गया संपादन सबसे अधिक नुकसान करता है, क्योंकि इसके अंक सजावटी नहीं होते। [3] जैसा कोई ब्रैकेट संदर्भ सूची की एक विशिष्ट प्रविष्टि से जुड़ा होता है, जिसे शोधपत्र में स्रोतों के पहली बार आने के क्रम के अनुसार दिया जाता है, और उस स्रोत का हर बाद का उल्लेख अपनी अलग प्रविष्टि पाने के बजाय उसी अंक का पुनः उपयोग करता है। दो वाक्यों के क्रम को बदल देने वाला, या किसी अनुच्छेद को इस तरह पुनर्गठित करने वाला पुनर्लेखन कि कोई अलग स्रोत पहले प्रस्तुत हो जाए, उसके बाद आने वाले हर ब्रैकेट को चुपचाप असंगत कर सकता है। उसी स्रोत का किसी अलग पृष्ठ पर दोहराया गया उद्धरण ब्रैकेट के भीतर अपना अलग स्थान-सूचक रखता है, पहली बार [3, p. 517] और दूसरी बार [3, p. 522], एक ऐसी परंपरा जिसे IEEE से अपरिचित कोई मॉडल दो अलग-अलग क्रमांकित प्रविष्टियों में सरल करने की कोशिश कर सकता है।
संदर्भ सूचियों को अपनी अलग जाँच चाहिए
संदर्भ-सूची की प्रविष्टि वाक्य से अधिक एक डेटा अभिलेख के निकट होती है, लेखक सूची, वर्ष, शीर्षक, कंटेनर, स्थान-सूचक संख्याओं का एक समूह, जिनमें से प्रत्येक का अपना विराम-चिह्न नियम होता है और जिनमें से कोई भी जुड़े हुए गद्य की तरह पढ़ने के लिए नहीं होता। किसी अंश को अधिक स्वाभाविक बनाने के लिए कहा गया मॉडल उस अभिलेख को यथावत छोड़ने का कोई कारण नहीं रखता, और वह जिन सुधारों की ओर बढ़ता है वे ठीक वही होते हैं जो गलत होते हैं। किसी जर्नल नाम पर लगे इटैलिक हट जाते हैं। पूर्ण पते के रूप में लिखा गया DOI फिर से एक साधारण स्ट्रिंग में छोटा कर दिया जाता है। आरंभाक्षर पहले वाले रूप में लिखा गया IEEE लेखक-नाम, M. R. Chen, एक पूर्ण प्रथम नाम में विस्तारित हो जाता है, क्योंकि वह सामान्य गद्य जैसा अधिक पढ़ता है।
सबसे सुरक्षित नियम सरल है, संदर्भ-सूची किसी भी तरह से पुनर्लेखन का लक्ष्य नहीं है। आसपास के गद्य को संपादित करने वाला कोई भी उपकरण पूरे खंड को स्थिर सामग्री की तरह माने, उसी तरह जैसे वह वाक्य के भीतर एकल उद्धरण को स्थिर रखता है। उदाहरण के लिए, पुनःप्रस्तुति के लिए Harvard से Vancouver में किसी संदर्भ-सूची को a reference format converter के माध्यम से पुनरूपित करना एक अलग कार्य है, जिसके अपने नियम हैं, न कि ऊपर वाले अनुच्छेद को अधिक स्वाभाविक रूप से पढ़ने योग्य बनाने का कोई गौण प्रभाव।
अपने उद्धरणों के मानवीकरण के बाद भी सुरक्षित रहने की जाँच कैसे करें
तथ्य के बाद जाँच करने में अधिकांश लेखकों की अपेक्षा से कम समय लगता है, और एक छोटा अनुच्छेद किसी विशेष सॉफ़्टवेयर की बिल्कुल आवश्यकता नहीं रखता। हर in-text citation को उस संस्करण के साथ, जिससे आपने शुरुआत की थी, एक-एक करके पढ़ें, और पुष्टि करें कि लेखक, वर्ष या पृष्ठ, तथा उसके आसपास की विराम-चिह्न व्यवस्था एक जैसी है। एक लंबे खंड के लिए, एक in-text citation fixer जो ठीक इन्हीं त्रुटियों को पकड़ने के लिए बनाया गया है, अल्पविराम का स्थान, et al. की सीमाएँ, पृष्ठ-रूप, जाँचों के आकार को पंक्ति दर पंक्ति पढ़ने की तुलना में अधिक तेज़ी से देखता है, यद्यपि यह उद्धरण के गद्य-रूप पर काम करता है, न कि उन क्रमांकित कोष्ठकों पर जिन्हें IEEE उपयोग करता है।
संरक्षित उद्धरणों को फिर भी वास्तविक उद्धरण ही होना चाहिए, और hallucinated प्रविष्टियों के लिए एक ग्रंथसूची का ऑडिट करना एक अलग कार्य है, जिसका अपना पृष्ठ है। जर्नल प्रस्तुति से पहले AI स्कोर को कम करना भी वहीं शामिल है।
एक ऐसा उपकरण जो हर संपादन को सम्मिलन या विलोपन के रूप में दिखाता है, इसे खोज से एक नज़र में देखने योग्य बना देता है: जो उद्धरण कभी बदला ही नहीं, उस पर कोई चिह्न नहीं होता, इसलिए जाँच के योग्य उद्धरण वे होते हैं जो पहले से ही हाइलाइट किए गए हैं। दस पृष्ठ के शोध-पत्र पर यह पाँच मिनट का काम है, पूरा दोपहर नहीं, और यही अंतर है आत्मविश्वास के साथ जमा करने तथा पर्यवेक्षक की हाशिये की टिप्पणी से यह जानने के बीच कि Smith ने तीसरे संशोधन के आसपास कहीं एक पृष्ठ संख्या खो दी थी।
अक्सर पूछे जाने वाले प्रश्न
हाँ, यदि tool पूरे अनुच्छेद को पुनर्लेखन के लिए गद्य के एक ही span के रूप में मानता है। (Smith, 2020, p. 44) जैसा उद्धरण एक स्थिर, विराम-चिह्नित string है, सुधारने के लिए कोई वाक्य नहीं, और एक सामान्य rewrite page numbers हटा देगा, commas जोड़ या हटा देगा, या parenthetical citation को narrative sentence में मिला देगा। उद्धरणों को सुरक्षित रखने वाला AI humanizer उन spans को बाकी सब कुछ पुनर्लेखन से पहले पहचानता है और स्थिर कर देता है।
Content planner and copywriter at TextPulse. Sara runs the blog day to day, from planning and drafting through to publishing. She writes the practical guides: clear explanations of academic writing problems, aimed at the person who actually has to hand something in.