शैक्षणिक अंग्रेज़ी में स्वाभाविक कैसे सुनें, बिना मूल-भाषी संपादक के
कृत्रिम-सा गैर-मूल-भाषी शैक्षणिक गद्य प्रायः व्याकरण की समस्या नहीं होता। यह कोलोकेशन, गलत तीव्रता वाली हेजिंग, ऐसी वाक्य-लंबाई जो कभी नहीं बदलती, और संज्ञाओं का वह काम करना है जो क्रिया का होना चाहिए। यहाँ ठोस प्रतिस्थापन और एक स्व-संपादन दिनचर्या दी गई है, जो संपादक नियुक्त किए बिना इन पाँचों को पकड़ लेती है।
एक विधि अनुभाग व्याकरण की दृष्टि से पूर्णतः सही हो सकता है, फिर भी हाशिये में "यह आपके जैसा नहीं लगता" प्राप्त कर सकता है। हर वाक्य का वाक्यविन्यास सही होता है। हर क्रिया अपने कर्ता से सहमत होती है। व्याकरण-जांचक जिसे गलत बताएगा, उसमें कुछ भी गलत नहीं होता, और फिर भी अनुच्छेद ऐसा पढ़ा जाता है मानो उसे किसी वाक्यांश-पुस्तिका से जोड़कर बनाया गया हो, न कि ऐसे व्यक्ति ने लिखा हो जो अंग्रेज़ी में सोच रहा हो। अंग्रेज़ी अकादमिक लेखन में स्वाभाविक कैसे लगना है, यह सीखना इस बात को स्वीकार करने से शुरू होता है कि उस प्रभाव को पैदा करने वाली अधिकांश चीज़ों का व्याकरण से कोई संबंध नहीं होता।
चार बातें लगभग सारा नुकसान करती हैं, ऐसे शब्द-संयोजन जो तकनीकी रूप से ठीक हैं, लेकिन मूल-भाषी पाठक उनसे जो अपेक्षा करता है, वे नहीं हैं, साक्ष्य के लिए गलत स्तर पर रखी गई अनिश्चितता, ऐसे वाक्य जिनकी लंबाई कभी नहीं बदलती, और संज्ञाएँ जो ऐसा काम कर रही होती हैं जिसे क्रिया के रूप में पढ़ना बेहतर होता। इन चारों में से कोई भी वर्तनी-जांचक या व्याकरण-जांचक को नहीं पकड़ाएगा, और जब लेखक को इन्हें देखने का पता हो, तब चारों को सुधारा जा सकता है।
यह सब किसी detector से आगे निकलने के बारे में नहीं है, और इसे उस तरह देखना सुधार को उल्टा कर देता है। AI detector false positives पर साक्ष्य की TextPulse की समीक्षा बताती है कि पूर्वानुमेय, पाठ्यपुस्तक-सुरक्षित वाक्य-विन्यास मशीन-निर्मित के रूप में अंकित होता है, चाहे उसे वास्तव में किसी ने भी लिखा हो। नीचे दिए गए सुधार इस बारे में हैं कि आप सोचते हुए किसी विशिष्ट व्यक्ति जैसे कैसे लगें, और यही वह चीज़ भी है जो लेखन को सामान्य-सा पढ़े जाने से रोकती है।
सहप्रयोग: शोध "conducted" क्यों होता है, "made" क्यों नहीं
विकल्प व्याकरण की दृष्टि से अशुद्ध नहीं हैं। वे बस वह नहीं हैं जिसे किसी क्षेत्र का पाठक उस विशेष संज्ञा के साथ देखने की अपेक्षा करता है। सहप्रयोग एक शब्द-संयोजन है, जिसे मूल-भाषी पाठक स्थिर मानते हैं, यद्यपि उसी स्थान पर कोई पर्यायवाची व्याकरण की दृष्टि से सही हो सकता है। अकादमिक अंग्रेज़ी में एक अध्ययन, एक प्रयोग, एक सर्वेक्षण और एक विश्लेषण conducted किए जाते हैं। यह एक निष्कर्ष, एक तुलना और एक भेद draw करती है। यह एक प्रश्न और एक चुनौती प्रस्तुत करती है, एक चिंता उठाती है, और एक सहमति या एक निर्णय तक पहुँचती है।
"The study made an analysis of the interview transcripts" बिना किसी व्याकरण त्रुटि के पार्स हो जाता है, और फिर भी यह अनुवादित जैसा पढ़ा जाता है। "The study conducted an analysis of the interview transcripts," या अधिक सीधे, "the study analyzed the interview transcripts," वह संस्करण है जिसे इस क्षेत्र का एक पाठक बिना सोचे लिखेगा।
| Common substitution | Collocation academic readers expect | In context |
|---|---|---|
| made an experiment | conducted an experiment / ran an experiment | We ran a follow-up experiment with a larger sample. |
| give a result | yield a result / produce a result | The regression yielded results consistent with Study 1. |
| make an analysis | conduct an analysis / carry out an analysis | We conducted a sensitivity analysis across three model specifications. |
| put a question | raise a question / pose a question | These findings raise a question the current model cannot answer. |
| arrive to a conclusion | arrive at a conclusion / reach a conclusion | The panel reached a conclusion after reviewing all three datasets. |
इसका अर्थ यह नहीं है कि सामान्य रूप से "make" एक क्रिया के रूप में गलत है। "Make a contribution," "make a distinction" और "make an argument" सभी अपने-अपने रूप में मानक अकादमिक कोलोकेशन हैं। उस विशिष्ट संज्ञा की जाँच करें जो क्रिया के साथ लगी है, क्योंकि English इनमें से प्रत्येक संज्ञा को क्रियाओं के एक छोटे, स्थिर समूह से जोड़ता है और उस समूह के भीतर लगभग किसी भी प्रतिस्थापन को सहन नहीं करता।
पाठ्यपुस्तक के अनुसार नहीं, बल्कि साक्ष्य के अनुरूप सावधानी का स्तर निर्धारित करना
हेजिंग का उद्देश्य किसी दावे की शक्ति को उस साक्ष्य के अनुरूप बनाना है जिसे वास्तव में समर्थन प्राप्त है, और यह दोनों दिशाओं में विफल होती है। ओवरक्लेमिंग किसी ऐसे डिज़ाइन से कारणात्मक या निर्णायक परिणाम का दावा करती है जो उसे सहारा नहीं दे सकता, जैसे, "proves," "demonstrates conclusively," "shows that X causes Y," को एक ही सहसंबंधी अध्ययन से जोड़ देना। अंडरक्लेमिंग किसी ऐसे निष्कर्ष पर कई हेज जोड़ देती है जो पहले से ही अच्छी तरह समर्थित है, तब तक कि वाक्य निष्कर्ष के बारे में उचित सावधानी के बजाय स्वयं हेज के बारे में संदेह संकेतित करने लगता है।
एकल क्रॉस-सेक्शनल सर्वेक्षण "screen time is associated with adolescent anxiety" या "these results are consistent with a link between the two" का समर्थन करता है। यह "these results prove that screen time causes anxiety in adolescents" का समर्थन नहीं करता, क्योंकि क्रॉस-सेक्शनल डिज़ाइन यह स्थापित नहीं कर सकता कि कौन-सा चर पहले आया, यह तो दूर की बात है कि एक ने दूसरे का कारण बनाया। एक संतुलित दावा अधिक आत्मविश्वासी प्रतीत होता है, बनिस्बत एक ओवरक्लेम्ड दावे के, क्योंकि एक सावधान पाठक उस पर लाइन दर लाइन तथ्य-जांच शुरू करने से पहले अधिक भरोसा करता है।
उतने ही उल्लेखनीय अंडरक्लेमिंग के उदाहरण हैं। छात्रों को "always hedge" सिखाया गया था, लेकिन यह नहीं कि कितना। "It could perhaps possibly be suggested that the intervention may potentially have some effect." इस वाक्य में चार हेज हैं। "The intervention appears to have an effect." यहाँ केवल एक हेज है, जो एकल अध्ययन की वास्तविक शक्ति के लिए उपयुक्त है। यह अधिक कहता है क्योंकि यह कम कहता है।
वाक्य-लय: वह संकेत जिसे पाठक नाम देने से पहले महसूस करते हैं
समान वाक्य-लंबाई शायद ही कभी किसी व्याकरण-जांचक को चौंकाती है, फिर भी ऐसा अनुच्छेद जिसमें हर वाक्य लगभग समान लंबाई के कुछ शब्दों के भीतर समाप्त होता है, चाहे प्रत्येक वाक्य अपने आप में कितना भी सही क्यों न हो, सपाट पढ़ा जाता है। TextPulse की शैक्षणिक लेखन में वाक्य-लंबाई में विविधता लाने का पूर्ण विवरण पुनर्गठन को विस्तार से कवर करती है, पहले और बाद के अनुच्छेदों के साथ। संक्षिप्त रूप यह है, एक अनुच्छेद को फिर से पढ़ें, समान आकार के तीन या अधिक वाक्यों की हर श्रृंखला को चिह्नित करें, और एक को तोड़ दें।
अपने पेपर को मानवीय बनाइए
अपने AI-सहायता प्राप्त पाठ को रूपांतरित करें और उसे मानवीय ध्वनि दें, महत्वपूर्ण शब्दों या उद्धरणों को छेड़े बिना।
अत्यधिक संज्ञाकरण: क्रिया को काम करने दें
नामिकीकरण एक क्रिया को एक अमूर्त संज्ञा में बदल देता है: investigate, investigation बन जाता है, analyze, analysis बन जाता है, improve, improvement बन जाता है। अंग्रेज़ी इसे लगातार सहन करती है, और अकादमिक लेखन इस पर अधिकांश रजिस्टरों की तुलना में अधिक निर्भर करता है, लेकिन केवल नामिकीकरणों से बना एक अनुच्छेद हर वाक्य को आवश्यकता से अधिक भारी ढांचे से गुज़ारता है, और यह भारीपन अनुवादित जैसा पढ़ा जाता है, भले ही हर शब्द सही हो।
"The implementation of the revised protocol resulted in a reduction in contamination events" सोलह शब्दों में उस चीज़ का वर्णन करता है जिसे एक क्रिया सीधे वहन कर सकती थी। "Implementing the revised protocol reduced contamination events" मूल वाक्य के हर तथ्य को बनाए रखता है और केवल उनके चारों ओर की संरचना को हटाता है।
"This study aims to undertake an investigation into the relationship between diet and cognitive performance" वास्तविक विषय के आने से पहले तेरह शब्द खर्च करता है। "This study investigates the relationship between diet and cognitive performance" वही बात नौ शब्दों में कहता है, और पाठक तीन शब्द पहले ही बिंदु तक पहुँच जाता है।
गलत रजिस्टर में संयोजक
पाठ्यपुस्तकें औपचारिक संयोजकों के एक छोटे समूह को आरंभ में और कठोरता से सिखाती हैं: furthermore, moreover, thus, hence, consequently। जो लेखक इन्हें एक अकादमिक वाक्य शुरू करने का सही तरीका मानकर सीखता है, वह हर कुछ पंक्तियों में एक से आरंभ करने की प्रवृत्ति रखता है, चाहे वास्तविक तार्किक संबंध को संकेतित करने की आवश्यकता हो या न हो। मूल अकादमिक गद्य इन्हीं शब्दों का बहुत अधिक संयम से उपयोग करता है, और अक्सर साधारण सन्निकटता पर निर्भर करता है, एक दावा जिसके तुरंत बाद उसका प्रमाण आता है, बजाय किसी संकेतक शब्द के जो संबंध की घोषणा करे।
"Furthermore, the sample size was small. Participants were not randomly assigned. The results may not generalize. Future research should use a larger sample" चार वाक्यों में चार संयोजकों का उपयोग करता है और वास्तव में केवल एक की आवश्यकता होती है। "The sample size was small, and participants were not randomly assigned, so the results may not generalize to a broader population" वही तर्क एक ही वाक्य में रखता है, जिसमें एक ही संयोजक चार के काम को करता है।
एक संबंधित असंगति पूरे वाक्यों के बजाय अलग-अलग शब्दों में दिखाई देती है। "Besides" का वाक्य की शुरुआत में "in addition" के अर्थ में प्रयोग बोलचाल में और कुछ अनूदित अकादमिक गद्य में सामान्य है, लेकिन अपने आसपास के रजिस्टर के साथ यह अनौपचारिक लगता है; "in addition" या बिना किसी संयोजक के एक नया वाक्य, दोनों ही किसी methods section या discussion में अधिक उपयुक्त बैठते हैं।
अंग्रेज़ी अकादमिक लेखन में स्वाभाविक कैसे सुनाई दें: एक स्व-संपादन दिनचर्या
पूरे अध्याय पर हाथ से सभी 5 जाँचें करना एक कार्यशील दोपहर लेता है, और यही वह लागत है जिसे यह दिनचर्या किसी संपादक को देने से बचाने के लिए मौजूद है। TextPulse का ESL अकादमिक लेखकों के लिए बनाया गया humanizer ऊपर बताए गए पैटर्नों के आधार पर, किसी सामान्य पास के बजाय, उसी प्रकार की जाँचों का एक संस्करण सीधे मसौदे पर लागू करता है।
- मसौदे में "make," "do," और "give" को किसी संज्ञा के साथ लगे हुए खोजें, और उस युग्मन की तुलना करें कि क्षेत्र का पाठक क्या अपेक्षा करता है: conducted, not made; yielded, not given.
- हर hedge word को ज़ोर से पढ़ें और पूछें कि क्या साक्ष्य वास्तव में उस तीव्रता का समर्थन करता है; एक अकेला correlational study शायद prove, show or demonstrate का औचित्य नहीं देता।
- हर अनुच्छेद के प्रत्येक वाक्य के पहले 3 शब्दों को चिह्नित करें; यदि वही आरंभ लगातार 3 बार दोहरता है, तो एक वाक्य को किसी भिन्न संरचना के साथ पुनर्गठित करें।
- -tion, -ment और -ance पर समाप्त होने वाले शब्दों को खोजें, और पूछें कि क्या वाक्य अधिक सीधे पढ़ा जाएगा यदि वह संज्ञा मुख्य क्रिया बन जाए।
- हर furthermore, moreover, thus और consequently को हटा दें, फिर अनुच्छेद को उनके बिना पढ़ें; केवल उन्हीं को वापस रखें जिनकी तर्कशृंखला को सचमुच आवश्यकता है।
इन 5 जाँचों में से कोई भी अधिक समय नहीं लेती, एक बार वे आदत बन जाएँ, न कि डेस्क के ऊपर चिपकी हुई सूची। एक free academic tone converter उसी पास का एक संस्करण स्वतः चलाता है, casual constructions और oversized hedges को उस रजिस्टर के विरुद्ध चिह्नित करते हुए जिसकी किसी section को वास्तव में आवश्यकता होती है, और केवल सुधार नहीं बल्कि उसके साथ तर्क भी देता है।
यदि किसी डिटेक्टर ने पहले ही आपके काम को चिह्नित कर दिया है, तो AI का उपयोग करने का आरोप लगाए जाने पर क्या करना चाहिए और यह कैसे साबित करें कि आपने ऐसा नहीं किया को अलग से कवर किया गया है।
वह परीक्षण, जो वास्तव में महत्वपूर्ण है, का इस बात से कोई संबंध नहीं है कि कोई डिटेक्टर किसी अनुच्छेद को चिह्नित करता है या नहीं। प्रश्न यह है कि क्या क्षेत्र का कोई पाठक यह भूल जाता है कि वह एक अनुवाद पढ़ रहा है, जो स्वच्छ व्याकरण से अधिक ऊँचा मानदंड है और अधिकांश लेखकों के अनुमान से कम मानदंड है: एक सावधानीपूर्वक समायोजित hedge, कुछ सही collocations, और वाक्य लंबाई के पैटर्न में एक टूटन, आमतौर पर वहाँ तक पहुँचा देते हैं।
अक्सर पूछे जाने वाले प्रश्न
व्याकरण प्रायः संकेतक नहीं होता। चार पैटर्न अधिकतर काम करते हैं, ऐसे शब्द-संबंध जो तकनीकी रूप से सही होते हैं, लेकिन मूल-भाषी पाठक उनसे अपेक्षा नहीं करता, जैसे conducted के बजाय made; साक्ष्य के लिए गलत तीव्रता वाली हेजिंग; ऐसी वाक्य-लंबाई जो कभी नहीं बदलती; और संज्ञाओं का वह काम करना जो क्रिया अधिक सीधे करती। इन चारों में से कोई भी व्याकरण-जांचक को नहीं पकड़ता।
PhD in natural language processing, with years spent building NLP applications end to end. Moe works on text analysis: lexical and syntactic structure, and what separates machine-generated prose from human prose statistically. He has been experimenting with computational linguistics since the early days of NLTK, spaCy and WordNet, and still writes most of his tooling in Python.