टेक्स्ट AI से लिखा होने की सात निशानियाँ

चार जिन्हें मापा जा सकता है, तीन जिन्हें सिर्फ़ महसूस किया जा सकता है — और दोनों की ईमानदार सीमाएँ।

सबसे भरोसेमंद निशानियाँ मैकेनिकल होती हैं: एक समान दर पर लंबे डैश, घुमावदार उद्धरण, अदृश्य Unicode अक्षर और इमोजी से शुरू होती बुलेट सूचियाँ। स्टाइल वाली निशानियाँ — हिचकिचाहट भरी भाषा, 'not just X, but Y' जैसी रचना और असाधारण रूप से समान पैराग्राफ़ की लंबाई — कमज़ोर होती हैं। इनमें से कोई भी अकेले कुछ साबित नहीं करती; ये पैटर्न हैं, सबूत नहीं।

चार मैकेनिकल निशानियाँ जिन्हें असल में मापा जा सकता है

इन्हें गिना जा सकता है। आप इन्हें किसी टूल से जाँचकर अंदाज़े की जगह एक संख्या पा सकते हैं — यही इन्हें महसूस पर आधारित पहचान से ज़्यादा उपयोगी बनाता है।

1. एक समान दर पर लंबे डैश। चैट मॉडल लंबा डैश (—) इंसानों से कहीं ज़्यादा नियमितता से इस्तेमाल करते हैं, क्योंकि इसे टाइप करने के लिए एक ऐसा कीबोर्ड शॉर्टकट चाहिए जो ज़्यादातर लेखकों ने कभी नहीं सीखा। लंबे दस्तावेज़ में एक-दो डैश सामान्य है। लगभग हर पैराग्राफ़ में एक, बराबर फैला हुआ, सामान्य नहीं है। लंबे डैश की गाइड में बताया गया है कि यह आदत इतनी पक्की क्यों है।

2. घुमावदार उद्धरण और टाइपोग्राफ़िक विराम चिह्न। AI आउटपुट अक्सर दिशात्मक उद्धरण चिह्नों (" "), घुमावदार अपॉस्ट्रॉफ़ी (') और असली एलिप्सिस अक्षर (…) के साथ आता है, तीन फ़ुल स्टॉप की जगह। वर्ड प्रोसेसर भी ये अपने आप बना देते हैं, इसलिए ये तभी मायने रखते हैं जब ऑटोकरेक्ट कभी शामिल ही न हुआ हो — जैसे प्लेन-टेक्स्ट फ़ील्ड, कोड कमेंट या CSV फ़ाइल।

3. अदृश्य Unicode अक्षर। ज़ीरो-विथ स्पेस, नॉन-ब्रेकिंग स्पेस और नैरो नो-ब्रेक स्पेस अक्सर चैट विंडो से कॉपी-पेस्ट करते समय बच जाते हैं। ये आँख से बिल्कुल नहीं दिखते और ये सबसे मज़बूत मैकेनिकल संकेतक हैं, क्योंकि इंसान के हाथ से टाइप की गई चीज़ में ये लगभग कभी नहीं आते।

4. इमोजी से शुरू होती बुलेट सूचियाँ। हर बुलेट की शुरुआत में सजावटी इमोजी वाले स्ट्रक्चर्ड जवाब, असली हेडिंग की जगह बोल्ड टेक्स्ट से बने सेक्शन हेडर, और तीन स्तर तक नेस्ट की गई सूचियाँ — यह एक ऐसी हाउस स्टाइल है जिसे चैट इंटरफ़ेस बढ़ावा देते हैं, जबकि ज़्यादातर इंसानी लेखक इसका इस्तेमाल नहीं करते।

आम पहचान संकेत1Delve into the multifaceted landscape2It's not just X — it's Y3“Smart quotes” and … ellipses4✅ Emoji-headed bullet lists
चार यांत्रिक पैटर्न जो AI चैट से कॉपी-पेस्ट करने के बाद अक्सर बचे रहते हैं।

तीन स्टाइल वाली निशानियाँ — कमज़ोर, लेकिन जानने लायक

स्टाइल स्तर के पैटर्न गलत समझना काफ़ी आसान है, क्योंकि बहुत-सी सावधान इंसानी लेखन शैली में भी ये मिलते हैं। इन्हें करीब से देखने के संकेत की तरह लें, कभी निष्कर्ष की तरह नहीं।

5. हिचकिचाहट भरी, संतुलित प्रस्तुति। ऐसे वाक्य जो हर सवाल को दो उचित पहलुओं वाला बताते हों, ऐसे पैराग्राफ़ जो सवाल दोहराकर खुलते हों, और ऐसी आखिरी लाइनें जो कुछ नया जोड़े बिना सिर्फ़ सारांश दें। यह उस ट्रेनिंग से आता है जो मददगार और गैर-प्रतिबद्ध — दोनों एक साथ — होने को पुरस्कृत करती है।

6. "not just X, but Y" वाली रचना। साथ ही "it's worth noting that", "delve into", "navigate the complexities of" और "in today's fast-paced world" जैसे वाक्यांश। ये वाक्यांश मना किए गए शब्द नहीं हैं — ये साधारण अंग्रेज़ी है। खास बात यह है कि छोटे से टेक्स्ट में ये कितनी बार एक साथ ढेर हो जाते हैं।

7. असाधारण रूप से एक जैसी संरचना। लगभग एक ही लंबाई के पैराग्राफ़, संदिग्ध रूप से बराबर बुलेट वाले सेक्शन, और ऐसा निष्कर्ष जो भूमिका की हूबहू झलक हो। इंसानी ड्राफ़्ट असमान होते हैं; कोई पैराग्राफ़ लंबा चलता है क्योंकि लेखक के पास उस खास बात के बारे में ज़्यादा कहने को था।

शब्दावली के संकेत खासकर जल्दी पुराने हो जाते हैं। "AI शब्दों" की हर घूमती सूची लोगों की लिखावट में और अगली पीढ़ी के मॉडलों की ट्यूनिंग में समा जाती है। मैकेनिकल निशानियाँ ज़्यादा टिकाऊ होती हैं क्योंकि वे स्टाइल की नहीं, एन्कोडिंग की उपज हैं।

संरचनात्मक आदतें, और वे सबसे कमज़ोर संकेत क्यों हैं

ऊपर की निशानियाँ अक्षरों और वाक्यांशों के बारे में हैं। एक और परत है जो वाक्य से ऊपर बैठती है — पूरा टुकड़ा किस तरह गढ़ा गया है — और यही वह परत है जिसकी तरफ़ लोग सबसे ज़्यादा इशारा करते हैं जब वे कहते हैं कि कुछ "AI जैसा लगता है"।

  • एक जैसी पैराग्राफ़ लंबाई। तीन से चार वाक्य, बार-बार, बिना किसी ज़ोर देने वाले एक-लाइन पैराग्राफ़ के और बिना किसी ऐसे हिस्से के जो लेखक की दिलचस्पी बढ़ने से लंबा खिंच गया हो।
  • सवाल दोहराने वाली शुरुआत। "बहुत अच्छा सवाल है। डेटाबेस चुनने में कई बातें शामिल होती हैं।" किसी भी कंटेंट से पहले गला साफ़ करने जैसा एक पैराग्राफ़, जो चैट फ़ॉर्मैट से विरासत में मिला है, जहाँ प्रॉम्प्ट दोहराकर शुरू करना एक वाजिब तरीका है।
  • कुछ न जोड़ने वाला समापन। "In conclusion", "Overall", "Ultimately" के बाद अभी पढ़े गए का सारांश। किसी निबंध में ठीक है जिसमें कोई दलील साबित करनी हो; 300 शब्दों के जवाब पर अजीब लगता है।
  • डिफ़ॉल्ट रूप से दोनों-पक्षीय प्रस्तुति। हर ट्रेड-ऑफ़ को संतुलित दिखाया जाता है, हर सिफ़ारिश "it depends on your specific needs" कहकर हिचकिचाई जाती है, भले ही बताए गए मामले में कोई एक विकल्प साफ़ तौर पर बेहतर हो।
  • हर चीज़ को लिस्ट बना देना। हेडिंग, बुलेट और नंबर वाले स्टेप ऐसी सामग्री पर लगा दिए जाते हैं जिसमें न कोई क्रम है, न कोई समानांतर संरचना — बुलेट पॉइंट्स को पैराग्राफ़ में बदलें टूल इसीलिए मौजूद है क्योंकि इसे हाथ से वापस बदलना थकाने वाला काम है।

अब सबसे ज़रूरी बात। ये इस पेज पर सबसे कमज़ोर संकेत हैं, स्टाइल वाले संकेतों से भी कमज़ोर, और इसकी वजह साफ़-साफ़ बताना ज़रूरी है।

उस लिस्ट का हर आइटम सिखाया हुआ है। एक जैसे पैराग्राफ़ और सवाल दोहराने वाली शुरुआत वही है जो स्कूल की निबंध-शिक्षा माँगती है। "In conclusion" एक मानक अकादमिक चाल है। संतुलित प्रस्तुति पेशेवर सावधानी है — यही तरीका है जिससे किसी कंसल्टेंट, वकील या डॉक्टर को लिखना सिखाया जाता है, क्योंकि ज़्यादा दावा करने के नतीजे होते हैं। भारी लिस्ट का इस्तेमाल तकनीकी दस्तावेज़ीकरण, कॉर्पोरेट रिपोर्टिंग और ज़्यादातर आंतरिक विकी में हाउस स्टाइल है। मॉडल इस तरह इसलिए लिखता है क्योंकि लोग इसी तरह लिखते हैं; यह पैटर्न सबसे पहले इंसानी टेक्स्ट से ही आया था।

यही वजह है कि संरचनात्मक विशेषताओं पर स्कोर करने वाले डिटेक्टर ठीक उसी लेखन पर ग़लत-पॉज़िटिव नतीजे देते हैं जो सबसे सावधानी से एडिट किया गया, सबसे औपचारिक, और अक्सर उन गैर-देशीय अंग्रेज़ी बोलने वालों का लिखा होता है जिन्होंने अंग्रेज़ी औपचारिक शिक्षा से सीखी। एकरूपता एक ऐसा गुण है जो अभ्यास को इनाम देता है, और बहुत से लोगों ने यही अभ्यास किया है।

तो यह सेक्शन आपको कोई टेस्ट देने के लिए नहीं, बल्कि एक रजिस्टर पहचानने में मदद के लिए है। लंबे डैश की गाइड विराम चिह्नों के बारे में यही बात कहती है, और यहाँ यह और भी मज़बूती से लागू होती है: कोई दस्तावेज़ ऊपर के हर संरचनात्मक पैटर्न पर खरा उतर सकता है और पूरी तरह इंसानी हो सकता है, और कोई दस्तावेज़ इनमें से किसी पर भी खरा न उतरे फिर भी पूरी तरह जनरेट किया हुआ हो सकता है। इस पेज पर कुछ भी, और इस साइट के किसी टूल की कोई रिपोर्ट, यह तय नहीं करती कि किसी चीज़ को किसने लिखा।

दस्तावेज़ की जाँच एक ही बार में कैसे करें

काम का क्रम, सबसे सस्ती जाँच पहले:

  1. अदृश्य अक्षरों की स्कैनिंग करें। यह सबसे मज़बूत संकेत वाली, सबसे कम मेहनत वाली जाँच है। टेक्स्ट को अदृश्य अक्षर दिखाएँ में पेस्ट करें — यह कुछ भी मिटाता नहीं, बल्कि हर छिपे अक्षर को उसी जगह लेबल कर देता है: [ZWSP], [SHY], [BOM], [LRM], [NBSP], [NNBSP] — ताकि आप देख सकें कि वे कितने हैं और कहाँ बैठे हैं, नॉन-ब्रेकिंग और नैरो नो-ब्रेक स्पेस समेत। Invisible Character Scanner इसी जोड़ी का दूसरा हिस्सा है: यह छिपे अक्षरों, ज़ीरो-विथ अक्षरों और सॉफ्ट हाइफ़न की कुल गिनती बताता है और उन्हें हटा देता है, नो-ब्रेक स्पेस को जगह पर छोड़ते हुए।
  2. मैकेनिकल निशानों को एक साथ गिनें। AI Text Cleaner एक ही बार में लंबे डैश, घुमावदार उद्धरण, अदृश्य अक्षर और इमोजी की रिपोर्ट देता है, ताकि आप देख सकें कि कई संकेत साथ-साथ मिल रहे हैं या नहीं, बजाय एक-एक के पीछे भागने के।
  3. स्टाइल वाले पैटर्न के लिए पढ़ें। गिनती मिलने के बाद ही। पहले संख्याएँ इसलिए, ताकि आप खुद को किसी निष्कर्ष पर मना न लें।
  4. संदर्भ तौलें। Word से पेस्ट किया टेक्स्ट लिखने वाला कोई भी हो, घुमावदार उद्धरण लेकर आएगा। प्लेन textarea में टाइप किया टेक्स्ट नहीं लाएगा।

मायने साथ-साथ मिलना रखता है। एक अकेला लंबा डैश कुछ नहीं कहता। लेकिन लंबे डैश और घुमावदार उद्धरण और दो ज़ीरो-विथ स्पेस और इमोजी बुलेट — एक ऐसे दस्तावेज़ में जो सीधे प्लेन-टेक्स्ट फ़ॉर्म में टाइप किया गया था — सचमुच असामान्य संयोजन है।

क्यों इनमें से कुछ भी सबूत नहीं है

ऊपर की हर निशानी की एक मासूम व्याख्या मौजूद है।

Word डबल हाइफ़न को लंबे डैश में अपने आप बदल देता है, और Word तथा Google Docs दोनों सीधे उद्धरणों को घुमावदार उद्धरणों में अपने आप बदल देते हैं। किसी भी आधुनिक वेबसाइट से कॉपी करने पर अदृश्य अक्षर साथ आ सकते हैं। प्रोफ़ेशनल एडिटर ठीक वैसी ही संतुलित, हिचकिचाहट भरी शैली में लिखते हैं जो मशीन से लिखी लगती है। गैर-देशीय अंग्रेज़ी बोलने वाले अक्सर ज़्यादा औपचारिक और संरचनात्मक रूप से नियमित स्टाइल में लिखते हैं — यही वजह है कि व्यावसायिक AI डिटेक्टर उनके काम को काफ़ी ज़्यादा दर से फ़्लैग करते हैं।

एक साफ़-साफ़ चक्रीयता भी है: कोई व्यक्ति AI आउटपुट को टेक्स्ट एडिटर में पेस्ट करके, सफ़ाई का एक चक्कर चलाकर, करीब दस सेकंड में हर मैकेनिकल निशान मिटा सकता है। जो संकेत मापने में सबसे आसान हैं, वे मिटाने में भी सबसे आसान हैं।

इसलिए ईमानदार स्थिति यह है: फ़ॉर्मैटिंग विश्लेषण आपको बताता है कि दस्तावेज़ में कौन-कौन से अक्षर हैं। यह नहीं बता सकता कि उन्हें वहाँ किसने डाला। हमारे टूल जानबूझकर सिर्फ़ गिनती बताते हैं और कभी फ़ैसला नहीं सुनाते, क्योंकि फ़ैसला एक ऐसा अंदाज़ा होगा जिसने भेष में संख्या पहन रखी हो। अगर आपको यह जानना है कि किसी चीज़ को इंसान ने लिखा या नहीं, तो जवाब उस व्यक्ति से बात करने से मिलेगा — ड्राफ़्ट का इतिहास, स्रोत और अपनी दलील खुद समझाने की क्षमता — डैश गिनने से नहीं।

अक्सर पूछे जाने वाले सवाल

टेक्स्ट AI से लिखा होने की सबसे भरोसेमंद निशानी क्या है?

ज़ीरो-विथ स्पेस जैसे अदृश्य Unicode अक्षर सबसे मज़बूत मैकेनिकल संकेतक हैं, क्योंकि सामान्य टाइपिंग से ये लगभग कभी नहीं बनते, जबकि चैट विंडो से कॉपी-पेस्ट में अक्सर आ जाते हैं। फिर भी, ये किसी वेबसाइट से कॉपी करने से भी आ सकते हैं, इसलिए ये लेखक की नहीं, पेस्ट के स्रोत की ओर इशारा करते हैं।

क्या AI डिटेक्टर सच में काम करते हैं?

भरोसेमंद तरीके से नहीं। वे इंसानी लेखन पर भी गलत नतीजे देते हैं — जिसमें गैर-देशीय अंग्रेज़ी बोलने वाले असमान रूप से प्रभावित होते हैं — और हल्की एडिटिंग से उन्हें चकमा दिया जा सकता है। फ़ॉर्मैटिंग विश्लेषण ठोस निशान गिन सकता है, लेकिन सिर्फ़ टेक्स्ट से लेखक का पता कोई टूल नहीं लगा सकता — हमारा भी नहीं।

क्या लंबे डैश या घुमावदार उद्धरण इस्तेमाल करने पर मुझ पर AI इस्तेमाल का आरोप लगेगा?

ऐसा नहीं होना चाहिए, और आरोप के लिए यह बुरा आधार है। Word सामान्य टाइपिंग से ही दोनों अपने आप बना देता है, और Google Docs भी उसी तरह सीधे उद्धरणों को घुमावदार कर देता है। अगर आपको दस्तावेज़ कैसा पढ़ा जाएगा इसकी चिंता है, तो विराम चिह्नों को सादा ASCII में बदलने से निशान हट जाते हैं — आपकी लिखावट का एक शब्द बदले बिना।

क्या AI से बने टेक्स्ट से ये निशानियाँ हटाई जा सकती हैं?

हाँ, और बहुत जल्दी — यही वजह है कि वे कमज़ोर सबूत हैं। लंबे डैश बदलना, उद्धरण सामान्य करना और अदृश्य अक्षर हटाना सेकंडों का काम है। यह डिटेक्शन के दावों पर शक करने की वजह है, किसी और के काम को अपना बताने की तरकीब नहीं।

इस गाइड में बताए गए टूल

संबंधित गाइड