सबसे भरोसेमंद निशानियाँ मैकेनिकल होती हैं: एक समान दर पर लंबे डैश, घुमावदार उद्धरण, अदृश्य Unicode अक्षर और इमोजी से शुरू होती बुलेट सूचियाँ। स्टाइल वाली निशानियाँ — हिचकिचाहट भरी भाषा, 'not just X, but Y' जैसी रचना और असाधारण रूप से समान पैराग्राफ़ की लंबाई — कमज़ोर होती हैं। इनमें से कोई भी अकेले कुछ साबित नहीं करती; ये पैटर्न हैं, सबूत नहीं।
चार मैकेनिकल निशानियाँ जिन्हें असल में मापा जा सकता है
इन्हें गिना जा सकता है। आप इन्हें किसी टूल से जाँचकर अंदाज़े की जगह एक संख्या पा सकते हैं — यही इन्हें महसूस पर आधारित पहचान से ज़्यादा उपयोगी बनाता है।
1. एक समान दर पर लंबे डैश। चैट मॉडल लंबा डैश (—) इंसानों से कहीं ज़्यादा नियमितता से इस्तेमाल करते हैं, क्योंकि इसे टाइप करने के लिए एक ऐसा कीबोर्ड शॉर्टकट चाहिए जो ज़्यादातर लेखकों ने कभी नहीं सीखा। लंबे दस्तावेज़ में एक-दो डैश सामान्य है। लगभग हर पैराग्राफ़ में एक, बराबर फैला हुआ, सामान्य नहीं है। लंबे डैश की गाइड में बताया गया है कि यह आदत इतनी पक्की क्यों है।
2. घुमावदार उद्धरण और टाइपोग्राफ़िक विराम चिह्न। AI आउटपुट अक्सर दिशात्मक उद्धरण चिह्नों (" "), घुमावदार अपॉस्ट्रॉफ़ी (') और असली एलिप्सिस अक्षर (…) के साथ आता है, तीन फ़ुल स्टॉप की जगह। वर्ड प्रोसेसर भी ये अपने आप बना देते हैं, इसलिए ये तभी मायने रखते हैं जब ऑटोकरेक्ट कभी शामिल ही न हुआ हो — जैसे प्लेन-टेक्स्ट फ़ील्ड, कोड कमेंट या CSV फ़ाइल।
3. अदृश्य Unicode अक्षर। ज़ीरो-विथ स्पेस, नॉन-ब्रेकिंग स्पेस और नैरो नो-ब्रेक स्पेस अक्सर चैट विंडो से कॉपी-पेस्ट करते समय बच जाते हैं। ये आँख से बिल्कुल नहीं दिखते और ये सबसे मज़बूत मैकेनिकल संकेतक हैं, क्योंकि इंसान के हाथ से टाइप की गई चीज़ में ये लगभग कभी नहीं आते।
4. इमोजी से शुरू होती बुलेट सूचियाँ। हर बुलेट की शुरुआत में सजावटी इमोजी वाले स्ट्रक्चर्ड जवाब, असली हेडिंग की जगह बोल्ड टेक्स्ट से बने सेक्शन हेडर, और तीन स्तर तक नेस्ट की गई सूचियाँ — यह एक ऐसी हाउस स्टाइल है जिसे चैट इंटरफ़ेस बढ़ावा देते हैं, जबकि ज़्यादातर इंसानी लेखक इसका इस्तेमाल नहीं करते।
तीन स्टाइल वाली निशानियाँ — कमज़ोर, लेकिन जानने लायक
स्टाइल स्तर के पैटर्न गलत समझना काफ़ी आसान है, क्योंकि बहुत-सी सावधान इंसानी लेखन शैली में भी ये मिलते हैं। इन्हें करीब से देखने के संकेत की तरह लें, कभी निष्कर्ष की तरह नहीं।
5. हिचकिचाहट भरी, संतुलित प्रस्तुति। ऐसे वाक्य जो हर सवाल को दो उचित पहलुओं वाला बताते हों, ऐसे पैराग्राफ़ जो सवाल दोहराकर खुलते हों, और ऐसी आखिरी लाइनें जो कुछ नया जोड़े बिना सिर्फ़ सारांश दें। यह उस ट्रेनिंग से आता है जो मददगार और गैर-प्रतिबद्ध — दोनों एक साथ — होने को पुरस्कृत करती है।
6. "not just X, but Y" वाली रचना। साथ ही "it's worth noting that", "delve into", "navigate the complexities of" और "in today's fast-paced world" जैसे वाक्यांश। ये वाक्यांश मना किए गए शब्द नहीं हैं — ये साधारण अंग्रेज़ी है। खास बात यह है कि छोटे से टेक्स्ट में ये कितनी बार एक साथ ढेर हो जाते हैं।
7. असाधारण रूप से एक जैसी संरचना। लगभग एक ही लंबाई के पैराग्राफ़, संदिग्ध रूप से बराबर बुलेट वाले सेक्शन, और ऐसा निष्कर्ष जो भूमिका की हूबहू झलक हो। इंसानी ड्राफ़्ट असमान होते हैं; कोई पैराग्राफ़ लंबा चलता है क्योंकि लेखक के पास उस खास बात के बारे में ज़्यादा कहने को था।
शब्दावली के संकेत खासकर जल्दी पुराने हो जाते हैं। "AI शब्दों" की हर घूमती सूची लोगों की लिखावट में और अगली पीढ़ी के मॉडलों की ट्यूनिंग में समा जाती है। मैकेनिकल निशानियाँ ज़्यादा टिकाऊ होती हैं क्योंकि वे स्टाइल की नहीं, एन्कोडिंग की उपज हैं।
दस्तावेज़ की जाँच एक ही बार में कैसे करें
काम का क्रम, सबसे सस्ती जाँच पहले:
- अदृश्य अक्षरों की स्कैनिंग करें। यह सबसे मज़बूत संकेत वाली, सबसे कम मेहनत वाली जाँच है। टेक्स्ट को Invisible Character Scanner में पेस्ट करें — यह मिलने वाले हर ज़ीरो-विथ स्पेस, सॉफ्ट हाइफ़न, बाइट-ऑर्डर मार्क और दिशा चिह्न को गिनती के साथ सूचीबद्ध करता है।
- मैकेनिकल निशानों को एक साथ गिनें। AI Text Cleaner एक ही बार में लंबे डैश, घुमावदार उद्धरण, अदृश्य अक्षर और इमोजी की रिपोर्ट देता है, ताकि आप देख सकें कि कई संकेत साथ-साथ मिल रहे हैं या नहीं, बजाय एक-एक के पीछे भागने के।
- स्टाइल वाले पैटर्न के लिए पढ़ें। गिनती मिलने के बाद ही। पहले संख्याएँ इसलिए, ताकि आप खुद को किसी निष्कर्ष पर मना न लें।
- संदर्भ तौलें। Word से पेस्ट किया टेक्स्ट लिखने वाला कोई भी हो, घुमावदार उद्धरण लेकर आएगा। प्लेन textarea में टाइप किया टेक्स्ट नहीं लाएगा।
मायने साथ-साथ मिलना रखता है। एक अकेला लंबा डैश कुछ नहीं कहता। लेकिन लंबे डैश और घुमावदार उद्धरण और दो ज़ीरो-विथ स्पेस और इमोजी बुलेट — एक ऐसे दस्तावेज़ में जो सीधे प्लेन-टेक्स्ट फ़ॉर्म में टाइप किया गया था — सचमुच असामान्य संयोजन है।
क्यों इनमें से कुछ भी सबूत नहीं है
ऊपर की हर निशानी की एक मासूम व्याख्या मौजूद है।
Word और Google Docs डबल हाइफ़न को लंबे डैश में और सीधे उद्धरणों को घुमावदार उद्धरणों में अपने आप बदल देते हैं। किसी भी आधुनिक वेबसाइट से कॉपी करने पर अदृश्य अक्षर साथ आ सकते हैं। प्रोफ़ेशनल एडिटर ठीक वैसी ही संतुलित, हिचकिचाहट भरी शैली में लिखते हैं जो मशीन से लिखी लगती है। गैर-देशीय अंग्रेज़ी बोलने वाले अक्सर ज़्यादा औपचारिक और संरचनात्मक रूप से नियमित स्टाइल में लिखते हैं — यही वजह है कि व्यावसायिक AI डिटेक्टर उनके काम को काफ़ी ज़्यादा दर से फ़्लैग करते हैं।
एक साफ़-साफ़ चक्रीयता भी है: कोई व्यक्ति AI आउटपुट को टेक्स्ट एडिटर में पेस्ट करके, सफ़ाई का एक चक्कर चलाकर, करीब दस सेकंड में हर मैकेनिकल निशान मिटा सकता है। जो संकेत मापने में सबसे आसान हैं, वे मिटाने में भी सबसे आसान हैं।
इसलिए ईमानदार स्थिति यह है: फ़ॉर्मैटिंग विश्लेषण आपको बताता है कि दस्तावेज़ में कौन-कौन से अक्षर हैं। यह नहीं बता सकता कि उन्हें वहाँ किसने डाला। हमारे टूल जानबूझकर सिर्फ़ गिनती बताते हैं और कभी फ़ैसला नहीं सुनाते, क्योंकि फ़ैसला एक ऐसा अंदाज़ा होगा जिसने भेष में संख्या पहन रखी हो। अगर आपको यह जानना है कि किसी चीज़ को इंसान ने लिखा या नहीं, तो जवाब उस व्यक्ति से बात करने से मिलेगा — ड्राफ़्ट का इतिहास, स्रोत और अपनी दलील खुद समझाने की क्षमता — डैश गिनने से नहीं।
अक्सर पूछे जाने वाले सवाल
टेक्स्ट AI से लिखा होने की सबसे भरोसेमंद निशानी क्या है?
ज़ीरो-विथ स्पेस जैसे अदृश्य Unicode अक्षर सबसे मज़बूत मैकेनिकल संकेतक हैं, क्योंकि सामान्य टाइपिंग से ये लगभग कभी नहीं बनते, जबकि चैट विंडो से कॉपी-पेस्ट में अक्सर आ जाते हैं। फिर भी, ये किसी वेबसाइट से कॉपी करने से भी आ सकते हैं, इसलिए ये लेखक की नहीं, पेस्ट के स्रोत की ओर इशारा करते हैं।
क्या AI डिटेक्टर सच में काम करते हैं?
भरोसेमंद तरीके से नहीं। वे इंसानी लेखन पर भी गलत नतीजे देते हैं — जिसमें गैर-देशीय अंग्रेज़ी बोलने वाले असमान रूप से प्रभावित होते हैं — और हल्की एडिटिंग से उन्हें चकमा दिया जा सकता है। फ़ॉर्मैटिंग विश्लेषण ठोस निशान गिन सकता है, लेकिन सिर्फ़ टेक्स्ट से लेखक का पता कोई टूल नहीं लगा सकता — हमारा भी नहीं।
क्या लंबे डैश या घुमावदार उद्धरण इस्तेमाल करने पर मुझ पर AI इस्तेमाल का आरोप लगेगा?
ऐसा नहीं होना चाहिए, और आरोप के लिए यह बुरा आधार है। Word और Google Docs सामान्य टाइपिंग से ही दोनों अपने आप बना देते हैं। अगर आपको दस्तावेज़ कैसा पढ़ा जाएगा इसकी चिंता है, तो विराम चिह्नों को सादा ASCII में बदलने से निशान हट जाते हैं — आपकी लिखावट का एक शब्द बदले बिना।
क्या AI से बने टेक्स्ट से ये निशानियाँ हटाई जा सकती हैं?
हाँ, और बहुत जल्दी — यही वजह है कि वे कमज़ोर सबूत हैं। लंबे डैश बदलना, उद्धरण सामान्य करना और अदृश्य अक्षर हटाना सेकंडों का काम है। यह डिटेक्शन के दावों पर शक करने की वजह है, किसी और के काम को अपना बताने की तरकीब नहीं।