किसी भी फ़ाइल से AI मेटाडेटा हटाएँ — PDF की तस्वीरों के भीतर छिपा निशान भी
हर फ़ाइल को याद रहता है कि वह कैसे बनाई गई थी। ChatGPT, DALL·E, Gemini या Adobe Firefly द्वारा जनरेट की गई छवि में एक हस्ताक्षरित C2PA मैनिफेस्ट और XMP प्रोवेनेंस टैग्स जुड़े होते हैं — digitalSourceType, trainedAlgorithmicMedia, मॉडल का नाम — और ये टैग्स फ़ाइल के साथ हर प्लेटफ़ॉर्म पर जाते हैं। AI द्वारा लिखा गया टेक्स्ट ऐसे अक्षरों के साथ आ सकता है जिन्हें आप देख नहीं सकते: जीरो-विथ स्पेस और जॉइनर जो कॉपी-पेस्ट के बाद भी रहते हैं और वॉटरमार्क की तरह काम करते हैं। यह टूल इन सबको हटा देता है, और साथ ही वह सब कुछ भी साफ़ कर देता है जो फ़ाइल चुपचाप ले जा रही थी। अकेली तस्वीर पर यह सब एक भी पिक्सल डिकोड किए बिना होता है, इसलिए जो तस्वीर वापस मिलती है वही होती है जो आपने भेजी थी।
यह पहचान के हर निशान को हटाता है, सिर्फ AI वाले ही नहीं
AI प्रोवेनेंस इसकी विशेषता है, सीमा नहीं। इसी प्रक्रिया में आपकी फ़ाइल के बारे में बाकी सब कुछ भी साफ़ हो जाता है: लेखक और निर्माता के नाम, GPS निर्देशांक, कैमरा का ब्रांड, मॉडल और सीरियल नंबर, लेंस डेटा, निर्माण और संशोधन की तारीखें, और आखिरी बार संपादन करने वाले सॉफ़्टवेयर का इतिहास। जो फोटो आप प्रकाशित करते हैं, वह किसी अजनबी को यह नहीं बताना चाहिए कि आप किस गली में खड़े थे या किस लैपटॉप पर आपने इसे संपादित किया। जब फ़ाइल वापस आती है, तो उसे आपके, आपके डिवाइस या बनाने वाले टूल के बारे में कुछ भी याद नहीं रहता।
AI-लिखित टेक्स्ट में वे अक्षर जिन्हें आप देख नहीं सकते
टेक्स्ट वह हिस्सा है जिसे ज़्यादातर क्लीनर पूरी तरह नज़रअंदाज़ कर देते हैं। कुछ मॉडल्स अपने आउटपुट में जीरो-विथ स्पेस, जीरो-विथ जॉइनर और वर्ड-जॉइनर डालते हैं — स्क्रीन पर अदृश्य, प्रिंट में अदृश्य, और कॉपी-पेस्ट के बाद भी पूरी तरह सुरक्षित। वे दिखते नहीं, लेकिन वॉटरमार्क की तरह होते हैं। यह टूल उन्हें ढूंढकर हटा देता है, और प्लेन-टेक्स्ट फ़ाइलों के लिए दो अतिरिक्त विकल्प देता है: दिखने में समान यूनिकोड अक्षरों को सामान्य बनाना, और मिलते-जुलते अक्षरों को सादा ASCII में बदलना। ये दोनों विकल्प सिर्फ टेक्स्ट फ़ाइलों पर लागू होते हैं — कभी भी छवि, PDF या Office दस्तावेज़ पर नहीं।
यह फिंगरप्रिंट पढ़ता है, फिर हटाता है
यह वह चीज़ है जो कोई अन्य मुफ्त मेटाडेटा क्लीनर नहीं करता। कुछ भी हटाने से पहले, फ़ाइल की जांच की जाती है और निशान की पहचान की जाती है, ताकि रिपोर्ट में जनरेटर का नाम लिखा जा सके, न कि सिर्फ यह कि “कुछ हटाया गया”। जब फ़ाइल अपने निर्माता का नाम देती है, तो आपको बताया जाता है कि वह कौन है: OpenAI (ChatGPT / GPT / DALL·E), Google (Gemini / Imagen), Anthropic (Claude), Adobe Firefly, Midjourney, Stability AI (Stable Diffusion), xAI (Grok), Leonardo AI, Microsoft Copilot या Black Forest Labs (FLUX)। अगर फ़ाइल के निशान इनमें से किसी का नाम नहीं देते, तब भी पूरी तरह साफ़ की जाती है — रिपोर्ट में बस लिखा होता है कि फ़ाइल में जनरेटर का नाम नहीं था।
और यह आपको बताता है जब कुछ भी छुपा हुआ नहीं था
एक क्लीनर जो हमेशा “हो गया” कहता है, वह आपको कुछ नहीं सिखाता। यह टूल वही सवाल का जवाब देता है, जो आप लेकर आए थे: क्या इस फ़ाइल में पहली बार में कोई AI फिंगरप्रिंट था? हर काम के बाद प्रति-फ़ाइल रिपोर्ट मिलती है। जिस फ़ाइल में निशान था, उसमें विक्रेता का नाम लिखा होता है और रिपोर्ट में दिखता है “इस फ़ाइल से छुपे हुए AI प्रोवेनेंस निशान हटाए गए”, और फिंगरप्रिंट का नाम भी। जिस फ़ाइल में कुछ नहीं था, उसमें Verified clean लिखा होता है और साफ़-साफ़ बताया जाता है: “इस फ़ाइल में कोई AI प्रोवेनेंस निशान नहीं मिले।” दोनों जवाब उपयोगी हैं — एक पुष्टि करता है कि निशान हट गया, दूसरा कि फ़ाइल में कभी था ही नहीं — और दोनों के साथ एक सूची भी मिलती है, साधारण भाषा में, कि क्या-क्या हटाया गया।
PDF की तस्वीरों के भीतर छिपा निशान
स्कैन किया हुआ पन्ना या एक्सपोर्ट की गई रिपोर्ट दरअसल एक तस्वीर के चारों ओर लिपटी हुई PDF ही है, और C2PA मैनिफ़ेस्ट दस्तावेज़ के अपने गुणों में नहीं, उसी तस्वीर के भीतर बैठा हो सकता है। सिर्फ़ दस्तावेज़ की परत साफ़ कर दीजिए और फ़ाइल किसी भी मेटाडेटा रीडर को बिलकुल साफ़ दिखेगी, जबकि निशान एक स्तर नीचे वहीं मौजूद रहेगा। यह टूल भीतर जुड़ी तस्वीरों को खोलता है और उन्हें भी साफ़ करता है, इसलिए जिस PDF के गुण पहले से ही खाली थे, वह भी बिना कोई निशान छोड़े वापस आती है।
कुछ भी डिकोड नहीं होता, बशर्ते निशान तस्वीर के भीतर न हो
अकेली तस्वीर में फ़ाइल कभी खोली, दोबारा बनाई या दोबारा कंप्रेस नहीं की जाती। आपका PNG अपने पिक्सल डेटा के साथ बाइट-दर-बाइट वैसा ही लौटता है और आपका JPEG अपने स्कैन डेटा के साथ अछूता: वही रंग, वही तीक्ष्णता, कोई जनरेशन लॉस नहीं। PDF अपना टेक्स्ट, फ़ॉन्ट और लेआउट बनाए रखती है, और Office दस्तावेज़ अपनी सामग्री और फ़ॉर्मैटिंग।
एक अपवाद है, और हम उसे छिपाने के बजाय नाम देना बेहतर समझते हैं। PDF के भीतर जुड़ी किसी तस्वीर में बैठे निशान तक उस तस्वीर को डिकोड करके दोबारा लिखे बिना पहुँचा नहीं जा सकता, इसलिए सिर्फ़ उसी सूरत में उसके पिक्सल बहुत हल्के से बदलते हैं और फ़ाइल आमतौर पर बड़ी हो जाती है। यह केवल वहीं होता है जहाँ सचमुच कोई निशान मिले: जो जुड़ी हुई तस्वीर पहले से साफ़ थी, वह बाइट-दर-बाइट अछूती निकल जाती है। नतीजे का पन्ना गिनता है कि कितनी तस्वीरें दोबारा एनकोड हुईं और उनके नाम बताता है, और आपकी फ़ाइल बाइट-दर-बाइट वैसी ही लौटी — यह वह तभी कहता है जब यह गिनती शून्य हो।
ईमानदार सीमा: दिखने वाला वॉटरमार्क दिखता ही रहेगा
यह टूल मेटाडेटा लेयर पर काम करता है — छुपे टैग्स, हस्ताक्षरित मैनिफेस्ट, अदृश्य अक्षर। यह लोगो, कैप्शन या ऐसा वॉटरमार्क नहीं हटाता जो आपकी तस्वीर के पिक्सेल में जला हुआ है, क्योंकि वह छवि का हिस्सा है, और उसे हटाने का मतलब फोटो को फिर से बनाना और उसकी गुणवत्ता घटाना होगा। कोई भी टूल जो कहता है कि वह दिखने वाला वॉटरमार्क बिना छवि बदले हटा सकता है, या तो कुछ नहीं कर रहा या आपको धुंधली फ़ाइल दे रहा है। अगर आपको छुपा हुआ प्रोवेनेंस डेटा और अदृश्य टेक्स्ट निशान हटाने हैं, तो आप सही जगह हैं। अगर दिखने वाला लोगो हटाना है, तो आपको मेटाडेटा क्लीनर नहीं, इमेज एडिटर चाहिए।
यह किन फ़ाइलों पर काम करता है
प्रकार फ़ाइल के अपने बाइट्स से पहचाना जाता है, एक्सटेंशन से नहीं, इसलिए गलत एक्सटेंशन वाली फ़ाइल भी सही तरीके से प्रोसेस होती है और सही फॉर्मेट में लौटती है। मूल फ़ाइल नाम सुरक्षित रहते हैं — अरबी और चीनी नाम भी — और पासवर्ड-प्रोटेक्टेड PDF को सामान्य तरीके से हैंडल किया जाता है: पासवर्ड दें और साफ़ की गई कॉपी अनलॉक होकर मिलती है।
| श्रेणी | फॉर्मेट्स |
|---|---|
| छवियाँ | PNG · JPG / JPEG · WebP · AVIF · HEIC / HEIF · GIF · BMP · TIFF · SVG |
| दस्तावेज़ | |
| ऑफ़िस | DOCX · XLSX · PPTX |
| पुस्तकें और ओपन फॉर्मेट्स | EPUB · ODT |
| टेक्स्ट | HTML · Markdown · TXT |
यह अपना काम खुद जांचता है
अधिकांश क्लीनर फ़ाइल को सेव कर देते हैं और मान लेते हैं कि काम हो गया। यह टूल अपनी आउटपुट फ़ाइल को दोबारा खोलता है और फिर से जांचता है, यह देखने के लिए कि C2PA मैनिफेस्ट और हर AI टैग जो अभी हटाया गया, वे वाकई चले गए हैं या नहीं। फ़ाइल को तभी साफ़ घोषित किया जाता है जब वे प्रमाणित रूप से हट चुके हों — यानी यहाँ “साफ़” का मतलब साबित है, वादा नहीं। अगर फ़ाइल की आंतरिक संरचना पूरी तरह से री-राइट नहीं हो पाई, तो उसे ईमानदारी से फ्लैग किया जाता है, न कि झूठी सफलता के रूप में लौटाया जाता है। रिमूवल इंजन खुद ओपन-सोर्स, MIT-लाइसेंस प्राप्त watermarks-remover प्रोजेक्ट है, इसलिए आपकी फ़ाइलों को छूने वाला सारा लॉजिक सार्वजनिक और ऑडिटेबल है, न कि कोई ब्लैक बॉक्स।
आपको क्या मिलता है
- छवियों, PDF और Office फ़ाइलों से C2PA और Content Credentials मैनिफेस्ट, XMP प्रोवेनेंस टैग्स और “Generated by” स्ट्रिंग्स हटाई जाती हैं
- AI-लिखित टेक्स्ट से अदृश्य जीरो-विथ अक्षर हटाए जाते हैं, जिनमें वे भी शामिल हैं जो कॉपी-पेस्ट के बाद भी रहते हैं
- लेखक के नाम, GPS निर्देशांक, कैमरा और डिवाइस विवरण, टाइमस्टैम्प और संपादन इतिहास एक ही बार में साफ़ किए जाते हैं
- प्रति-फ़ाइल रिपोर्ट जिसमें AI का नाम होता है — या जब कोई AI प्रोवेनेंस निशान नहीं मिलता तो फ़ाइल को Verified clean के रूप में चिह्नित किया जाता है
- अकेली तस्वीरें अपने पिक्सल डेटा के साथ बाइट-दर-बाइट वैसी ही लौटती हैं: कुछ भी डिकोड, दोबारा कंप्रेस या दोबारा तैयार नहीं होता
- PDF के भीतर जुड़ी तस्वीरों में छिपे निशान ढूँढ़कर मिटाए जाते हैं, और दोबारा एनकोड हुई हर तस्वीर रिपोर्ट में गिनी जाती है और नाम से बताई जाती है
- प्रमाणित परिणाम — सफाई के बाद आउटपुट दोबारा जांची जाती है, और फ़ाइलें एक घंटे बाद सर्वर से हटा दी जाती हैं
हाल ही में क्या बदला
3 सितंबर 2026 — टूल अब PDF के भीतर जुड़ी तस्वीरों के अंदर भी देखता है, इसलिए स्कैन किए पन्ने में छिपा AI निशान छूट जाने के बजाय मिल जाता है और हट जाता है। रिपोर्ट भी उसी समय नए सिरे से बनाई गई: अब वह दस्तावेज़ के गुणों को अलग मद के रूप में गिनाती है, बताती है कि कब किसी जुड़ी हुई तस्वीर को दोबारा एनकोड करना पड़ा, और जो उसने सचमुच हटाया नहीं, उसे अब सूची में नहीं डालती।
अब आगे क्या?
सिर्फ फोटो से कैमरा और लोकेशन डेटा हटाना है? फोटो मेटाडेटा हटाएँ यही करता है। किसी दस्तावेज़ पर काम कर रहे हैं? PDF मेटाडेटा हटाएँ PDF से लेखक, निर्माता और टाइमस्टैम्प हटाता है, और PDF फ्लैटन करें भरे हुए फ़ील्ड्स और एनोटेशन को स्थायी बना देता है, ताकि आप भेजने से पहले उन्हें पक्का कर सकें।