आँकड़ों और विज्ञापन के लिए कुकीज़
हम आँकड़ों और विज्ञापन के लिए कुकीज़ इस्तेमाल करते हैं, दोनों Google को जाती हैं। मना करने से आपको दिखने वाली किसी चीज़ में कोई फ़र्क़ नहीं पड़ता।निजता पेज पढ़ें
यहाँ आप GIF को TXT में बदलते हैं, मुफ़्त और बिना खाते के: फ़ाइल ऊपर छोड़िए और कुछ ही सेकंड में नतीजा डाउनलोड के लिए तैयार मिलेगा। कन्वर्ज़न आपके अपने ब्राउज़र के भीतर होता है, इसलिए फ़ाइल कभी अपलोड नहीं होती। यह Windows, macOS और Linux पर वैसे ही चलता है जैसे iPhone और Android पर, और कनेक्शन काट देने पर भी चलता रहता है।
एक बार में 100 फ़ाइलें। फ़ॉर्मेट अलग-अलग हों तो भी चलेगा।
ये एक के बाद एक बदलती हैं और साथ में एक ZIP बनकर उतरती हैं।
GIF से TXT
शब्दों वाली लगभग हर GIF एक screen capture है। पुराने screenshot टूल डिफ़ॉल्ट रूप से GIF बनाते, फ़ोरम सॉफ़्टवेयर अपलोड को इसमें बदल देता, और बीस साल के कई support ticket में error dialog की GIF लगी होती है।
यही इतिहास इस रूपांतरण को उपयोगी और किसी scan से पढ़ने से मुश्किल भी बनाता है। GIF बना screenshot वह palette कटौती झेल चुका है जो PNG बना screenshot नहीं झेलता, और टेक्स्ट इसके सबसे संवेदनशील सामग्री है।
पहचानने वाला इंजन फ़ाइल को सीधे पढ़ता है, और इसकी दस्तावेज़ीकृत फ़ॉर्मेट सूची non-animated GIF को कवर करती है। कोई screenshot, कोई captured dialog — सब यहाँ पढ़ी जा सकती हैं।
एनिमेटेड GIF इससे बाहर है। किसी frame का अंदाज़ा लगाने की बजाय, ईमानदार रास्ता एक अतिरिक्त कदम है — GIF को PNG में बदलिए, जो पहला frame लेता है, और उसे इस टूल से गुज़ारिए।
Screen text anti-aliased होता है — हर glyph के किनारे बीच के shades में खींचे जाते हैं ताकि रेखाएँ चिकनी दिखें। GIF के पास काम करने को 256 रंग हैं, और जब कोई screenshot उस palette तक घटाया जाता है, बीच के shades पहली शिकार बनते हैं।
Recognition किसी अक्षर की आकृति को उसकी सीखी हुई आकृति से मिलाता है, और alternating pixels से किनारे वाली रेखा एक अलग आकृति है। यही वजह है GIF screenshot PNG screenshot से थोड़ा कमज़ोर पढ़ी जाती है।
इस साइट पर हर दूसरा image रूपांतरण पहले तस्वीर को raw pixels में डिकोड करता है। यह जान-बूझकर नहीं करता — फ़ाइल बिना छुए दी जाती है, क्योंकि पहचानने वाले का अपना loader है और canvas से गुज़ारना transparent चीज़ों को काला कर देता।
सफ़ेद काग़ज़ के scan पर यह एक ही बारीकी पढ़ने लायक़ पेज और काले rectangle में फ़र्क़ करती है, और यह जानना ज़रूरी है अगर आपकी GIF का background transparent है।
चार भाषा मॉडल उपलब्ध हैं — English, German, French, Spanish। यह setting चुनाव है, अंदाज़ा नहीं, क्योंकि अंदाज़ा लगाना ख़ुद एक अनुमान है और ग़लत अनुमान अदृश्य होगा।
ग़लत चुनाव विफल नहीं होता। यह ऐसा टेक्स्ट देता है जो सहज-दिखने वाले शब्दों जैसा है, ग़लत भाषा में, आकृतियों को उस शब्दावली पर मैप करते हुए जो मॉडल के पास है।
जो वापस आता है वह पहचानने वाले ने जिन खाली लाइनों को blocks के बीच देखा, उनके साथ लाइनों की एक श्रृंखला है, और कोई और processing नहीं। कुछ भी उन ख़ाली जगहों को जोड़ता, या लाइनों को reflow नहीं करता।
यहाँ हर tidying कदम layout के बारे में एक अंदाज़ा है। एक कविता, पता ब्लॉक, कोड सैंपल और table — सब अपना अर्थ खो देते हैं अगर उनकी line breaks फिर से जमाई जाएँ।
पहचानने वाले को शुरू करने का मतलब है कई megabytes WebAssembly डाउनलोड और compile करना और फिर भाषा मॉडल। यह recognition शुरू होने से पहले सेकंडों का इंतज़ार है।
यह एक बार होता है। मॉडल आपकी मशीन पर पहले run के बाद कैश हो जाता है, इसलिए दूसरी GIF लगभग तुरंत शुरू होती है, और बीस की batch पूरी लागत एक बार चुकाती है, बीस बार नहीं।
मूल रूप से हस्तलेख। कोण पर टेक्स्ट, busy background पर टेक्स्ट, बहुत छोटा टाइप, decorative typeface — सब कुछ अक्षरों से पूरी बकवास तक की गलतियाँ पैदा करेंगे।
दूसरा मामला वह GIF है जिसे screenshot लेने के बाद छोटा किया गया। screenshot को आधा करना glyph आकृतियों को इस तरह नष्ट करता है कि कोई पहचानने वाला उसे वापस नहीं ला सकता।
पहचानने वाला, उसका WebAssembly core और हर भाषा मॉडल इसी साइट से परोसे जाते हैं, किसी सार्वजनिक CDN से नहीं मँगाए जाते। किसी payslip, medical letter या निजी बातचीत को screenshot से पढ़ने वाले को यह किसी तीसरे पक्ष को घोषित नहीं होना चाहिए।
Recognition आपके ब्राउज़र में होती है, कोई अकाउंट नहीं है, और टेक्स्ट कभी store नहीं किया जाता।
| GIF | TXT | |
|---|---|---|
| पूरा नाम | Graphics Interchange Format | सादा पाठ |
| फ़ाइल एक्सटेंशन | .gif | .txt, .text, .log |
| मीडिया टाइप | image/gif | text/plain |
| कंप्रेशन | बिना नुक़सान — कुछ छोड़ा नहीं जाता | — |
| पहली बार प्रकाशित | 1987 | 1963 |
| प्रकाशक | CompuServe | — |
| विनिर्देश | GIF89a | Unicode |
| लाइसेंस | खुला मानक | खुला मानक |
| आज की स्थिति | पुराना, फिर भी हर जगह पढ़ा जाता है | मौजूदा |
| बिट डेप्थ | 8 | — |
| रंग जो यह दर्ज कर सकता है | इंडेक्स्ड पैलेट | — |
| सबसे बड़ी इमेज | हर तरफ़ 65,535 px | — |
| ब्राउज़र में खुलता है | हर ब्राउज़र | हर ब्राउज़र |
| इसकी जगह विचारणीय | WebP, MP4 | MD, RTF |
TXT काम करने का फ़ॉर्मेट है और GIF बनकर तैयार फ़ॉर्मेट। जो लौटता है वह पन्ने की तस्वीर नहीं बल्कि बदली जा सकने वाली लिखावट है — आम तौर पर यही इस कन्वर्ज़न की वजह होती है, और यही इसकी सीमा भी।
GIF 1987 का है और अब मुश्किल से ही इस्तेमाल होता है। TXT वह है जो आज के प्रोग्राम लिखते हैं, इसलिए यह कन्वर्ज़न पढ़े जाते रहने का भी सवाल है।
दोनों तरफ़ के प्रोग्राम अलग हैं: GIF फ़ाइल GIMP, Adobe Photoshop और ImageMagick में खुलती है और TXT फ़ाइल Notepad, TextEdit और Visual Studio Code में — यानी नतीजा जिसके पास जाएगा, उसे दूसरी सूची में से कोई प्रोग्राम चाहिए होगा।
दोनों का निशाना अलग काम है: GIF का वेब पर, TXT का प्रोग्रामों के बीच डेटा ले जाना और सहेजना पर। इस पर सोचना बनता है, क्योंकि जिस वजह से एक मौजूद है, आम तौर पर उसी वजह से दूसरा असुविधाजनक होता है।
GIF CompuServe का फ़ॉर्मेट है, जो 1987 में आया। यह हर चैनल पर 8 बिट में दर्ज करता है।
TXT 1963 से चला आ रहा है, और Unicode में तय किया गया है। Notepad, TextEdit और Visual Studio Code इस फ़ॉर्मेट को पढ़ लेते है।
TXT 1963 में आया और GIF 1987 में। किसी को सौंपने के लिए आम तौर पर पुराना वाला ज़्यादा सुरक्षित रहता है; नया वाला वही काम कम बाइट में कर देता है।
नहीं। यह कन्वर्ज़न पूरी तरह आपके ब्राउज़र में होता है, इसलिए फ़ाइल आपके डिवाइस से बाहर नहीं जाती। आप ख़ुद जाँच सकते हैं: डेवलपर टूल्स का नेटवर्क टैब खोलिए और कुछ बदल कर देखिए। आपको पेज ख़ुद दिखेगा और आँकड़ों तथा विज्ञापन के वे अनुरोध दिखेंगे जिनसे इस सेवा का ख़र्च निकलता है — और एक भी ऐसा अनुरोध नहीं जो आपकी फ़ाइल साथ ले जा रहा हो। इस जोड़ी के पीछे Tesseract है, ओपन सोर्स अक्षर-पहचान; आपका ब्राउज़र इसे एक बार उतारता है और फिर सहेज कर रखता है।
हाँ। न खाता, न वॉटरमार्क, और न कोई रोज़ का कोटा जो ख़त्म हो: यह आपकी अपनी मशीन पर चलता है, इसलिए आप जितनी बार चाहें लौट सकते हैं। ब्राउज़र 100 MB तक की फ़ाइलें सँभालता है, एक बार में 100। Tesseract आपकी अपनी मशीन पर उतरता है और वहीं चलता है — इसीलिए उस पर कोई गिनती नहीं है।
GIF और TXT सामग्री का वर्णन बुनियादी तौर पर अलग-अलग तरीक़ों से करते हैं। इसलिए यह कन्वर्ज़न नक़ल नहीं, पुनर्निर्माण है: ईमानदार, पर बाइट-दर-बाइट एक जैसा नहीं। लिखावट पैटर्न पहचान से पढ़ी जाती है, इसलिए यह सोच-समझकर लगाया अंदाज़ा है, नक़ल नहीं। साफ़, सीधी, ठीक रोशनी वाली छपाई अगर ठीक-ठाक रिज़ॉल्यूशन में हो तो लगभग सटीक निकलती है; टेढ़ी खींची फ़ोटो, धुँधला फ़ैक्स, अनोखा टाइपफ़ेस या हाथ की लिखावट ग़लतियाँ देंगे। भरोसा करने से पहले नतीजे को हमेशा असली के साथ मिलाकर पढ़िए। भाषा की सेटिंग मायने रखती है — ग़लत भाषा से पढ़ी गई लिखावट ग़लती के रूप में नहीं, आत्मविश्वास से भरी बकवास के रूप में लौटती है।
TXT काम करने का फ़ॉर्मेट है और GIF बनकर तैयार फ़ॉर्मेट। जो लौटता है वह पन्ने की तस्वीर नहीं बल्कि बदली जा सकने वाली लिखावट है — आम तौर पर यही इस कन्वर्ज़न की वजह होती है, और यही इसकी सीमा भी।
इस पेज पर GIF और TXT के बारे में जो कहा गया है, वह जाँचा जा सकता है, और ये रहे वे दस्तावेज़ जो उसे तय करते हैं।