分析と広告のためのCookie
分析と広告のためにCookieを使っており、どちらもGoogleに送られます。拒否しても、目に見える動作は何も変わりません。プライバシーポリシーを読む
ここで TIFF を TXT に変換できます。無料、アカウント不要です。ファイルを上の枠に落とせば、数秒で結果がダウンロードできる状態になります。 変換はお使いのブラウザーの中で行われるので、ファイルはアップロードされません。Windows でも macOS でも Linux でも、iPhone でも Android でも同じように動き、通信を切っても動き続けます。
一度に100ファイルまで。フォーマットが混ざっていても構いません。
順番に変換し、まとめてZIPでダウンロードします。
TIFF から TXT
TIFF はほとんど偶然には生まれません。スキャナー、文書管理システム、記録管理部門、アーカイブ、FAX ゲートウェイから来て、中身は契約書、書簡、請求記録、案件ファイル、カルテ、議事録であることが多い形式です。
これは仕事の性質を変えます。写真から段落を書き写したいのではなく、大量の文書を検索可能にしたい、アーカイブから引用できるテキストを取り出したい、帳票の束から数字を拾いたい——そういう用途で、扱う分量が多く、精度も重視されます。
スマートフォンの写真を難しくする要因はすべて存在しません。ページはガラス面に平らに置かれるため遠近のゆがみがなく、照明は均一で影が落ちず、解像度は既知で一定、スキャナーは構造上つねに正しい距離に焦点を合わせています。
実際、300 dpi でスキャンされたきれいな印刷活字はほぼ完璧に読み取れます。これはこのサイトの写真向けのページでは望めない高い水準で、大量の認識作業がスマートフォンの写真ではなくスキャンから行われる理由でもあります。
まず解像度です。200 dpi を下回ると文字あたりのピクセル数が足りず、精度は急激に落ちます。300 dpi が実務上の標準で、小さな文字や状態の悪い原本には 600 dpi の価値があります。
次に原本そのものの状態です。FAX はよくある最悪のケースで、そもそも低解像度な設計のうえ、何世代ものコピーを経ていることも珍しくありません。カーボンコピー、色あせた感熱紙、印やペン書きの入った文書、活字の欠けたタイプライター書体もエラーの原因になります。傾いてスキャンされた場合は、認識の前に補正しておくべきです。
スキャナーは 1 個の TIFF に文書の全ページを収めることがよくあります。認識されるのはファイル内の最初の画像だけで、それより先に進むページ設定はありません。10 ページの文書からは 1 ページ目のテキストだけが返り、それ以上は何もありません。ほかの 9 ページについて何も告げず、出力はそこで単に止まります。
1 ファイル 1 ページでスキャンされた文書ならこれは問題になりません。束になった文書では、ページをここに来る前に分割しておくのが正直な答えです。分割は、スキャナーか記録システムの側で行うべき作業です。このページは、今すぐ読む必要がある文書のためのもので、書庫全体をデジタル化するためのものではありません。
認識は形をレターフォームと照合するだけで、文書の意味は理解しません。どこで自信がなかったかを示す手段もなく、間違いを含んでいても流暢で完成された文章として返ってきます。
記録の仕事ではこれがいっそう重みを持ちます。証券番号や日付、金額、事件番号の一桁の誤読は、ざっと読んで見過ごされやすく、あとで実害につながりやすい種類の誤りです。何かのシステムに入れる前、束ねる前、引用する前には、必ず元のページと突き合わせて確認してください。
アーカイブ用途では、プレーンテキストはスキャンを価値あるものにしていたページ自体の画像——それこそが記録です——を捨ててしまいます。検索可能な PDF ならその画像を保ったままテキスト層を裏に持たせるので、文書は見た目そのままに、印刷もでき、検索もコピーもできます。
プレーンテキストが正しい選択なのは、単語そのものを引用や索引、別の処理の入力として使いたい場合です。100 ファイルを変換する前に、どちらが本当に必要かを決めておく価値があります。この 2 つの作業は変換の直後から枝分かれします。
認識処理は開いているタブの中、あなたの端末の処理だけで行われます。アップロードがないので、サーバー側の保存も、保存期間についての問い合わせも、アカウントも、日ごとの上限もありません。
署名済みの契約書、カルテ、裁判関連書類、保険金請求書——これらのファイルによく入っている内容を考えると、これはただの機能説明ではなく、ホスト型サービスとの実質的な違いです。依頼人の文書を第三者に送るために誰かの許可が要るかどうか、という気まずい問いも同時に消えます。
| TIFF | TXT | |
|---|---|---|
| 正式名称 | Tagged Image File Format | プレーンテキスト |
| 拡張子 | .tif, .tiff | .txt, .text, .log |
| メディアタイプ | image/tiff | text/plain |
| 圧縮方式 | 可逆 — 何も捨てない | — |
| 最初の公開 | 1986 | 1963 |
| 発行元 | Adobe | — |
| 仕様 | TIFF 6.0 | Unicode |
| ライセンス | 公開仕様、標準化はされていない | オープン標準 |
| 現在の位置づけ | 現行 | 現行 |
| ビット深度 | 32 | — |
| 扱える色 | RGB, CMYK, グレースケール, Lab | — |
| ブラウザで開けるか | 一部のブラウザ | すべてのブラウザ |
| 代わりに検討される形式 | PNG, PDF, DNG | MD, RTF |
TXT は今のブラウザーならどれでも開けます。TIFF はそこまでも届きません。ファイルがウェブページや申込フォームへ向かうのであれば、たいていはそれがこの変換の理由のすべてです。
開くプログラムが重なりません。TIFF はAdobe Photoshop、Affinity Photo、ImageMagickで、TXT はNotepad、TextEdit、Visual Studio Codeで開きます。結果を渡す相手には後者のどれかが要ります。
TIFF は Adobe の形式です(1986 年に登場)。 記録は 1 チャンネルあたり 32 ビットです。
TXT は 1963 年から使われています。規定は Unicode です。Notepad、TextEdit、Visual Studio Codeがこの形式を読めます。
TXT は 1963 年、TIFF は 1986 年に登場しました。人に渡すならたいてい古いほうが安全で、新しいほうは同じ仕事をより少ないバイト数で片づけます。
いいえ。この変換は完全にブラウザーの中で行われるので、ファイルが端末から出ることはありません。ご自分で確かめられます。開発者ツールのネットワークタブを開いて、何か変換してみてください。ページそのものと、このサービスの費用をまかなっている分析・広告のリクエストは見えますが、あなたのファイルを運んでいるリクエストはひとつもありません。
はい。アカウントも透かしもなく、消費される 1 日の割り当てもありません。お使いの機械の上で動くので、何度でも戻ってきていただけます。ブラウザーが扱えるのは 100 MB までのファイルで、一度に 100 本です。
TIFF と TXT は、内容の表し方が根本から違います。ですからこの変換は複製ではなく再構築です。誠実ではありますが、1 バイトも同じというわけではありません。 文字はパターン認識で読み取られるため、これは最善の推測であって、書き起こしではありません。まっすぐで汚れのない、十分な明るさと解像度の活字ならほぼ正確に出てきますが、斜めから撮った写真、かすれたファックス、変わった書体、手書きは必ず間違いを生みます。結果を頼りにする前に、必ず原本と読み合わせてください。言語の設定は効きます——間違った言語で読み取られた文字は、エラーとしてではなく、自信たっぷりの意味不明な文章として返ってきます。
変換には要りません。すでに開いているブラウザーの中で行われます。そのあと結果を開くには、お使いの端末がふだん Plain Text を表示するのに使っているソフトが必要です。
このページがTIFFとTXTについて述べていることは検証できます。根拠となる資料は次のとおりです。