Tesseract.js OCR

画像からテキストへ (OCR)

正確な多言語 OCR を使用して、スクリーンショット、スキャン、写真を編集可能なテキストにブラウザ内で変換します。

画像はデバイス上に残ります11 language options編集可能な結果

ここに画像をドロップまたは貼り付けます

JPG、PNG、WebP、GIF、または BMP · 最大 20 MB

Ctrl/⌘ + V を押してスクリーンショットを貼り付けることもできます。

画像はローカルで処理されます

ソース画像はこのブラウザの Tesseract.js Web ワーカーに直接渡され、MediaKit にはアップロードされません。 OCR コードと選択した言語モデルは必要に応じてフェッチされ、そのモデルはブラウザでキャッシュできます。

仕組み

3 つのステップでテキストを抽出する

最良の結果を得るには、コントラストがはっきりした鮮明な画像を使用し、画像に表示される言語を選択してください。

  1. 01

    画像を追加する

    テキストを含む画像をドロップ、選択、または貼り付けます。

  2. 02

    言語とレイアウトを選択してください

    メインテキストの言語と、ドキュメント、スクリーンショット、またはポスターのレイアウトを選択します。

  3. 03

    認識してエクスポートする

    OCR を実行し、編集可能な結果を​​確認して、それをコピーするか、TXT ファイルをダウンロードします。

より正確な OCR 結果を取得する

1

鮮明な画像を使用する

鮮明なテキストと均一な照明を備えた高解像度の画像は、認識しやすくなります。

2

適切な言語を選択してください

言語を選択すると、Tesseract が似たような文字を正しく解釈するのに役立ちます。

3

レイアウトを合わせる

ポスターと UI スクリーンショットにはスパース テキストを使用します。文書の段落には単一ブロックを使用します。

FAQ

よくある質問

私の画像はアップロードされていますか?

いいえ。認識はデバイス上の Web Worker で実行されます。 OCR コードと言語データのみがダウンロードされます。

どの言語がサポートされていますか?

このページには、英語、簡体字および繁体字中国語、日本語、韓国語、フランス語、ドイツ語、スペイン語、ポルトガル語、イタリア語、ロシア語のオプションが含まれています。

最初の認識が遅いのはなぜですか?

OCR エンジンと選択した言語モデルは、一度ダウンロードする必要があります。ブラウザは後で使用できるようにそれらをキャッシュできます。

OCR は元の書式を保持できますか?

OCR では有用な改行が維持されますが、複雑な列、表、フォント、および正確な間隔は手動でクリーンアップする必要がある場合があります。

関連ツール

画像の操作を続ける