ブラウザ内OCR: 選択した画像はサーバーへ送らず、端末内で文字認識します。
初回ダウンロード: OCRエンジンと言語データを配信元から取得します。通信量と所要時間は言語・回線・キャッシュ状態で変わります。
画像をドラッグ&ドロップ、またはボタンから選択
JPEG、PNG、WebPの静止画、10MB・合計40MP・一辺16,384pxまで
JPEG・PNG・WebP画像から文字を抽出する端末内OCR。日本語・英語・中国語・韓国語、信頼度・ブロック詳細、コピー、中止に対応。画像はサーバーへ送信しません。
ブラウザ内OCR: 選択した画像はサーバーへ送らず、端末内で文字認識します。
初回ダウンロード: OCRエンジンと言語データを配信元から取得します。通信量と所要時間は言語・回線・キャッシュ状態で変わります。
画像をドラッグ&ドロップ、またはボタンから選択
JPEG、PNG、WebPの静止画、10MB・合計40MP・一辺16,384pxまで
OCR(Optical Character Recognition)は、画像内の文字をコピーできるテキストへ変換する技術です。紙書類のスキャン画像、写真、スクリーンショットなどから文字を抽出できます。
本ツールはTesseract.jsを使用します。選択した画像と認識結果はサーバーへ送信せず、ブラウザ内で処理します。
拡張子やブラウザの申告形式だけでなく、ファイル内容を確認してから読み込みます。アニメーション画像、PDF、TIFF、BMPは直接入力できません。PDFは対象ページをJPEG・PNG・WebPへ変換してから使用してください。
認識処理の開始時に、OCRエンジン(WebAssembly)と言語学習データを配信元からダウンロードします。通信量と待ち時間は、選択言語、回線、ブラウザのキャッシュ状態、配信内容によって変わります。
画像そのものは言語データの配信元へ送信されません。処理が長い場合は「中止」で止められ、失敗や中止の後も同じ画像で再実行できます。
日本語、英語、日本語+英語、中国語(簡体字)、韓国語を選択できます。認識後は全文、全体の信頼度、検出したテキストブロック数を表示し、複数ブロックがある場合は各ブロックの文字と信頼度も確認できます。
信頼度は認識結果の目安であり、正確性を保証するものではありません。固有名詞、金額、日付、契約内容など重要な文字は、必ず元画像と照合してください。