画像ツール / 28

画像からテキスト(OCR)

ブラウザ内で、アップロードせずに、写真やスクリーンショットから12言語のテキストを抽出できます。

画像からテキスト(OCR): TOEAはWebAssemblyにコンパイルされたフル機能のOCRエンジンを実行し、画像内の文字を読み取り、行を段落に再結合して、結果を自然な文章として読める形に整えます。 サーバーへのファイルアップロードは一切なく、100%ブラウザ内でローカル実行します。

カテゴリ
画像ツール
実行回数
ブラウザ内で
コスト
無料 · 登録不要
提供状況
すぐに使えます
画像→テキスト デスクローカル処理

完全にブラウザ内で実行します

↥
画像を選択

PNG, JPG, WebP, or BMP · 最大30 MB、一切アップロードされません

言語を選ぶ

読み取る前に、テキストが書かれている言語を選択してください。言語モデルは文字体系と、エンジンが推測を照合する語彙を提供します。そのため、フランス語のページで英語を選ぶとアクセント記号が欠落したり崩れたりし、ラテン文字のモデルでは中国語、日本語、韓国語、アラビア語、ロシア語のテキストが意味のない文字列になります。複数の言語が混在するページでは、主な言語を選び、残りには誤りが出ることを見込んでください。

結合された段落を確認する

行を段落として結合すると、行末のハイフンは単語の分割とみなされて削除されます。そのため、well-に続いてknownと書かれた実際の複合語は、wellknownとして戻ります。行はスペースで結合されるため、中国語や日本語のテキストでも、不要なスペースがすべての改行位置に入ります。これらの言語や、改行に意味がある表、リスト、住所、コードでは、このオプションをオフにしてください。スキャンしたPDFにはPDF OCRを使ってください。

使い方

  1. 画像を選びます。
  2. テキストの言語を選びます。
  3. 結果を確認して、コピーまたはダウンロードします。

プライバシーと制限事項

ファイルは一切アップロードされません。認識エンジンと言語モデルは初回に一度だけ—約10 MB—ダウンロードされてブラウザにキャッシュされ、その後の処理はすべてお使いの端末上で動作します。ホスト型のOCRサービスはその逆で、彼らはドキュメントを求めます。

関連ツール

よくある質問

なぜ初回は遅いのですか?

エンジンと言語モデルを初回にダウンロードする必要があり、約10 MBあります。その後はブラウザにキャッシュされ、以降の実行はすぐに始まります。

精度はどのくらいですか?

きれいなスクリーンショットであれば、たいていほぼ完璧です。斜めから撮ったページのスマホ写真や、小さい文字やぼやけた文字では誤りが含まれます。結果の上にある信頼度スコアがどちらかを示しますし、元の画像と突き合わせて読み返す価値はいつもあります。

手書きは読めますか?

いいえ。エンジンは印刷体で学習されており、手書きは別の問題のため、意味のない結果になります。

結果を良くするには何が効きますか?

ピクセル数が多いこと、文字がまっすぐであること、コントラストが高いことです。文字だけにトリミングし、ページは斜めではなく平らな状態で撮影してください。

無料ツール · ブラウザ内で · アカウント不要