画像ツール / 28
画像からテキスト(OCR)
ブラウザ内で、アップロードせずに、写真やスクリーンショットから12言語のテキストを抽出できます。
画像からテキスト(OCR): TOEAはWebAssemblyにコンパイルされたフル機能のOCRエンジンを実行し、画像内の文字を読み取り、行を段落に再結合して、結果を自然な文章として読める形に整えます。 サーバーへのファイルアップロードは一切なく、100%ブラウザ内でローカル実行します。
- カテゴリ
- 画像ツール
- 実行回数
- ブラウザ内で
- コスト
- 無料 · 登録不要
- 提供状況
- すぐに使えます
完全にブラウザ内で実行します
PNG, JPG, WebP, or BMP · 最大30 MB、一切アップロードされません
言語を選ぶ
読み取る前に、テキストが書かれている言語を選択してください。言語モデルは文字体系と、エンジンが推測を照合する語彙を提供します。そのため、フランス語のページで英語を選ぶとアクセント記号が欠落したり崩れたりし、ラテン文字のモデルでは中国語、日本語、韓国語、アラビア語、ロシア語のテキストが意味のない文字列になります。複数の言語が混在するページでは、主な言語を選び、残りには誤りが出ることを見込んでください。
結合された段落を確認する
行を段落として結合すると、行末のハイフンは単語の分割とみなされて削除されます。そのため、well-に続いてknownと書かれた実際の複合語は、wellknownとして戻ります。行はスペースで結合されるため、中国語や日本語のテキストでも、不要なスペースがすべての改行位置に入ります。これらの言語や、改行に意味がある表、リスト、住所、コードでは、このオプションをオフにしてください。スキャンしたPDFにはPDF OCRを使ってください。
使い方
- 画像を選びます。
- テキストの言語を選びます。
- 結果を確認して、コピーまたはダウンロードします。
プライバシーと制限事項
ファイルは一切アップロードされません。認識エンジンと言語モデルは初回に一度だけ—約10 MB—ダウンロードされてブラウザにキャッシュされ、その後の処理はすべてお使いの端末上で動作します。ホスト型のOCRサービスはその逆で、彼らはドキュメントを求めます。
関連ツール
よくある質問
なぜ初回は遅いのですか?
エンジンと言語モデルを初回にダウンロードする必要があり、約10 MBあります。その後はブラウザにキャッシュされ、以降の実行はすぐに始まります。
精度はどのくらいですか?
きれいなスクリーンショットであれば、たいていほぼ完璧です。斜めから撮ったページのスマホ写真や、小さい文字やぼやけた文字では誤りが含まれます。結果の上にある信頼度スコアがどちらかを示しますし、元の画像と突き合わせて読み返す価値はいつもあります。
手書きは読めますか?
いいえ。エンジンは印刷体で学習されており、手書きは別の問題のため、意味のない結果になります。
結果を良くするには何が効きますか?
ピクセル数が多いこと、文字がまっすぐであること、コントラストが高いことです。文字だけにトリミングし、ページは斜めではなく平らな状態で撮影してください。
無料ツール · ブラウザ内で · アカウント不要