Strumento per immagini / 28

Immagine in testo (OCR)

Estrai il testo da una foto o da uno screenshot nel browser, in dodici lingue, senza caricarlo.

Immagine in testo (OCR): TOEA esegue un motore completo di riconoscimento ottico dei caratteri compilato in WebAssembly, legge i caratteri nell'immagine e ricompone le righe in paragrafi, così il risultato è più simile a un testo continuo. Funziona al 100% localmente nel browser, senza caricare file sul server.

Esecuzioni
Nel browser
Costo
Gratuito · senza registrazione
Disponibilità
Pronto all'uso
Area immagine → testoElaborazione locale

Funziona interamente nel browser

↥
Scegli un'immagine

PNG, JPG, WebP, or BMP · fino a 30 MB, non viene mai caricato

Scegliere la lingua

Seleziona la lingua in cui è scritto il testo prima di leggerlo. Il modello linguistico fornisce l'alfabeto e il vocabolario con cui il motore confronta le sue ipotesi: selezionare l'inglese per una pagina francese fa perdere o altera gli accenti, mentre un modello basato sull'alfabeto latino trasforma il testo cinese, giapponese, coreano, arabo o russo in parole senza senso. Per una pagina che mescola più lingue, scegli quella principale e aspettati errori nel resto.

Controllare i paragrafi uniti

Quando le righe vengono unite in paragrafi, un trattino alla fine di una riga viene interpretato come una divisione della parola e rimosso. Perciò una parola composta spezzata in quel punto, come well- seguito da known, diventa wellknown. Le righe vengono unite con uno spazio, che inserisce uno spazio a ogni interruzione di riga anche nel testo cinese o giapponese, dove non dovrebbe esserci. Disattiva l'opzione per queste lingue e per tabelle, elenchi, indirizzi e codice, dove le interruzioni di riga hanno un significato. Per un PDF scansionato, usa OCR per PDF.

Come usarlo

  1. Scegli un'immagine.
  2. Seleziona la lingua del testo.
  3. Leggi il risultato e copialo oppure scaricalo.

Privacy e limitazioni

Il tuo file non viene mai caricato. Il motore di riconoscimento e il modello linguistico vengono scaricati una volta — circa 10 MB — e memorizzati nella cache del browser; poi tutto funziona sul tuo dispositivo. I servizi OCR online funzionano al contrario: vogliono il documento.

Strumenti correlati

Domande frequenti

Perché la prima esecuzione è lenta?

La prima volta è necessario scaricare il motore e il modello linguistico, per un totale di circa 10 MB. In seguito il browser li memorizza nella cache e le esecuzioni successive si avviano immediatamente.

Quanto è preciso?

Uno screenshot nitido è generalmente quasi perfetto. Una foto scattata con il telefono a una pagina inclinata, oppure un testo piccolo o sfocato, può contenere errori. Il punteggio di affidabilità sopra il risultato ti indica quanto puoi fidarti della trascrizione; in ogni caso, è sempre utile confrontarla rileggendo il testo originale.

Riesce a leggere la scrittura a mano?

No. Il motore è addestrato sul testo stampato; la scrittura a mano è un problema diverso e produrrebbe risultati senza senso.

Cosa migliora il risultato?

Più pixel, testo più dritto e maggiore contrasto. Ritaglia l'immagine lasciando solo il testo e fotografa la pagina mantenendola piatta, senza inclinarla.

Strumento gratuito · nel browser esecuzioni · senza account