Visualizzazione post con etichetta jocr. Mostra tutti i post
Visualizzazione post con etichetta jocr. Mostra tutti i post

Pubblicato il 30/09/09 - aggiornato il  | 4 commenti :

Come estrarre testo da un'immagine con Google Docs.

Google Documenti nella battaglia per i servizi online sul tipo di Office segna un altro punto a favore di Google nei confronti dei rivali della Microsoft. Il metodo OCR consiste nell'estrapolare del testo da un'immagine. Ho già parlato di JOCR, un tool che svolge questo compito ma adesso è chiaro che da un'applicazione messa a punto da BigG ci si aspetta tutta un'altra affidabilità.

La funzionalità in effetti non è ancora pienamente disponibile ma si può già testare in una live demo messa a disposizione degli utenti, come comunicato da Google Operating System. 

Possono essere caricati file in alta risoluzione JPG, GIF o PNG fino a 10MB e Google Docs ne estrae il testo che vi è contenuto. Google comunica che l'operazione non porta via più di 40 secondi.

Per testare la funzione ho fatto uno screenshot di un post di questo blog e l'ho salvato come JPG, quindi l'ho caricato nel live-form messo a disposizione da Google Documenti. Prima di inserire l'immagine occorre effettuare l'accesso, quindi selezionare il file immagine

 

image

Cliccando su Start OCR import si effettua la conversione. Ecco accostati l'immagine ed il testo che ne è stato ricavato con questa applicazione

screenshot_articolo                       image

 

Devo dire che ci sono molti errori e che, per il momento, questa feature è certamente deludente.



Pubblicato il 22/06/09 - aggiornato il  | 6 commenti :

JOCR per estrarre del testo da immagini o da documenti in PDF che non può essere selezionato.

Può capitare di vedere del testo in un’immagine, per esempio uno screenshot, e avere la necessità di copiarlo. La cosa non è poi così semplice in quanto se tenti di selezionarlo, viene selezionata tutta l’immagine. Un discorso analogo si può fare con i file PDF.
Il programma non ha bisogno di installazione; dopo che si è aperto si sceglie la lingua del testo che si vuole estrarre quindi si seleziona la modalità di cattura tra
  • Una regione dello schermo
  • Tutto lo schermo
  • Una finestra
  • Gli appunti
Come test ho aperto una pagina di un libro nel  formato lit di Microsoft Reader

image
quindi ho scelto Region come sistema di cattura
image
Cliccando su Recognize ecco che il testo presente nella finestra catturata viene convertito in un file di testo  denominato JOCR.txt
 image
che viene salvato nella stessa cartella in cui è presente il programma. A me la prima volta è stato necessario, per completare l’operazione, inserire nel masterizzatore un disco di Office in cui avevo Word 2003.
Un programma molto interessante dall’eccellente funzionamento, che può stare in una chiavetta USB e ha una dimensione di soli 84KB.
L’esempio che ho fatto non è del tutto pertinente visto che in quel tipo di formato si poteva procedere in altro modo ma resta la sua validità per le immagini con testo all’interno e per i file PDF protetti.
Scarica JOCR -

Aggiornamento: Per funzionare correttamente JOCR deve essere aperto in un PC Windows (Win98/98SE/Me/2000/NT/XP/Vista) che abbia installato Office 2003 o superiore.