Ricerca negli archivi
Ritrovare un contratto tramite partita IVA (SIRET in Francia), clausola o importo presuppone un testo indicizzato, non solo un nome di file.
Glossario · Acquisizione
Tecnologia che converte un documento scansionato o un’immagine in testo leggibile dalla macchina, per cercarlo, estrarne i dati e archiviarlo.
Detto anche: Optical Character Recognition · riconoscimento ottico dei caratteri
L’OCR (Optical Character Recognition) riconosce i caratteri presenti in un’immagine (scansione, foto di un contratto, PDF non testuale) e produce un livello di testo. Senza OCR, un PDF «immagine» resta una fotografia: lo si vede, ma non lo si può cercare, estrarre né indicizzare. In azienda, l’OCR è la porta d’ingresso di qualsiasi automazione documentale seria.
I flussi in entrata (e-mail, posta, portali fornitori) arrivano spesso come scansioni. Senza OCR, i team reinseriscono date, importi e riferimenti, con errori e ritardi.
Ritrovare un contratto tramite partita IVA (SIRET in Francia), clausola o importo presuppone un testo indicizzato, non solo un nome di file.
L’OCR alimenta la classificazione e l’estrazione dei dati: date di scadenza, parti, importi.
Meno digitazione manuale = meno discrepanze tra il PDF e l’archivio aziendale.
L’OCR legge i caratteri; non decide il tipo di documento né la sua validità giuridica. L’approvazione resta umana.
Foto sfocate, pagine piegate o scansioni a bassissima risoluzione peggiorano il tasso di riconoscimento, e quindi tutta la pipeline a valle.
DocPilot applica l’OCR ai documenti in entrata (caricamento, e-mail, foto) per rendere il contenuto ricercabile e preparare l’estrazione assistita prima dell’approvazione.
Per approfondire il prodotto e le guide.
Metodi passo passo per fare progressi concreti.
Letture del blog DocPilot sullo stesso tema.
Pagine correlate per affinare la ricerca.
Passi all’azione
Attivi l’acquisizione DocPilot: OCR, scheda strutturata e iter di approvazione fin dalla ricezione.