Cosa fa questa operazione
Le tabelle nei PDF non sono un database. L’estrazione può unire celle, perdere intestazioni o ignorare scansioni senza testo. Lo strumento è dichiarato come euristico. I dati estratti non diventano un magazzino presso Cifradocs: lo XLSX è un elaborato a ritenzione breve. Motore spesso non disponibile sul gratuito.
Domande frequenti
Funziona su un PDF scansionato?
Di regola no, se manca il testo. In quel caso va usato prima l’OCR, quando disponibile.
Conservate i fogli estratti?
No. Segue la retention. Non è un magazzino di dati tabellari.