PDF nativo o scansione: qual è la differenza e perché conta
Due PDF possono sembrare identici sullo schermo ed essere completamente diversi 'sotto il cofano'. Capire se il tuo file è nativo o scansionato ti evita ore di frustrazione quando devi convertirlo, modificarlo o estrarne i dati.
Cosa cambia tra un PDF nativo e uno scansionato
Un PDF nativo nasce digitale: è stato creato esportando da Word, Excel, un gestionale o un software di fatturazione. Al suo interno il testo esiste davvero come testo: ogni lettera, ogni numero e ogni tabella sono elementi strutturati che un programma può leggere direttamente.
Un PDF scansionato, invece, è nato su carta: qualcuno ha passato il documento in uno scanner o gli ha fatto una foto. Dentro il file non c'è testo, c'è solo un'immagine del testo. Per il computer, quella fattura è indistinguibile da una fotografia di un gatto: pixel, non parole.
La prova pratica richiede 5 secondi: apri il PDF e prova a selezionare una frase con il mouse. Se il testo si evidenzia, è nativo. Se invece si crea solo un rettangolo di selezione vuoto, o si seleziona tutta la pagina come un blocco unico, stai guardando una scansione.
Perché la differenza conta quando converti
Con un PDF nativo, la conversione in Excel o Word è un'operazione di 'traduzione': i dati ci sono già, vanno solo riorganizzati nel nuovo formato. La precisione è altissima e gli errori rari.
Con una scansione, serve un passaggio in più: l'OCR (riconoscimento ottico dei caratteri), che trasforma i pixel in lettere e numeri. Qui la qualità dello strumento fa tutta la differenza:
- Una scansione dritta a 300 DPI si converte quasi perfettamente.
- Una foto storta fatta col telefono, con ombre e prospettiva, mette in crisi gli OCR tradizionali.
- Timbri, firme e sottolineature sovrapposte al testo creano caratteri ambigui.
È per questi casi difficili che Dotec EW-PDF usa un approccio ibrido: l'OCR legge i caratteri e un modello AI ne verifica la coerenza con il contesto, correggendo le letture improbabili (un prezzo di '1O0,50' con la lettera O diventa '100,50').
Come comportarsi nei due casi
Se il tuo file è nativo, puoi convertirlo con qualsiasi aspettativa di qualità: tabelle, formattazione e numeri arriveranno integri. Se è una scansione, segui queste buone pratiche: scansiona dritto e con buona luce, preferisci 300 DPI, evita fotografie quando puoi usare uno scanner.
In entrambi i casi il flusso con Dotec è identico: carichi il file nello strumento PDF → Excel o PDF → Word, il sistema riconosce da solo se serve l'OCR e ti mostra un'anteprima modificabile prima del download. Non devi sapere in anticipo che tipo di PDF hai: lo strumento si adatta, e tu controlli il risultato finale prima di scaricarlo.
Un ultimo caso particolare che vale la pena conoscere: i PDF 'ibridi' con livello di testo OCR già incorporato. Alcuni scanner aziendali salvano la scansione con un testo invisibile sovrapposto all'immagine: il file si lascia selezionare, quindi sembra nativo, ma il testo nascosto è spesso pieno di errori di riconoscimento fatti dallo scanner anni prima. Se una conversione da un file 'selezionabile' produce risultati stranamente sporchi, il colpevole è quasi sempre questo vecchio OCR di bassa qualità: in questi casi conviene trattare il file come una scansione pura e lasciare che sia uno strumento moderno a rifare il riconoscimento da zero.
Prova Dotec ora
Metti in pratica quello che hai letto: lo strumento è gratuito, funziona dal browser e non richiede registrazione.
Converti PDF nativi e scansioniLeggi anche
Come convertire un PDF scansionato in Excel