Carica un PDF con tabelle — un listino, un estratto conto, un report, anche scansionato. Ricevi un file Excel ordinato, con righe e colonne al posto giusto, pronto da filtrare e rielaborare. E se nel file manca qualcosa che abbiamo perso noi leggendo le pagine, il file ti arriva lo stesso e non lo paghi.
Esempio di risultato reale
Scarica l'Excel di questo esempio Il file vero, 3 fogli: «Dati estratti», «Riepilogo», «Info». 8 KB, senza registrarti.
Costo: 2 crediti · ≈ €1,80 per elaborazione. La prima elaborazione è gratuita con i crediti di benvenuto. Se poi vuoi continuare, la ricarica minima è di €3,90; i crediti non scadono. I crediti vengono trattenuti all'avvio e restituiti per intero se l'elaborazione non riesce.
- Se l'elaborazione fallisce, i crediti tornano indietro da soli.
- Il file caricato resta privato, fuori dal web, e viene eliminato automaticamente: subito dopo un'elaborazione riuscita, entro pochi giorni in ogni altro caso.
- Ogni risultato passa controlli automatici, con livello di confidenza indicato.
- Questo strumento invia a OpenAI le immagini delle pagine se il file è una foto o una scansione, e il testo estratto dal documento solo quando la lettura sui nostri server è incerta. Dettagli in Trattamento dati & AI.
Serve un account gratuito: con i crediti di benvenuto la prima elaborazione è offerta. Registrati in 30 secondi
Cosa fa
Estrae le tabelle contenute in un PDF e le converte in un foglio Excel. Su un estratto conto le uscite e le entrate restano in due colonne distinte, anche quando le entrate sono poche, e la descrizione che la banca stampa su più righe — l’esercente sotto «PAGAMENTO POS», l’ordinante e la causale sotto un bonifico — resta intera nella cella del suo movimento. Riconosce intestazioni, righe e colonne anche quando l’impaginazione del PDF le spezza su più pagine. I numeri restano numeri: prezzi e quantità arrivano in celle calcolabili, non come testo. Anche i negativi scritti come li stampano gestionali e bilanci — col meno in coda, «1.234,56-», o fra parentesi, «(1.234,56)» — arrivano come numeri negativi: la colonna si somma senza ritoccarla a mano. Le date diventano date di Excel: le date di un estratto conto si ordinano dalla più vecchia alla più recente, si filtrano per mese e si raggruppano in una tabella pivot. Vale anche quando il mese è scritto a lettere, come «01 set 2026» nell’estratto conto di Trade Republic o «02-AGO-2026» in un gestionale: le date arrivano come date, e la descrizione su più righe resta intera nel suo movimento. E se una colonna che il documento porta non viene letta in nessuna riga, il risultato non si dichiara completo: te la nominiamo, e le celle restano vuote invece di essere indovinate.
Sugli estratti conto: categorie e riepilogo
Quando il PDF è un estratto conto — una colonna di date e gli importi in due colonne, entrate e uscite (o dare e avere), oppure in una sola colonna di importi col segno in cui almeno metà dei movimenti sono spese in negativo, come di solito sul conto corrente — il file Excel ha in più due cose. La colonna «Categoria» su ogni movimento, scelta fra 36 categorie: Supermercati, Carburante, Utenze, Trasporti, Ristoranti e bar, Abbonamenti digitali, Acquisti online, Affitto e mutuo, Tasse e imposte, Commissioni bancarie, Stipendio e pensione, Bonifici, Prelievi, Casa e fai da te, Abbigliamento e scarpe, Salute, Tempo libero e sport, Viaggi e vacanze, Auto e moto e altre, assegnate con regole fisse sulle parole della descrizione («Esselunga» è Supermercati, «F24» è Tasse e imposte, «Decathlon» è Tempo libero e sport). Per una partita IVA ci sono anche «Incassi POS e online» (gli accrediti del POS, di SumUp, Satispay, Stripe o PayPal), «Professionisti» (commercialista, notaio, avvocato) e «Carte di credito e ricariche», dove finiscono il saldo mensile della carta di credito e le ricariche delle prepagate, che non sono spese fatte in un negozio. Quello che nessuna regola riconosce resta «Da classificare», e la categoria la scegli tu. E il foglio «Riepilogo»: entrate, uscite e differenza mese per mese, le uscite per categoria con la loro quota, le cinque spese più alte e, se il documento riporta il saldo iniziale e il saldo finale o una colonna del saldo, il controllo che il saldo iniziale più le entrate meno le uscite dia il saldo finale; con la colonna del saldo ti diciamo anche la prima riga in cui non torna. Nella pagina del risultato lo leggi subito, sopra l’anteprima: quanto è uscito, dove (con una barra per ciascuna delle categorie più grandi) e se il saldo torna. I numeri del riepilogo sono valori, non formule: se correggi una categoria, rifai il conto con una tabella pivot. Le righe di saldo e di totale che la banca stampa fra i movimenti — il saldo iniziale nella colonna delle entrate, il saldo finale, «Totale movimenti» — restano nel file dove le scrive il documento, ma nella colonna «Categoria» portano «Saldo, non è un movimento» o «Totale, non è un movimento»: con un filtro su quella colonna le togli, e la somma delle entrate e delle uscite torna quella del foglio «Riepilogo». Le categorie le assegna il nostro codice: per classificarle, le descrizioni non vengono mandate a nessun servizio esterno. L’estratto della carta di credito, dove gli acquisti sono positivi e il pagamento del saldo è negativo, resta una conversione normale, senza categorie né riepilogo: con i segni rovesciati le spese diventerebbero entrate.
Per chi è
Per chi riceve documenti in PDF e li deve rilavorare in Excel: chi porta l’estratto conto della banca in Excel per la prima nota o per il commercialista, uffici acquisti, amministrazione, commerciali che ricevono listini e conferme d’ordine dai fornitori.
Come funziona
- Carichi il PDF, anche scansionato, o la foto della tabella (fino a 15 MB).
- Il sistema individua le tabelle e ne estrae il contenuto.
- Un controllo di qualità verifica coerenza di righe e colonne.
- Scarichi il file Excel dalla pagina o dalla tua dashboard.
Input supportati
PDF generati al computer (listini, estratti conto, report) e anche PDF scansionati: le pagine che sono solo un’immagine le leggiamo come immagini, fino a cinque pagine per elaborazione, allo stesso prezzo. Puoi caricare anche la foto di una tabella scattata col telefono (JPG, PNG, HEIC). Quando le righe vengono da un’immagine il riepilogo lo dice e ti chiede di ricontrollare importi e date sull’originale: una stampa sbiadita o storta si legge peggio di un file digitale, e una cifra che non si legge resta scritta «[illeggibile]», mai indovinata. Se la scansione ha più di cinque pagine leggiamo le prime cinque e il risultato ti dice da quale pagina ripartire; se da un’immagine non esce abbastanza testo il lavoro viene segnalato come non riuscito e non ti viene addebitato nulla. Un PDF in parte digitale e in parte scansionato, con le tabelle nelle pagine digitali, viene invece elaborato e addebitato a partire dal testo digitale: in quel caso il risultato ti dice quali pagine non contenevano testo selezionabile e che il loro contenuto non è in questo risultato, invece di dichiararsi completo — caricale da sole come lavoro separato e le leggiamo come scansione. Se invece la parte digitale non contiene tabelle — per esempio è generata al computer solo la copertina, e il resto è scansionato — lo leggiamo come scansione, con lo stesso tetto di cinque pagine. I PDF protetti da password vengono rifiutati allo stesso modo: senza la password le pagine non si aprono, l’elaborazione si ferma subito e non ti viene addebitato nulla. Apri il file con la sua password, salvane una copia senza protezione e carica quella. Ogni elaborazione legge al massimo le prime 80 pagine del PDF e, dentro quelle, circa 280.000 caratteri di testo. I due tetti mordono nello stesso punto su un documento di densità ordinaria: ottanta pagine portano circa 280.000 caratteri. Solo su un documento molto più fitto della media — un computo metrico, un allegato a righe serrate — è il limite sui caratteri ad arrivare per primo, e la lettura si ferma prima dell’ottantesima pagina. Il risultato dichiara sempre a quale pagina la lettura si è fermata, e il messaggio ti dice da quale pagina ripartire. Quando il documento prosegue oltre il taglio la parte letta ti viene consegnata lo stesso, con il taglio dichiarato: il lavoro si conclude e i crediti restano spesi, anche se i dati che cercavi stavano oltre. In entrambi i casi puoi caricare come lavoro separato un PDF con le sole pagine che ti servono.
C’è una seconda perdita possibile, indipendente da questi due tetti: dentro le pagine lette l’estrazione assistita dall’intelligenza artificiale può smettere di elencare prima della fine, restituendo righe giuste ma poche. Ce ne accorgiamo confrontando il risultato consegnato con due letture indipendenti dello stesso documento: la griglia che legge le tabelle riga per riga e, quando la griglia non riconosce la struttura del documento, il conteggio delle righe del testo estratto che hanno la forma di una riga di tabella. Quando una delle due si scosta dal risultato, il file lo dichiara con entrambi i conteggi e si considera incompleto. Non è una garanzia — su un documento fatto in prevalenza di prosa, con qualche tabella dentro, nessuna delle due letture sa dire quante ne dovevano tornare, e una perdita lì non te la segnala nessuno: conta sempre le righe del file contro l’originale prima di importarle. In questo caso il file ti arriva lo stesso e non lo paghi: la perdita è nostra, e i crediti ti tornano indietro. Ricaricare il PDF a blocchi di poche pagine per volta è il modo più efficace per recuperare le righe mancanti.
C’è infine un tetto che non riguarda il documento ma la nostra risposta: le righe tornano indietro in un’unica risposta del modello, e quella risposta ha uno spazio finito. Un documento che ne contiene moltissime lo esaurisce. Se lo esaurisce prima che ne arrivi una parte utilizzabile, il lavoro viene segnalato come non riuscito, il messaggio ti dice che il documento contiene più voci di quante riusciamo a restituirne in una volta sola e non ti viene addebitato nulla; se lo esaurisce dopo, il risultato ti viene consegnato con il taglio dichiarato fra le note, e non lo paghi: i crediti ti tornano indietro. In entrambi i casi il gesto è lo stesso: caricare il PDF a blocchi di poche pagine per volta.
Risultato
Un file .xlsx con un foglio per tabella, intestazioni riconosciute e un riepilogo di righe e colonne estratte. In pagina vedi un’anteprima delle prime righe. Le righe che nel documento stanno da sole, senza una griglia accanto — il titolo, una nota, l’intestazione di una categoria come «Bibite fredde» in mezzo a un listino — non diventano una colonna: restano fuori dalle righe di dati. Non ci finiscono le righe che continuano la descrizione di un movimento: quelle restano nella cella del movimento. Il riepilogo le elenca una per una, con il testo che il documento riporta, e le ripete nel foglio «Info» del file: così sai che cosa è rimasto fuori senza riaprire il PDF. Quando sono troppe per stare in una nota leggibile, il riepilogo dice quante ne restano fuori dall’elenco: il numero complessivo non viene mai taciuto.
Limiti
Tabelle con celle unite in modo molto irregolare possono richiedere una verifica manuale. Lo spazio fra le migliaia, «€ 1 559,62», lo leggiamo quando il PDF scrive l’importo tutto d’un pezzo; se invece lo stampa a pezzi separati non sappiamo distinguerlo da due colonne accostate, e piuttosto che inventare un prezzo mille volte più grande lasciamo la cella com’è scritta, come testo: il riepilogo — e il foglio «Info» del file — dichiara che a non averlo letto siamo stati noi, quante celle sono e in quale colonna stanno. Le righe di riepilogo scritte in una colonna di date, come «Totale movimenti» o «Saldo finale al 31/08/2026» in fondo a un estratto conto, restano testo e le date sopra si convertono lo stesso. Una colonna di date resta invece tutta testo, com’è scritta, se una sua cella ha la forma di una data ma non lo è — «31/02/2026», «07/25/2026» scritto col mese per primo, «01/07» senza anno: meglio una data che non si ordina che una data inventata. C’è poi un caso che il riepilogo non segnala: quando il testo di una cella è così lungo da sconfinare per più di otto millimetri dentro la colonna accanto, le due celle possono arrivare unite in una sola e quella accanto restare vuota. Sono i punti in cui anche il PDF, guardato da vicino, mostra le due scritte sovrapposte; sotto quella misura le colonne vengono separate lo stesso. Il riepilogo indica sempre il livello di confidenza dell’estrazione.
Privacy e dati
Il PDF caricato viene conservato in un’area privata non accessibile dal web, usato solo per l’elaborazione ed eliminato automaticamente: subito dopo un’elaborazione riuscita, entro due giorni se l’elaborazione fallisce (in quel caso il file serve a capire cosa non ha funzionato). Il file Excel generato resta scaricabile dalla tua dashboard per 14 giorni, poi viene eliminato. I contenuti non vengono usati per addestrare modelli.
Domande frequenti
Quante pagine può avere il PDF?
I limiti sono quattro e vale il primo che scatta: 15 MB di file, le prime 80 pagine, circa 280.000 caratteri di testo dentro quelle pagine e lo spazio della risposta con cui il modello restituisce le righe — l’unico che non dipende da quanto è lungo il documento ma da quante righe contiene. I due tetti mordono nello stesso punto su un documento di densità ordinaria: ottanta pagine portano circa 280.000 caratteri. Solo su un documento molto più fitto della media — un computo metrico, un capitolato a righe serrate — è il limite sui caratteri ad arrivare per primo, e la lettura può fermarsi prima dell’ottantesima pagina. Il riepilogo dichiara sempre a quale pagina la lettura si è fermata e quante pagine ha il documento: se i due numeri non coincidono, il file non contiene tutto. Indica anche quante pagine contenevano tabelle; quando l’estrazione viene assistita dall’AI quel conteggio non è misurabile, e il riepilogo lo dichiara invece di indovinarlo.
Il mio estratto conto è una scansione: funziona?
Sì. Se le pagine del PDF sono immagini — una scansione, un documento fotocopiato, la foto di un listino — le leggiamo come immagini, fino a cinque pagine per elaborazione, e le righe arrivano nel file Excel come per un PDF digitale, al prezzo di sempre. Ci vuole un po’ di più: circa mezzo minuto per pagina. Il riepilogo ti dice che le righe vengono da un’immagine: ricontrolla importi e date sull’originale, e dove una cifra non si leggeva trovi «[illeggibile]» invece di un numero inventato. Se hai anche il PDF originale scaricato dalla banca o dal gestionale, carica quello: si legge meglio di qualunque scansione.
Pago anche se il file è incompleto?
Dipende da chi ha perso le righe. Se il documento va oltre un limite scritto qui sopra — le 80 pagine, i circa 280.000 caratteri, le cinque pagine scansionate, le pagine senza testo di un PDF in parte scansionato — ricevi la parte letta e la paghi: quanto leggiamo lo sai prima di caricare. Se invece qualcosa lo abbiamo perso noi dentro le pagine lette — la risposta del modello finita prima della fine dell’elenco, due letture che non coincidono, una colonna mai riempita, frammenti rimasti fuori dalle colonne, un totale letto nella scansione e non arrivato nel file — il file ti arriva lo stesso, il riepilogo lo dice con le parole «non te lo facciamo pagare» e i crediti ti tornano indietro. Nel registro dei crediti trovi il movimento come «File incompleto per una nostra lettura, non addebitato».
Cosa succede se l’estrazione non riesce?
Se il risultato non supera i controlli automatici di qualità, il lavoro viene marcato come non riuscito e i crediti non vengono addebitati. La causa più frequente su un documento lungo è il tetto della risposta: il documento contiene più righe di quante riusciamo a restituirne in una volta sola, e l’estrazione si interrompe prima della fine — preferiamo dirtelo invece di consegnarti un risultato parziale spacciato per completo. Quando riconosciamo quel caso il messaggio lo dice per nome; il gesto che lo risolve è sempre lo stesso, caricare il PDF a blocchi di poche pagine per volta.