Convertire PDF in testo
Convertire PDF in testo con un clic: trascina il PDF, fai clic su «Estrai testo» ed è fatta. Le righe spezzate tornano paragrafi puliti e il riconoscimento del testo (OCR) legge le pagine scansionate. Tutto avviene nel tuo browser: il file non viene caricato.
Fonte: Adobe – ISO 32000-1:2008 Document management – Portable document format (PDF 1.7). Aggiornato al: .
Come si calcola
Copiare il testo da un PDF spesso finisce nel caos: a capo in mezzo alla frase, parole spezzate («docu-mento»), colonne mescolate. Questo strumento legge il livello di testo del PDF con pdf.js, raggruppa i frammenti in righe secondo la loro posizione sulla pagina e li unisce in paragrafi. Puoi modificare il risultato, copiarlo o salvarlo come file TXT (UTF-8).
Come funziona
- Trascina o scegli un PDF.
- Scegli il formato del testo: «Paragrafi» dà testo continuo da rielaborare, «Righe come nel PDF» conserva ogni a capo, utile per indirizzi, poesie o elenchi.
- Se vuoi, spunta «Segna i cambi pagina» per avere «--- Pagina 3 ---» prima di ogni pagina.
- Fai clic su «Estrai testo», controlla, copia o salva. Le opzioni si possono cambiare dopo senza rileggere il PDF.
PDF scansionati: riconoscimento del testo (OCR)
Una scansione è un’immagine senza livello di testo. Se una pagina ha meno di 20 caratteri, lo strumento la disegna a circa 300 dpi e la fa leggere a Tesseract, lo stesso motore OCR libero usato da Testo da immagine. Scegli la lingua del documento. Servono alcuni secondi per pagina; con scansioni nitide è molto preciso, con scrittura a mano o fotocopie scadenti no.
Limiti
- Tabelle e impaginazioni a più colonne vengono lette riga per riga e le colonne possono mescolarsi. Per un documento modificabile con titoli usa PDF in DOCX.
- Alcuni PDF usano font senza tabella dei caratteri: compaiono quadratini o simboli strani. In quel caso spunta «Leggi tutte le pagine con l’OCR».
- I PDF protetti si aprono con la password; lo strumento non aggira la protezione dalla copia.
Privacy
Il PDF resta sul tuo dispositivo. Da questo sito vengono caricati solo il motore PDF e, se serve, l’OCR: nessun servizio esterno vede il documento. Per testo strutturato (appunti, IA) c’è PDF in Markdown.
Domande frequenti
Come si converte un PDF in testo gratis?
Trascina qui il PDF e fai clic su «Estrai testo». Copialo con un clic o salvalo come TXT. Senza registrazione e senza caricare il file.
Come trasformare un PDF scansionato in testo?
Lascia attivo «Leggi le pagine scansionate con l’OCR» e scegli la lingua del documento. Le pagine senza livello di testo vengono lette automaticamente.
Perché il testo copiato da un PDF ha tanti a capo?
Il PDF salva il testo riga per riga. Con «Paragrafi» lo strumento unisce le righe che vanno insieme e toglie la sillabazione a fine riga.
Posso incollare il testo in Word?
Sì: fai clic su «Copia» e incolla. Per conservare titoli e paragrafi in un file Word usa «PDF in DOCX».
Il mio PDF viene caricato online?
No. Lettura e OCR avvengono interamente nel browser.
Perché vedo solo quadratini o caratteri strani?
Il PDF usa font non collegati a lettere vere. Spunta «Leggi tutte le pagine con l’OCR» ed estrai di nuovo: l’OCR legge ciò che è stampato.
Fonti e riferimenti normativi
- Adobe – ISO 32000-1:2008 Document management – Portable document format (PDF 1.7)
- pdf.js – getTextContent / getAnnotations (Mozilla, Apache-2.0)
- pdf.js 6.3.289 licence (Apache-2.0)
- Tesseract.js – OCR library for the browser (GitHub, Apache-2.0)
- Tesseract OCR documentation – Improving the quality of the output
- Unicode Standard – UTF-8 encoding form (TXT export)
- Open-source licenses of the libraries used (MIT, LGPL-3.0)
Aggiornato al:
Strumenti correlati
- Convertire PDF in MarkdownConverti PDF in Markdown: titoli, paragrafi, elenchi e link in .md per Obsidian, GitHub, appunti o chat con l’IA. OCR per le scansioni, gratis e senza upload.
- Convertire PDF in DOCXTrasforma un PDF in un DOCX modificabile per Word o LibreOffice direttamente nel browser, pagine scansionate con OCR. Senza upload e senza registrazione.
- Estrarre testo da un’immagine con OCREstrarre testo da immagine gratis: copia il testo da foto, scansioni e screenshot. OCR in italiano, inglese, tedesco, francese e altre lingue, nel browser.
- Convertire PDF in JPGConverti un PDF in JPG o PNG: ogni pagina come immagine, da 72 a 300 dpi, singolarmente o in ZIP. Gratis, direttamente nel browser – nulla viene caricato.
- Pulisci testo onlineRimuovi a capo, spazi doppi, righe vuote e caratteri invisibili, elimina righe duplicate e ordina le liste. Gratis e istantaneo, nel browser.
- Aggiungere una cornice a una fotoAggiungere cornice a una foto online: bordo bianco o colorato, stile foto istantanea, angoli arrotondati e cornice trasparente, con anteprima. Gratis.