Ordine delle pagine
Rapporto pubblico riaperto e letto in sequenza
21 pagine21 sezioni
CorrispondeTesto selezionabile in un file TXT
Converti da PDF a testo gratis: estrai il contenuto già selezionabile, mantieni separate le pagine e scarica un TXT senza inviare il documento al server.
Un file PDF di massimo 50 MB. Il documento resta sul tuo dispositivo.
Semplice dall’inizio alla fine
Dal documento al file TXT in tre passaggi locali.
Scegli un documento fino a 50 MB dal dispositivo.
Il browser legge il testo già presente, pagina per pagina.
Salva un file UTF-8 con separatori tra le pagine.
Verifica concreta
Ho estratto nel browser il contenuto di un rapporto pubblico e verificato separatori, ordine, codifica e comportamento delle pagine senza testo.
Rapporto pubblico riaperto e letto in sequenza
21 pagine21 sezioni
CorrispondeContenuto estratto con il motore usato in produzione
PDF87.666 caratteri
EstrattoAccenti e caratteri vengono salvati nel TXT
TestoUTF-8
PreservatoFixture composta soltanto da contenuto visivo
0 oggetti testoAvviso
SegnalatoIl test browser legge un rapporto pubblico di 21 pagine e produce 87.666 caratteri. La suite usa inoltre un PDF deterministico di tre pagine e una pagina priva di oggetti testuali, controllando ordine, separatori, UTF-8 e messaggio no-OCR.
Elenco soltanto i browser con cui ho provato davvero lo strumento. Su altri browser o dispositivi il risultato può cambiare.
Guida pratica
Differenze tra testo selezionabile, scansioni e impaginazione del documento.
Lo strumento legge gli oggetti testuali già presenti nel documento e li salva in un file TXT. Ogni pagina è separata con un’intestazione, così l’origine del contenuto rimane riconoscibile anche senza l’impaginazione PDF.
Se puoi selezionare le parole nel lettore PDF, normalmente il testo può essere estratto. Una scansione invece contiene immagini di pagine: senza OCR non esistono lettere da leggere.
Questa pagina non applica OCR. Quando non trova testo, lo comunica chiaramente invece di produrre contenuti inventati.
Parole, accenti e ordine restituito dal PDF vengono salvati in UTF-8. Il TXT non conserva font, colori, colonne, coordinate, immagini o l’aspetto grafico del documento.
Nei PDF a più colonne o con elementi posizionati liberamente, l’ordine estratto può differire da quello percepito visivamente. Controlla sempre il TXT prima di riutilizzarlo in un documento ufficiale.
Per ottenere parole modificabili usa questa conversione. Se vuoi mantenere grafica, collegamenti e impaginazione delle pagine originali, usa invece Estrai pagine PDF.
Il risultato TXT è pensato per appunti, ricerca, analisi e riutilizzo del contenuto, non come copia visiva del PDF.
Il PDF viene letto nel browser e il server non riceve il documento né il testo estratto. Non è richiesta registrazione. Il limite per il file è 50 MB.
FAQ sull’estrazione
Seleziona il PDF, avvia l’estrazione e scarica il file TXT. Tutto avviene nel browser senza registrazione.
Sì. Il risultato è un normale file TXT UTF-8 che puoi aprire e modificare con un editor di testo.
Solo se la scansione contiene già un livello di testo. Lo strumento non esegue OCR sulle immagini.
PDF con colonne o posizionamenti complessi possono descrivere un ordine interno diverso da quello visivo.
No. Il file TXT contiene solo il testo disponibile; immagini e formattazione non vengono incluse.
No. Il documento e il testo estratto restano sul dispositivo durante l’intera operazione.