Questo convertitore usa Mozilla PDF.js per leggere nel tuo dispositivo il text layer già presente in ogni pagina. Mantiene l'ordine delle pagine e i ritorni a capo rilevati, poi ti restituisce un unico risultato in testo semplice modificabile. Immagini, font, colonne, tabelle e formattazione visiva non vengono preservati nell'output TXT.
C'è un confine importante: un PDF digitale contiene caratteri selezionabili e ricercabili dal software. Una scansione può contenere solo la fotografia di una pagina. Estrarre il primo caso è parsing del testo; leggere il secondo richiede il riconoscimento ottico dei caratteri. Questo strumento fa solo la prima cosa.