Dette værktøj bruger Mozilla PDF.js til at læse hvert sides eksisterende tekstlag på din enhed. Det bevarer sidefølge og de linjeskift, som PDF'en rapporterer, og giver dig derefter ét redigerbart resultat i ren tekst. Billeder, fonte, kolonner, tabeller og visuel formatering bevares ikke i TXT-output.
Der er en vigtig grænse: En digital PDF gemmer tegn, som software kan markere og søge i. En scanning kan kun indeholde et foto af en side. At udtrække den første type er tekstparsing; at læse den anden kræver OCR. Dette værktøj løser kun den første opgave.