Det här verktyget använder Mozilla PDF.js för att läsa varje sidas befintliga textlager på din enhet. Det behåller sidordningen och rapporterade radbrytningar och ger dig sedan ett redigerbart resultat i ren text. Bilder, typsnitt, kolumner, tabeller och visuell formatering bevaras inte i TXT-utdata.
Det finns en viktig gräns: en digital PDF innehåller tecken som programvara kan markera och söka i. En skanning kan bara innehålla ett foto av en sida. Att extrahera den första typen är texttolkning; att läsa den andra kräver optisk teckenigenkänning. Det här verktyget gör bara det första.