CanDoYa
DA

PDF til tekst konverter

Kører helt i din browser - ingen upload, ingen tilmelding.

Vælg en digital PDF for at udtrække markerbar tekst.

Del dette værktøj

Hvordan konverterer man PDF til tekst?

Brug denne PDF til tekst-konverter til at udtrække den markerbare tekst, der allerede ligger i en digital PDF, og kopiér den eller download som en TXT-fil. Behandlingen kører i din browser, så dokumentet bliver ikke uploadet. Scannede PDF'er med kun billeder kræver OCR, og det gør dette værktøj ikke.

Sådan gør du

  1. 1Vælg en digital PDF. Slip én PDF på værktøjet, eller vælg den fra din enhed. For det bedste resultat skal du kunne markere ord i din normale PDF-læser.
  2. 2Udtræk tekstlaget. Klik på Udtræk tekst. PDF.js læser hver side lokalt og viser status uden at sende filen til en server.
  3. 3Gennemgå ren tekst. Tjek afsnit, kolonner, tabeller og symboler op mod originalen. Læserækkefølgen i PDF'en kan afvige fra den visuelle rækkefølge.
  4. 4Kopiér eller download. Redigér resultatet, hvis det er nødvendigt, kopiér det til udklipsholderen, eller gem det som en UTF-8 TXT-fil.

Hvem er det til

Dette værktøj bruger Mozilla PDF.js til at læse hvert sides eksisterende tekstlag på din enhed. Det bevarer sidefølge og de linjeskift, som PDF'en rapporterer, og giver dig derefter ét redigerbart resultat i ren tekst. Billeder, fonte, kolonner, tabeller og visuel formatering bevares ikke i TXT-output.

Der er en vigtig grænse: En digital PDF gemmer tegn, som software kan markere og søge i. En scanning kan kun indeholde et foto af en side. At udtrække den første type er tekstparsing; at læse den anden kræver OCR. Dette værktøj løser kun den første opgave.

Ofte stillede spørgsmål

Bliver mine PDF-filer uploadet til en server?

Nej. Din browser læser den valgte PDF lokalt med PDF.js, og filen sendes ikke til CanDoYa. Selve PDF-motoren kan blive hentet, når du bruger værktøjet første gang, men dit dokument er ikke en del af den forespørgsel.

Er denne PDF til tekst-konverter gratis?

Ja. Du kan udtrække, redigere, kopiere og downloade tekst uden konto, vandmærke eller betaling. Arbejdet kører på din enhed, så der er ingen serverkø eller fil, du skal hente senere.

Hvad er grænsen for filstørrelse og antal sider?

Værktøjet accepterer én PDF på op til 100 MB og 2.000 sider. Tilgængelig hukommelse og enhedshastighed kan give en lavere praktisk grænse, især på telefoner. Del et meget stort dokument i mindre PDF'er, hvis browseren ikke kan blive færdig.

Kan dette værktøj udtrække tekst fra en scannet PDF?

Ikke når scanningen kun består af sidebilleder. Denne konverter læser eksisterende markerbar tekst og udfører ikke OCR. En scannet PDF kræver et OCR-værktøj, der genkender tegn fra pixels. Nogle blandede PDF'er har markerbar tekst på enkelte sider, men ikke på andre; resultatet markerer sider uden tekst.

Hvorfor kommer den udtrukne tekst i forkert rækkefølge?

PDF-sider placerer tekstfragmenter i koordinater og gemmer ikke altid en tydelig afsnits- eller kolonnerekkefølge. PDF.js følger dokumentets tekstobjekter og linjeskift, hvilket kan afvige fra den visuelle læserækkefølge i layouts med flere kolonner, tabeller, sidehoveder eller komplekse formularer.

Bevarer PDF til tekst formatering og billeder?

Nej. TXT-filer indeholder kun almindelige tegn, så fonte, farver, billeder, links, kolonner og tabelkanter bevares ikke. Linjeskift kommer fra PDF'ens tekstlag og kan kræve redigering efter udtræk.

Hvorfor bliver en adgangskodebeskyttet PDF afvist?

Browseren kan ikke læse et krypteret dokument uden adgangskoden. Åbn PDF'en i en betroet læser, indtast adgangskoden, og gem en ulåst kopi, hvis du har tilladelse. Tilføj derefter den kopi til konverteren.

Hvilke sprog kan udtrækkes fra en PDF?

Parseren er ikke bundet til ét sprog. Den kan returnere Unicode-tekst i hvilket som helst skriftsystem, når PDF'en har et korrekt tegnkort og markerbar tekst. Hvis et dokument bruger manglende eller brugerdefinerede font-mappinger, kan kopierede tegn stadig være ufuldstændige eller forkerte.