CanDoYa
SR

PDF u tekst konvertor

Radi u celosti u pregledaču - bez otpremanja i bez registracije.

Izaberite digitalni PDF da izvučete selektabilni tekst.

Podelite ovu alatku

Kako da pretvorim PDF u tekst?

Koristite ovaj PDF u tekst konvertor da izvučete selektabilni tekst koji je već sačuvan u digitalnom PDF-u, a zatim ga kopirajte ili preuzmite kao TXT fajl. Obrada se odvija u vašem pregledaču, pa se dokument ne otprema. Skenirani PDF-ovi sa slikama zahtevaju OCR, a ovaj alat ga ne radi.

Kako se koristi

  1. 1Izaberite digitalni PDF. Prevucite jedan PDF u alatku ili ga izaberite sa uređaja. Za najbolji rezultat, proverite da možete da označite reči u svom uobičajenom PDF pregledniku.
  2. 2Izvucite tekstualni sloj. Kliknite Izvuci tekst. PDF.js lokalno čita svaku stranicu i prikazuje napredak bez slanja fajla na server.
  3. 3Pregledajte običan tekst. Uporedite pasuse, kolone, tabele i simbole sa originalom. Redosled čitanja u PDF-u može da se razlikuje od vizuelnog rasporeda stranice.
  4. 4Kopirajte ili preuzmite. Po potrebi uredite rezultat, kopirajte ga u klipbord ili sačuvajte kao UTF-8 TXT fajl.

Kome je namenjen

Ovaj konvertor koristi Mozilla PDF.js da na vašem uređaju pročita postojeći tekstualni sloj svake stranice. Zadržava redosled stranica i prijavljene prelome redova, a zatim vam daje jedan izmenjiv rezultat u običnom tekstu. Slike, fontovi, kolone, tabele i vizuelno formatiranje ne čuvaju se u TXT izlazu.

Postoji važna granica: digitalni PDF čuva znakove koje softver može da označi i pretražuje. Sken može sadržati samo fotografiju stranice. Izdvajanje prvog tipa je parsiranje teksta; čitanje drugog zahteva optičko prepoznavanje karaktera. Ovaj alat radi samo prvi posao.

Česta pitanja

Da li se moji PDF fajlovi otpremaju na server?

Ne. Vaš pregledač lokalno čita izabrani PDF pomoću PDF.js, a fajl se ne šalje na CanDoYa. Kod PDF engine-a može da se preuzme kada prvi put koristite alatku, ali vaš dokument nije deo tog zahteva.

Da li je ovaj PDF u tekst konvertor besplatan?

Da. Možete da izvučete, uredite, kopirate i preuzmete tekst bez naloga, vodenog žiga ili plaćanja. Obrada se odvija na vašem uređaju, pa nema server reda za konverziju niti naknadnog preuzimanja otpremljenog fajla.

Koja su ograničenja veličine PDF-a i broja strana?

Alat prihvata jedan PDF do 100 MB i 2.000 strana. Dostupna memorija i brzina uređaja mogu da uvedu nižu praktičnu granicu, posebno na telefonima. Ako pregledač ne može da završi obradu, podelite veoma veliki dokument na manje PDF-ove.

Može li ovaj alat da izvuče tekst iz skeniranog PDF-a?

Ne kada sken sadrži samo slike stranica. Ovaj konvertor čita postojeći selektabilni tekst i ne radi OCR. Skeniran PDF zahteva OCR alat koji prepoznaje znakove iz piksela. Neki mešoviti PDF-ovi imaju selektabilan tekst na pojedinim stranicama, ali ne na svim; rezultat označava stranice bez teksta.

Zašto je izvučeni tekst u pogrešnom redosledu?

PDF stranice pozicioniraju delove teksta koordinatama i ne moraju da čuvaju jasan redosled pasusa ili kolona. PDF.js prati stavke teksta i prelome redova iz dokumenta, što može da se razlikuje od vizuelnog redosleda čitanja u rasporedima sa više kolona, tabelama, zaglavljima ili složenim obrascima.

Da li PDF u tekst čuva formatiranje i slike?

Ne. TXT fajlovi sadrže samo obične znakove, pa fontovi, boje, slike, linkovi, kolone i ivice tabela nisu sačuvani. Prelomi redova dolaze iz tekstualnog sloja PDF-a i možda će zahtevati uređivanje nakon izvlačenja.

Zašto je PDF zaštićen lozinkom odbijen?

Pregledač ne može da pročita šifrovani dokument bez lozinke. Otvorite PDF u pouzdanom pregledniku, unesite lozinku i sačuvajte otključanu kopiju ako imate dozvolu. Zatim dodajte tu kopiju u konvertor.

Koji jezici mogu da se izvuku iz PDF-a?

Parser nije vezan za jedan jezik. Može da vrati Unicode tekst u bilo kom pismu kada PDF sadrži ispravnu mapu znakova i selektabilan tekst. Ako dokument koristi nedostajuće ili prilagođene mapiranja fontova, kopirani znakovi i dalje mogu biti nepotpuni ili netačni.