CanDoYa
TR

Resimden Yazıya Dönüştürücü

Tümüyle tarayıcınızda çalışır - yükleme yok, üyelik yok.

Başlamak için net, basılı metin içeren bir görsel seçin.

Bu aracı paylaş

Resimden yazıya dönüştürücü nasıl çalışır?

Resimden yazıya dönüştürücü, optik karakter tanıma (OCR) ile bir fotoğraf veya taramada basılı karakterleri algılayıp düzenlenebilir metne dönüştürür. Bu araç, Tesseract WebAssembly’i doğrudan tarayıcınızda çalıştırır, tüm 40 CanDoYa yerelinde kullanılan dilleri kapsar ve kaynak görseli yüklemeden sonucu kopyalamanıza veya indirmenize olanak tanır.

Nasıl kullanılır

  1. 1Net bir görsel seçin. JPEG, PNG, WebP, BMP veya hareketsiz GIF formatında (en fazla 15 MB ve 24 megapiksel) bir görsel bırakın ya da örnek görseli yükleyin.
  2. 2Metnin dilini seçin. Görselde yazılı olan dili seçin. Uygun Tesseract dil verisi, çıkarma başladığında indirilir.
  3. 3Çıkarın ve kontrol edin. OCR’yi başlatın, isim ve sayıları kaynakla karşılaştırıp gerekirse düzeltin, ardından metni kopyalayın veya UTF-8 TXT dosyası olarak indirin.

Kimler için

Bu dönüştürücü, açık kaynaklı Tesseract OCR motorunun tarayıcıya uyarlanmış sürümü olan Tesseract.js 7’yi kullanır. Kod, WebAssembly çekirdeği ve seçilen dil verisi, çıkarma işlemi başlatıldığında indirilir. Tesseract tanıma işlemini kendi arka plan sürecinde yürütür; böylece cihazınız işlemi işlerken sayfa yanıt vermeye devam eder.

OCR doğruluğu, dosya biçiminden çok kaynağın kalitesine bağlıdır. Düzgün hizalanmış basılı metin, dengeli aydınlatma, net görüntü, yüksek kontrast ve yeterli piksel ayrıntısı en iyi sonucu verir. Küçük ekran görüntüleri büyütülerek daha okunaklı olabilir. Eğik sayfalar, süslü yazı tipleri, sütunlu düzenler, el yazısı, parlama veya bulanık fotoğraflarda ise elle düzeltme gerekebilir.

Sık sorulan sorular

Görselim bir sunucuya yükleniyor mu?

Hayır. Seçtiğiniz dosya, cihazınızda bir Tesseract arka plan süreci tarafından çözülüp tanınır. Tarayıcı, OCR çalışma zamanı ve dil dosyalarını dış kaynaklardan indirir; bu isteklerde görseliniz yer almaz. CanDoYa, kaynak görseli veya çıkarılan metni almaz ve saklamaz.

Bu resimden yazıya dönüştürücü ücretsiz mi?

Evet. Hesap, ücret, filigran, kota veya indirme bedeli yoktur. İşlem gücünü cihazınız sağlar. Başlangıçta OCR motoru ve dil verisi internetten indirilir; büyük dil modelleri, kotalı bağlantılarda daha fazla veri kullanabilir.

Desteklenen görsel boyutu ve formatları nelerdir?

Bir adet JPEG, PNG, WebP, BMP veya hareketsiz GIF’i (en fazla 15 MB ve 24 megapiksel) işleyebilirsiniz. Bu sınırlar, telefon ve dizüstü bilgisayarlarda bellek hatalarını azaltır. Sadece görseller için uygundur; PDF sayfaları için ayrı bir PDF OCR aracı kullanmalısınız.

OCR ile metin çıkarma ne kadar doğru?

Temiz basılı metin iyi tanınır, ancak hiçbir OCR kesinlik garantisi vermez. Netlik, büyük harfler, yüksek kontrast, düz sayfa ve doğru dil seçimi doğruluğu artırır. El yazısı, alışılmadık fontlar, parlama, bulanıklık, tablolar, sütunlar ve karışık okuma yönleri karakter değişimi veya satır sırası hatalarına yol açabilir.

El yazısından metin çıkarabilir mi?

Çok düzgün blok harfli el yazısı kısmen tanınabilir, ancak bu Tesseract tabanlı araç esas olarak basılı metin için tasarlanmıştır. Bitişik yazı ve düzensiz harfler çok daha az güvenilirdir. El yazısı sonuçlarını taslak olarak kabul edin ve önemli her kelime, tarih ve sayıyı orijinal görselle karşılaştırın.

Hangi metin dilini seçmeliyim?

Görseldeki karakterlerin dilini seçin, tarayıcı dilinizi değil. Liste, tüm 40 CanDoYa yerelinde kullanılan dilleri kapsar; sadeleştirilmiş ve geleneksel Çince ayrı ayrı yer alır. Sayfada birden fazla dil varsa, baskın olanı seçin; bu sürümde her işlemde yalnızca bir dil modeli kullanılır.

Neden ilk çıkarma daha uzun sürüyor?

Tarayıcı, önce Tesseract.js kodunu, uyumlu WebAssembly çekirdeğini ve seçilen dilin eğitimli verisini indirir. Tarayıcı önbelleği sonraki işlemleri hızlandırabilir; gizli mod, yeni bir dil veya önbellek temizliği yeni bir indirme gerektirebilir.

Çıkarılan metni kontrol etmeden kullanabilir miyim?

Özellikle isimler, toplamlar, tarihler, noktalama ve O-0, l-1 gibi benzer karakterleri mutlaka gözden geçirin. Görünen güven oranı Tesseract’ın genel tahminidir; her kelime için onay vermez ve kaynağın görsel düzenini korumaz.