CanDoYa
DE

Bild zu Text Konverter

Läuft komplett in deinem Browser - kein Upload, keine Anmeldung.

Wählen Sie ein Bild mit klar gedrucktem Text aus.

Dieses Tool teilen

Wie funktioniert ein Bild-zu-Text-Konverter?

Ein Bild-zu-Text-Konverter nutzt optische Zeichenerkennung (OCR), um gedruckte Zeichen auf Fotos oder Scans zu erkennen und als bearbeitbaren Text bereitzustellen. Dieses Tool verwendet Tesseract WebAssembly direkt im Browser, unterstützt die Sprachen aller 40 CanDoYa-Lokalisierungen und ermöglicht das Kopieren oder Herunterladen des Ergebnisses, ohne dass das Quellbild hochgeladen wird.

So funktioniert’s

  1. 1Ein gut lesbares Bild auswählen. Laden Sie ein JPEG, PNG, WebP, BMP oder nicht animiertes GIF mit bis zu 15 MB und 24 Megapixeln hoch oder nutzen Sie das Beispielbild.
  2. 2Textsprache wählen. Wählen Sie die Sprache, die tatsächlich im Bild abgedruckt ist. Die passenden Tesseract-Sprachdaten werden beim Start der Erkennung geladen.
  3. 3Extrahieren und prüfen. Starten Sie die OCR, vergleichen Sie Namen und Zahlen mit dem Originalbild, korrigieren Sie eventuelle Fehler und kopieren Sie den Text oder laden Sie eine UTF-8-TXT-Datei herunter.

Für wen

Dieser Konverter verwendet Tesseract.js 7, eine Browser-Umsetzung der quelloffenen Tesseract-OCR-Engine. Der Code, der WebAssembly-Kern und die gewählten Sprachdaten werden erst geladen, wenn Sie die Texterkennung starten. Die Erkennung läuft in einem eigenen Hintergrundprozess, sodass die Seite währenddessen reaktionsfähig bleibt.

Die OCR-Genauigkeit hängt stärker von der Bildqualität als vom Dateiformat ab. Senkrecht gedruckter Text, gleichmäßige Ausleuchtung, scharfer Fokus, starker Kontrast und ausreichend viele Bildpunkte helfen. Kleine Screenshots können durch Hochskalieren lesbarer werden. Schiefe Seiten, verspielte Schriften, Spalten, Handschrift, Spiegelungen und unscharfe Fotos erfordern oft manuelle Korrekturen.

Häufige Fragen

Wird mein Bild an einen Server übertragen?

Nein. Die ausgewählte Datei wird auf Ihrem Gerät von einem Tesseract-Hintergrundprozess verarbeitet. Der Browser lädt öffentliche OCR-Laufzeit- und Sprachdateien von externen Servern, aber diese Anfragen enthalten Ihr Bild nicht. CanDoYa erhält oder speichert weder das Quellbild noch den extrahierten Text.

Ist dieser Bild-zu-Text-Konverter kostenlos?

Ja. Es ist kein Konto, keine Zahlung, kein Wasserzeichen, kein Seitenlimit und keine Gebühr für den Download erforderlich. Ihr Gerät übernimmt die Verarbeitung. Der erstmalige Download der OCR-Engine und Sprachdaten nutzt Ihre Internetverbindung, und größere Sprachmodelle können bei limitiertem Datenvolumen ins Gewicht fallen.

Welche Bildformate und Größen werden unterstützt?

Sie können ein JPEG, PNG, WebP, BMP oder nicht animiertes GIF mit bis zu 15 MB und 24 Megapixeln verarbeiten. Diese Limits verringern Speicherprobleme auf Mobilgeräten und Laptops. Das Tool verarbeitet ausschließlich Bilddateien - für vollständige PDF-Seiten nutzen Sie bitte ein spezielles PDF-OCR-Tool.

Wie genau ist die Bild-zu-Text-Erkennung per OCR?

Sauber gedruckter Text wird meist gut erkannt, aber kein OCR-Ergebnis ist garantiert. Scharfer Fokus, große Buchstaben, hoher Kontrast, eine gerade Seite und die richtige Sprache verbessern die Genauigkeit. Handschrift, ungewöhnliche Schriften, Spiegelungen, Unschärfe, Tabellen, Spalten und gemischte Leserichtungen können zu Verwechslungen oder vertauschten Zeilen führen.

Kann handschriftlicher Text erkannt werden?

Sehr ordentlich geschriebene Druckschrift kann teilweise erkannt werden, aber dieses Tesseract-basierte Tool ist vor allem für gedruckten Text gedacht. Schreibschrift und unregelmäßige Buchstaben sind deutlich weniger zuverlässig. Behandeln Sie Handschrift-Ausgaben als Entwurf und vergleichen Sie wichtige Wörter, Daten und Zahlen immer mit dem Originalbild.

Welche Sprache soll ich auswählen?

Wählen Sie die Sprache, in der der Text im Bild geschrieben ist, nicht die Sprache Ihres Browsers. Die Liste deckt die Sprachen aller 40 CanDoYa-Lokalisierungen ab, darunter vereinfachtes und traditionelles Chinesisch separat. Bei gemischten Sprachen wählen Sie die dominierende - pro Durchlauf wird jeweils ein Sprachmodell geladen.

Warum dauert die erste Extraktion länger?

Der Browser muss zunächst den Tesseract.js-Code, einen passenden WebAssembly-Kern und die Trainingsdaten der gewählten Sprache laden. Spätere Durchläufe sind meist schneller, wenn der Browser die Daten zwischenspeichert. Privater Modus, Speicherbereinigung, eine neue Sprache oder gelöschter Cache können einen erneuten Download auslösen.

Kann ich den extrahierten Text ungeprüft verwenden?

Bitte prüfen Sie den Text vor der Nutzung, insbesondere Namen, Summen, Daten, Satzzeichen und ähnlich aussehende Zeichen wie O und 0 oder l und 1. Der angezeigte Vertrauenswert ist eine grobe Schätzung von Tesseract. Er bestätigt weder jedes Wort noch das Layout des Originals.