Zum Inhalt springen

Bild in Text umwandeln

Lies gedruckten englischen oder koreanischen Text aus einem lokalen Foto und bearbeite, kopiere oder speichere ihn.

Eingabe

Verarbeitung im Browser.

Deine Datei bleibt in diesem Browser.

JPG, PNG oder statisches WebP · bis 10 MiB und 12 Megapixel. Verarbeitung mit maximal 4 Megapixeln und 2.400 px an der längsten Seite.

Die Erkennung lädt die Engine von jsDelivr und Sprachdateien von dieser Website. Dein Bild und der erkannte Text werden nicht hochgeladen.

Ergebnis

So funktioniert es

  1. Wähle ein JPG, PNG oder statisches WebP. Prüfe in der Vorschau, ob der gedruckte Text aufrecht und lesbar ist. Drehe bei Bedarf um 90 Grad nach links oder rechts.
  2. Wähle Englisch oder Koreanisch + Englisch passend zum Dokument. Diese Einstellung ist von der Website-Sprache getrennt. Eine japanische Oberfläche aktiviert zum Beispiel keine japanische OCR.
  3. Wähle Text erkennen. Zuerst werden Engine und Sprachdaten geladen. Korrigiere anschließend das Ergebnis. Text kopieren und TXT speichern verwenden den aktuell sichtbaren Inhalt des bearbeitbaren Textfelds.

Das Ergebnis verstehen

OCR erkennt gedruckte Zeichen anhand ihrer Pixel. Anders als beim Kopieren einer PDF-Textebene müssen die Zeichen geschätzt werden; Fehler sind normal. Prüfe besonders Namen, Zahlen, Satzzeichen und ähnlich aussehende Buchstaben.

Das Bild wird lokal verarbeitet. Versionsgebundene Engine-Dateien kommen von jsDelivr, englische und koreanische Sprachdaten von dieser Website. Diese Downloads enthalten weder Bild noch erkannten Text. Es gibt keine Anmeldung, Dokumentbibliothek oder kostenpflichtige Erkennungs-API.

Erkannt wird das Vorschaubild einschließlich manueller Drehung. Große Quellen werden auf höchstens vier Megapixel und 2.400 Pixel an der längsten Seite reduziert; dies wird angezeigt. Das begrenzt den Speicherbedarf, kann aber feine Details entfernen. Klare Buchstaben sollten einen sinnvollen Anteil des Fotos einnehmen.

Beispiele

Aus einer gedruckten Notiz „Meeting at 10:30“ kann bearbeitbarer Text werden. Steht dort nach der Erkennung „Meeting at 10:3O“, ersetze O durch die Ziffer 0. Die TXT-Datei enthält dann die Korrektur.

Für „회의 시간 10:30“ wähle Koreanisch + Englisch. Drehe ein seitliches Foto zuerst so, dass die Vorschau aufrecht lesbar ist. Sprach- oder Drehungsänderungen löschen alte Ergebnisse, damit kein veralteter Text kopiert wird. Die Beispiele erklären den Ablauf und garantieren keine perfekte Erkennung aller Fotos und Schriften.

Grenzen und Fehlerbehebung

Die Grenzen sind 10 MiB und 12 Megapixel sowie 12.000 Pixel je Seite. Animierte PNG/WebP, GIF, PDF und nicht unterstützte JPEG-Varianten werden abgewiesen. Signatur und Abmessungen werden vor dem Dekodieren geprüft. Eine passende Endung reicht nicht; beschädigte Dateien können beim nativen Dekodieren scheitern.

Fotografiere möglichst gerade bei gleichmäßigem Licht und gutem Kontrast. Reflexe, Bewegungsunschärfe, Schatten, kleine Zeichen und geringe Auflösung verursachen Fehler. Keine automatische Perspektivkorrektur, garantierte Handschrifterkennung, Tabellenrekonstruktion oder komplette Scan-PDF-Verarbeitung. Vierteldrehungen korrigieren keine schräge oder verzerrte Seite.

Abbrechen beendet den Erkennungsjob. Eine andere Datei, Drehung oder Sprache verwirft alte Ergebnisse. Entfernen leert Bild und Text, erhält aber die Sprache. Bei einem fehlerhaften Ersatz bleibt die vorige gültige Quelle verfügbar. Lange Vorgänge enden am Zeitlimit; versuche dann ein kleineres oder schärferes Bild.

Häufige Fragen

Warum ist das Ergebnis leer?

Ein gültiges Bild muss keinen erkennbaren Text enthalten. Prüfe Sprache, Ausrichtung, Kontrast und Zeichengröße. Ein leeres Ergebnis wird ausdrücklich angezeigt, ohne Wörter zu erfinden. Danach kann das Ergebnisfeld bearbeitet werden.

Werden Handschrift und Tabellen exakt gelesen?

Dafür gibt es keine Garantie. Unterstützt wird gedruckter englischer und koreanischer Text. TXT ist Klartext, keine Tabelle, kein Spreadsheet und kein formatiertes Dokument.

Ändert die Website-Sprache die OCR?

Nein. Sechs Oberflächensprachen stehen zwei Erkennungsoptionen gegenüber: Englisch und Koreanisch + Englisch. Weitere Erkennungssprachen werden nicht zugesagt.

Warum schlägt Kopieren fehl?

Der Browser kann die Zwischenablage einschränken. Der Text wird zum manuellen Kopieren markiert. Alternativ lässt sich der aktuelle Text als UTF-8-TXT speichern.

Wird das Originalbild verändert?

Nein. Drehung und Verkleinerung erfolgen im Arbeitsspeicher. Die Originaldatei wird nicht überschrieben; TXT ist eine separate Datei.

Kann ich später zum Text zurückkehren?

Es gibt keinen gespeicherten Verlauf. Kopiere oder lade das Ergebnis vor dem Schließen herunter. Eine neue Sitzung braucht Engine- und Sprachdateien; Offline-Betrieb ist nicht garantiert.