Bangla aus einem Bild lesen
Richten Sie es auf das Foto einer Seite, einen Scan oder einen Screenshot, und Sie erhalten den bengalischen Text als Unicode zurück – durchsuchbar, bearbeitbar und bereit zum Einfügen. Die Erkennung ist auf Bangla eingestellt, bevor das Bild ankommt; es gibt also nichts zu erkennen und nichts auszuwählen. Ihr Bild wird nie gespeichert.
- Nie gespeichert
- Keine Warteschlange, kein Warten
- Ohne Anmeldung, ohne Wasserzeichen
So funktioniert’s
Bild hinzufügen
Das Foto einer Buchseite, ein altes Rundschreiben, eine gescannte Urkunde oder ein Screenshot mit Bangla-Text. JPG, PNG, WebP, HEIC und TIFF funktionieren alle; ein schräg aufgenommenes Foto wird zuerst begradigt.
Lesen lassen
Bengalisch ist bereits ausgewählt. Enthält die Seite auch Englisch – ein Formular, ein Briefkopf –, fügen Sie es aus der Liste hinzu, und beides wird gelesen.
Als Unicode kopieren
Der Text kommt als Unicode heraus, egal in welcher Schrift das Original gedruckt war: Ein Rundschreiben in SutonnyMJ liest sich als gewöhnliches Bangla, nicht als „evsjv‡`k“. Behalten Sie das Layout oder fügen Sie die Zeilen zusammen, dann kopieren oder herunterladen.
Was Bangla beim Lesen anders macht
Das bengalische Modell liest Cluster statt einzelner Buchstaben. Eine Ligatur wie ক্ষ oder ন্ত্র ist auf der Seite eine einzige Form, und das Modell muss sowohl entscheiden, was sie ist, als auch, wie sie sich in Unicode zerlegt – deshalb erzeugt eine Fehllesung in Bangla meist eine falsche Ligatur oder ein Vokalzeichen am falschen Buchstaben statt eines schlicht falschen Buchstabens. Die Ausgabe hat die Reihenfolge, die Unicode erwartet: Ein Vokalzeichen folgt seinem Konsonantencluster, ein Reph wird als র + Hasanta vor dem Cluster geschrieben, auf dem es sitzt, und die zweiteiligen Vokale kommen als ein Codepunkt heraus. Das ist die Reihenfolge, die jedes Suchfeld, jede Rechtschreibprüfung und jede Schrift erwartet – und das Gegenteil der visuellen Reihenfolge, in der jemand an einer Bijoy-Tastatur arbeitet.
Alles, was die gewöhnliche Erkennung tut, geschieht auch hier: Das Papier wird angeglichen, die Seite begradigt, Tabellen mit Linien werden Zelle für Zelle gelesen, damit eine Beschriftung und ihr Wert getrennt bleiben, und das Ergebnis kommt entweder so angeordnet zurück, wie die Seite war, oder zu Absätzen zusammengefügt. Zahlen werden als bengalische Ziffern gelesen, wenn sie als bengalische Ziffern gedruckt sind; ein Formular, das ০১২ und 012 mischt, behält beides.
Bengalisch teilt sein Modell mit keiner anderen Sprache, aber das Bild kann trotzdem Englisch enthalten – einen Briefkopf, ein Aktenzeichen, einen Unterschriftsblock –, und die eine Sprache liest die andere als Unsinn. Wird Englisch aus der Liste hinzugefügt, wird die Seite mit beiden Paketen gelesen, und jedes Wort bleibt in der Schrift, in der es gedruckt war.
Wenn Sie etwas anderes brauchen
Ein Bijoy-Dokument, das noch als Datei existiert, wird besser umgewandelt als fotografiert. OCR baut den Text aus Pixeln neu auf und liegt selbst auf der besten Seite bei ein paar Zeichen von tausend falsch; der Konverter Bijoy in Unicode baut ihn aus den Tastenanschlägen neu auf, macht dabei keinen einzigen Fehler und behält Fettdruck und Tabellen. Fotografieren Sie eine Seite nur, wenn die Datei verloren ist.
Für ein ganzes Buch oder ein Archiv von Scans ist ein Desktop-Tool die richtige Form: Ein Kommandozeilen-OCR-Tool mit demselben bengalischen Modell liest über Nacht einen ganzen Ordner, und OCRmyPDF fügt jedem PDF darin eine durchsuchbare Textebene hinzu. Diese Seite ist für das Blatt, das gerade vor Ihnen liegt.
Häufig gestellte Fragen
Wird mein Bild irgendwo gespeichert?
Nein. Das Sprachpaket wird beim ersten Verwenden einer Sprache von dieser Website geladen; das Bild selbst wird nie gespeichert und nirgendwohin gesendet – es funktioniert sogar mit ausgeschaltetem WLAN.
Wie gut liest es Bangla?
Gedrucktes Bangla in einer gängigen Schrift – SutonnyMJ, Nikosh, Kalpurush, SolaimanLipi, ein Buch oder eine Zeitung –, gerade und scharf fotografiert, wird gut gelesen; auf einer unscharfen oder verblassten Seite ist hier und da eine Ligatur falsch. Die Fehler sind typisch für die Schrift: ein Reph oder ein Vokalzeichen an einem Buchstaben, den das Modell in dieser Form nicht kennt, und klein gedruckte Ligaturen. Ein klarer Scan mit 300 dpi wird besser gelesen als ein Handyfoto, und ein Handyfoto bei Tageslicht besser als eines unter einer Neonröhre.
Funktioniert es mit einem Bijoy-Dokument?
Ja, und das ist eine der besten Verwendungen dafür. OCR liest das Bild der Buchstaben, nicht die Codepunkte der Schrift, eine in SutonnyMJ getippte Seite kommt also direkt als Unicode-Bangla heraus – ohne Umwandlung. Für eine Word-Datei, die noch in Bijoy vorliegt (Text, kein Bild), verwenden Sie stattdessen Bijoy in Unicode: Das erhält die Formatierung und macht keine Lesefehler.
Warum hat Bangla eine eigene Seite?
Weil die Spracherkennung Zeit kostet und bei Bangla häufiger danebenliegt als bei anderen Schriften: Eine Seite mit lateinischem Briefkopf, einem Stempel oder einer Zahl kann als Englisch gelesen werden, und das Ergebnis ist eine Seite voller selbstbewusstem Unsinn. Ist die Sprache eingestellt, bevor das Bild ankommt, beginnt das bengalische Paket in dem Moment zu laden, in dem sich die Seite öffnet, und die Erkennung probiert nie die falsche Sprache aus. Die gewöhnliche Seite Bild in Text macht dasselbe mit eingeschalteter Spracherkennung, für Bilder in jeder Sprache.
Kann es Handschrift lesen?
Druckschrift in Blockbuchstaben manchmal; Schreibschrift nein, weder in Bangla noch in einer anderen Schrift – das gilt für jedes allgemeine OCR-Tool. Die Seite Handschrifterkennung sagt das klar und zeigt, was sie geschafft hat.
Und ein gescanntes PDF?
Verwenden Sie für ein ganzes Dokument Bangla-PDF in Word: Es liest jede Seite auf dieselbe Weise und liefert eine .docx. Diese Seite ist für ein einzelnes Bild.
Gut zu wissen: Nur gedruckter Text: Schreibschrift wird nicht erkannt. Dekorative Bangla-Schriften, Text über einem Foto und stark verblasster Druck kommen lückenhaft heraus. Assamesisch ist ein eigenes Paket – fügen Sie es aus der Liste hinzu, wenn die Seite auf Assamesisch ist. Das Ergebnis ist Nur-Text: Fett, Farben und das Bild selbst werden nicht übernommen.
Dieses Tool auf Ihrer Website einbinden
Kostenlos für jeden Blog, jede Kursseite und jeden Hilfeartikel. Fügen Sie ein einziges Snippet ein, und Ihre Besucher können das Tool direkt auf Ihrer Seite nutzen.
Ähnliche Tools
Bild in Text
Text aus einem Bild, in über 120 Sprachen
Bangla-PDF in Word
Bengalische PDFs als bearbeitbare .docx, gescannt oder nicht
Bijoy in Unicode
SutonnyMJ-Text als echtes Bengalisch lesen
PDF-OCR
Einen Scan durchsuchbar machen
Text aus Screenshot
Screenshot einfügen, Text erhalten
Handschrifterkennung
Druckschrift, ehrlich gelesen