Die Erkennung führt ein XLM-R-Klassifikationsmodell auf Ihrem Gerät aus und verarbeitet den Text in einem eigenen Prozess, damit die Seite bedienbar bleibt. Sie bevorzugt WebGPU-Beschleunigung und versucht es bei Bedarf erneut mit WebAssembly auf dem Prozessor. Beim ersten Start werden ungefähr 296 MB Modell- und Tokenizer-Daten von Hugging Face geladen. Der Browser speichert diese Dateien normalerweise im Cache, kann sie aber bei einer Speicherbereinigung oder bei knappem Platz entfernen.
Das Modell vergleicht Arabisch, Bulgarisch, Chinesisch, Deutsch, Englisch, Französisch, Griechisch, Hindi, Italienisch, Japanisch, Niederländisch, Polnisch, Portugiesisch, Russisch, Spanisch, Suaheli, Thailändisch, Türkisch, Urdu und Vietnamesisch. Text in einer anderen Sprache wird zwangsweise einem dieser Labels zugeordnet. Prüfen Sie deshalb die unterstützte Liste, bevor Sie sich auf das Ergebnis verlassen.