Ziehen Sie eine beliebige Audio- oder Videodatei hinein, wählen Sie eine Sprache und erhalten Sie ein vollständiges Transkript mit Zeitstempeln - alles in Ihrem Browser. Das Modell wird einmal heruntergeladen (~75 MB) und lokal zwischengespeichert, sodass nachfolgende Durchläufe sofort verfügbar sind und offline funktionieren.
Die Erkennung läuft lokal. Ihr Audio verlässt Ihr Gerät niemals.
Das Modell wird in Ihrem Browser zwischengespeichert. Weitere Durchläufe funktionieren offline.
Kein Konto, keine Credits, keine Nutzungsbegrenzung. Einfach öffnen und verwenden.
Spracherkennung bedeutet normalerweise, Ihr Audio auf die GPU eines anderen hochzuladen. Hier läuft das Modell stattdessen auf Ihrem eigenen Gerät, was das Tool gleichzeitig kostenlos und privat macht.
Der Kompromiss ist die Modellgröße. Die On-Device-Gewichte sind ein Bruchteil dessen, was ein gehosteter Dienst ausführt, sodass die Genauigkeit bei verrauschtem Audio, starken Akzenten und überlappenden Sprechern abnimmt – hier spielt die untenstehende Cloud-Option ihre Stärken aus.
Das kostenlose In-Browser-Tool verwendet ein kleines Open-Source-Modell – gut für sauberes Audio, aber es kann bei starken Akzenten, Rauschen oder überlappenden Sprechern Schwierigkeiten haben und deckt nur eine begrenzte Anzahl von Sprachen ab. Für Genauigkeit auf Sendequalität, wesentlich breitere Sprachunterstützung und SRT/VTT/TXT-Downloads nutzen Sie unser kostenpflichtiges Cloud-basiertes Speech to Text.
Cloud-basiertes Speech to Text ausprobieren