Audio-Datei
Dateien hier ablegen oder klicken zum Auswählen
Welche Sprachen kommen in der Aufnahme vor?
Erkennungs-Modell
Ergebnis
Dienst
Wird geprüft …
Modell-Dienste
Die Modelle laufen nicht dauernd. Sie starten von selbst, sobald ein
Auftrag sie braucht, und schalten sich etwa eine Minute nach dem letzten
Auftrag wieder aus. Das erste Starten dauert ein bis zwei Minuten. „Aus"
ist also der Normalzustand und kein Fehler.
Speech2Text — Qwen3-ASR + pyannote
Mehrsprachige Transkription mit Sprecher-Erkennung und Zeitstempeln.
Die Erkennung übernehmen die eigenen Modell-Dienste auf dem eigenen
GPU-Server — die Aufnahmen gehen verschlüsselt dorthin und zu keinem
fremden Anbieter.