Sprache-zu-Text-Software

Sprache-zu-Text-Software, ohne Raterei

Laden Sie eine Audio- oder Videodatei hoch oder fügen Sie einen Link zu einer Aufnahme ein. Sie erhalten ein Transkript mit Sprecherkennzeichnung und Zeitstempeln in 99 Sprachen, dazu Zusammenfassungen, To-dos und saubere Exporte. Die ersten 10 Minuten jeder Datei sind kostenlos und ohne Konto.

Lieber diktieren als eine Datei hochladen? Live-Spracheingabe im Browser ausprobieren

Die ersten 10 Minuten jeder Datei sind ohne Konto kostenlos. Kostenlose Konten: 10 Transkriptionsminuten, einmalig. Pro: unbegrenzt, ab 9,99 $/Monat bei jährlicher Abrechnung.

So wandeln Sie Sprache in Text um

  1. 1
    Bringen Sie Ihr Audio mitLaden Sie eine MP3-, WAV-, M4A-, MP4-, MOV- oder WebM-Datei hoch oder fügen Sie einen öffentlichen Link zu einer Aufnahme ein. Das Audio wird automatisch aus dem Video extrahiert, Sie müssen vorher nichts konvertieren.
  2. 2
    Geben Sie die gesprochene Sprache anWählen Sie die Sprache, bevor Sie starten. Wer sie vorab angibt, lässt das Modell auf den richtigen Lautbestand optimieren statt zu raten – daher stammen die meisten Transkripte in der falschen Sprache. 99 Sprachen werden unterstützt, mit Ausgabe in der jeweiligen Originalschrift.
  3. 3
    Lesen, bearbeiten, exportierenIhr Transkript kommt mit Sprecherkennzeichnung und Zeitstempeln. Lesen und Kopieren ist kostenlos. Bezahlte Tarife ergänzen Downloads als TXT, PDF, DOCX, SRT, VTT und JSON sowie KI-Zusammenfassungen, To-dos und Entscheidungen.

Was Sie zurückbekommen

Sprecherkennzeichnung, die über die gesamte Aufnahme hinweg trennt, wer wann gesprochen hat
Zeitstempel auf Wortebene, zu denen Sie springen können, damit jedes Zitat überprüfbar bleibt
99 Sprachen mit Ausgabe in der Originalschrift, nicht als romanisierter Text
11 auf die Aufgabe zugeschnittene KI-Vorlagen für Interviews, Podcasts, Vorlesungen, Meetings und Forschung
To-dos, Entscheidungen und ein versandfertiger E-Mail-Entwurf aus dem Transkript, verfasst in der Sprache des Transkripts selbst
Ein echter Editor: ein Wort korrigieren, einen Kommentar hinterlassen, den Versionsverlauf behalten

Wie genau es ist, gemessen

Wir veröffentlichen eigene Zahlen statt eines Marketing-Prozentwerts. Über einen öffentlichen Testsatz aus sechs Dateien – saubere Sprache aus LibriSpeech, nigerianisch akzentuiertes Englisch aus OpenSLR 70 und ein Meeting mit vier Sprechenden aus dem AMI-Korpus – erreichte das Live-Produkt eine durchschnittliche Wortfehlerrate von 6.43 %, gemessen am July 24, 2026. Meeting-Audio mit Durcheinanderreden ist deutlich schwerer als saubere Sprache, und der Bericht weist jede Datei einzeln aus, auch die, bei denen wir am schlechtesten abschneiden.

Den vollständigen Bericht lesen

Was Nutzerinnen und Nutzer über die Transkripte sagen

How easy it makes working with other tools, it's speed and it's efficiency. The interface is well coded and visually appealing. This is an incredible tool.
David E. · Marketing Manager
Best transcription tool I've ever used. The accuracy is amazing and the turnaround time is incredibly fast. Highly recommend!
Emily K. · Journalist
The multilingual support is what sold me. Transcribes French and Spanish recordings just as well as English.
Sofia G. · Translator

Dieselbe Engine, per API

Wenn Sie Sprache-zu-Text in Ihr eigenes Produkt einbauen: Die Tarife Developer und Business bieten eine REST-API. Erstellen Sie einen Schlüssel im Dashboard, senden Sie eine Datei oder eine URL, fragen Sie das Ergebnis ab und lesen Sie das Transkript mit Zeitstempeln und Sprecherkennzeichnung zurück. Webhook-Rückrufe gehören zum Business-Tarif.

Tarife mit API ansehen

Häufige Fragen

Ist Sprache zu Text kostenlos?
Die ersten 10 Minuten jeder Datei werden ohne Konto kostenlos transkribiert. Ein kostenloses Konto ergänzt 10 Transkriptionsminuten, einmalig vergeben statt nachgefüllt, einlösbar mit bis zu 3 Dateien pro Tag und je 10 Minuten. Text lesen und kopieren bleibt kostenlos; Datei-Downloads und unbegrenzte Länge kommen mit einem bezahlten Tarif ab 9,99 $/Monat bei jährlicher Abrechnung.
Wie genau ist Sprache zu Text?
Das hängt weit mehr vom Audio ab als vom Werkzeug. Bei sauberer Sprache mit nahem Mikrofon liegt unsere gemessene Wortfehlerrate bei etwa 1 %. Bei einem Meeting mit vier Sprechenden und Durcheinanderreden steigt sie über 20 %. Wir veröffentlichen den vollständigen Testsatz auf unserer Genauigkeitsseite, statt eine einzelne Zahl zu nennen. Rechnen Sie damit, Namen, Fachbegriffe und alles über Hintergrundgeräuschen Gesprochene nachzulesen.
Welche Sprachen werden unterstützt?
99 Sprachen, wobei das Transkript in der Originalschrift der jeweiligen Sprache geschrieben wird: Arabisch in arabischer Schrift, Hindi in Devanagari, Japanisch in Kana und Kanji. Wählen Sie die Sprache vor dem Hochladen. KI-Zusammenfassungen und To-dos entstehen in derselben Sprache wie das Transkript, nicht ins Englische übersetzt.
Kann ich Sprache aus einem Video umwandeln?
Ja. Laden Sie MP4, MOV, WebM oder MKV hoch, die Tonspur wird für Sie extrahiert – Sie müssen das Video vorher nicht konvertieren. Sie können statt eines Uploads auch einen öffentlichen Link zu einer Aufnahme einfügen.
Erkennt es, wer gerade spricht?
Ja. Die Sprecherdiarisierung läuft bei jedem Transkript: Sie trennt die Stimmen und kennzeichnet sie als Sprecher 1, Sprecher 2 und so weiter. Die echten Namen kennt sie nicht – Sie benennen eine Person einmal im Editor um, und die Kennzeichnung ändert sich im gesamten Transkript.
Was passiert danach mit meinem Audio?
Dateien im kostenlosen Tarif werden innerhalb von 7 Tagen gelöscht. Bezahlte Tarife lassen Sie die Aufbewahrungsdauer wählen – standardmäßig 30 Tage, bis hin zu unbefristetem Behalten – und Sie können jede Datei jederzeit selbst löschen.

Machen Sie aus Ihrer ersten Aufnahme Text

Nichts zu installieren, keine Karte. Die ersten 10 Minuten gehen auf uns.

Jetzt transkribieren