
Podcast-Shownotes automatisch erstellen (Workflow 2026)
Summarize this article with:
Du kannst aus rohem Audio in vier Schritten einen kompletten ersten Entwurf für Podcast-Shownotes erzeugen: Episode transkribieren, das Transkript mit einem strukturierten Prompt an ein KI-Modell geben, für Genauigkeit und Stimme bearbeiten, dann Links manuell hinzufügen. Die KI übernimmt etwa 80 Prozent der Arbeit. Die 20 Prozent, die du ergänzt, machen die Notizen menschlich.
Sie können aus einer rohen Podcast-Aufnahme in unter einer Stunde vollständige Shownotes erstellen, und zwar mit einer Automatisierungspipeline, die auf dem Transkript aufbaut. Die Schritte sind: Episode transkribieren, das Transkript mit einem strukturierten Prompt durch ein KI-Modell laufen lassen, für Genauigkeit korrigieren, dann Links hinzufügen. Das ist der gesamte Workflow. Alles hierunter sind die Details, die jeden Schritt zum Funktionieren bringen.

Warum das Transkript zuerst kommt
Jeder zuverlässige Workflow für automatisierte Shownotes beginnt mit einem Transkript, nicht mit Audio, das direkt in ein Shownotes-Tool eingespeist wird. Ein Transkript liefert Ihnen ein festes, durchsuchbares Textdokument, das Sie überprüfen, bearbeiten und wiederverwenden können. Es ist auch die Grundlage für zeitgestempelte Kapitel mit echter Genauigkeit: Tools, die Zeitstempel allein aus Audio generieren, neigen dazu, abzudriften; Tools, die Wort-für-Wort-Zeitdaten aus einem Transkript lesen, treffen innerhalb weniger Sekunden.
Wenn Ihre Episode Fachbegriffe, ungewöhnliche Namen oder spezialisiertes Vokabular enthält, lesen Sie das rohe Transkript auf Fehler durch, bevor Sie es an die KI weitergeben. Die Korrektur von „Dr. Ramachandran" vor dem KI-Entwurf erspart Ihnen, es danach an fünf Stellen zu berichtigen.
ConvertAudioToText transkribiert Audio und Video in über 99 Sprachen, inklusive Sprecherkennung. Für englische Episoden generiert es außerdem eine KI-Zusammenfassung, die Sie als Ausgangspunkt für Ihre Episodenbeschreibung nutzen können. Laden Sie den fertigen Schnitt hoch, nicht die rohe Aufnahme, damit das Transkript sauber bleibt.
Die Vier-Schritte-Automatisierungspipeline
Schritt 1: Transkribieren
Laden Sie Ihre bearbeitete Episodendatei hoch. Eine 45-minütige Episode wird je nach Dienst in etwa ein bis fünf Minuten verarbeitet. Sie möchten Sprecherkennung aktiviert haben und die Ausgabe als einfachen Text, den Sie leicht kopieren können. Exportieren Sie als TXT für den nächsten Schritt.
Schritt 2: KI-Modell für den Entwurf prompten
Öffnen Sie ChatGPT, Claude oder ein ähnliches Modell. Fügen Sie das Transkript ein und verwenden Sie einen Prompt, der die genaue Ausgabestruktur vorgibt, die Sie möchten. Ein Prompt, der funktioniert:
Du bist ein Podcast-Produzent. Erstelle anhand des untenstehenden Transkripts strukturierte Shownotes mit folgenden Abschnitten:
- Episodenzusammenfassung (150 Wörter, geschrieben für einen Hörer, der entscheidet, ob er die Episode abspielen soll)
- Behandelte Themen mit Zeitstempeln (Aufzählungsliste, Format: [MM:SS] Themenbeschreibung, ein Satz)
- Wichtige Zitate (3-5 eigenständige Zitate mit Sprecherangabe)
- Erwähnte Ressourcen (Buch/Werkzeug/Person/URL, liste alles auf, was du identifizieren kannst)
Transkript: [hier einfügen]
Die Ausgabe deckt grob 80 Prozent dessen ab, was du brauchst. Claude verarbeitet lange Transkripte besonders gut; einstündige Episoden lassen sich ohne Abschneidungsprobleme einfügen.
Speichere diesen Prompt irgendwo, wo du ihn jede Woche einfügen kannst. Ein gespeicherter Prompt ist die mit Abstand effektivste Zeitinvestition in diesem Workflow.
Schritt 3: Für Genauigkeit und Stimme bearbeiten
Lies jede Zeile des KI-Entwurfs. Die häufigen Fehlerquellen sind:
Generische Themenbeschreibungen. KI schreibt oft „bespricht Produktivitätsstrategien“, wenn das eigentliche Argument war „argumentiert, dass To-do-Listen falsche Dringlichkeit erzeugen und durch Zeitblockierung ersetzt werden sollten“. Mache die Beschreibung spezifisch.
Falsche Sprecherzuordnung bei Zitaten. Wenn zwei Stimmen akustisch ähnlich sind, können Transkription oder KI sie vertauschen. Überprüfe jeden zitierten Sprecher anhand deiner Erinnerung an das Gespräch.
Verpasste Nuancen bei spezialisierten Themen. Medizinische, rechtliche, finanzielle und technische Episoden haben oft Unterscheidungen, die für das Publikum wichtig sind. Die KI-Zusammenfassung wird sie einebnen. Stelle die Spezifität für die Teile wieder her, die deinen Hörern am meisten am Herzen liegen.
Fehler bei Gastname und Zugehörigkeit. Überprüfe vor der Veröffentlichung immer die Schreibweise des Gastnamens, seinen aktuellen Titel und sein Unternehmen.
Plane 10-15 Minuten für diesen Durchgang ein.
Schritt 4: Links manuell hinzufügen
Gehe den Ressourcenbereich Zeile für Zeile durch und füge zu jedem Buch, Tool, jeder Person, Studie und jedem Unternehmen, das erwähnt wird, eine URL hinzu. Das ist der manuellste Teil des Workflows und es gibt keinen zuverlässigen Weg, das vollständig zu automatisieren. KI-Modelle erfinden URLs in nennenswertem Umfang, also überprüfe jeden Link, bevor du veröffentlichst.
Eine einfache Textdatei mit deinen am häufigsten referenzierten Ressourcen spart Zeit über mehrere Episoden hinweg. Wenn du jeden Monat dieselben drei Produktivitäts-Apps besprichst, reicht ein einziger Nachschlagevorgang.
Was die KI richtig macht
Die Generierung von Show Notes durch KI ist bei drei Aufgaben wirklich zuverlässig.
Timestamp-Extraktion. Mit einem Transkript, das Timing auf Wortebene enthält, erzeugt KI Kapitelmarker auf der richtigen Granularitätsstufe: spezifisch genug für die Navigation, aber nicht so fein, dass sie zu Rauschen werden.
Zusammenfassungen schreiben. Ein gut gepromptetes Modell erzeugt eine Episodenzusammenfassung, die das tatsächliche Argument erfasst, nicht nur das oberflächliche Thema. Das ist der Abschnitt, den Hörer lesen, wenn sie entscheiden, ob sie die Episode abspielen. Gute KI-Ausgabe hier kann mit dem mithalten, was die meisten Menschen in Eile schreiben.
Entitätserkennung. Bücher, Tools, Personen und Unternehmen, die in der Episode erwähnt werden, werden zuverlässig herausgezogen. Die verbleibende Arbeit ist nur das Hinzufügen von Links.
Was die KI falsch macht
Drei Fehlermuster treten regelmäßig auf.
Halluzinierte URLs. KI-Modelle erfinden selbstbewusst URLs, die es nicht gibt. Veröffentliche niemals einen Link aus KI-Ausgabe, ohne ihn zu prüfen.
Vage Themenbeschreibungen. „Spricht über E-Mail" statt „erklärt, warum Inbox-Zero eine Zeitfalle für Wissensarbeiter ist." Korrigiere jede generische Beschreibung.
Falsch zugeordnete Zitate in Episoden mit mehreren Sprechern. Je mehr Sprecher in der Episode, desto höher die Fehlerquote. Ein Transkript mit guten Sprecherlabels reduziert das Problem, beseitigt es aber nicht.
Die Show-Notes-Struktur, die funktioniert
Deine KI-Ausgabe sollte einer konsistenten Struktur folgen. Die vollständige Vorlage mit Formatierungshinweisen findest du im Beitrag Podcast Show Notes Vorlage. Die Kurzfassung: eine Zusammenfassung von 150 Wörtern, Zeitstempel zu den Themen, drei bis fünf Schlüsselzitate, eine Ressourcenliste und das vollständige Transkript. Diese Struktur bedient drei Zielgruppen gleichzeitig: Hörer, die entscheiden, ob sie reinhören, Suchmaschinen, die die Seite indexieren, und wiederkehrende Hörer, die eine erwähnte Ressource suchen.
Zur Wortanzahl: Effektive Show Notes umfassen 800 bis 2000 Wörter vor dem Transkript. Ein einzelner Absatz nützt niemandem.
SEO in einem Absatz
Das vollständige Transkript ist das wichtigste SEO-Asset der Seite, nicht die Zusammenfassung. Veröffentliche es. Verwende spezifische Long-Tail-Phrasen in deinen Themenbeschreibungen („ADHS-Aufgabenmanagement für Remote-Mitarbeiter“ schlägt „Produktivitätstipps“). Verlinke jede neue Episode mit zwei oder drei verwandten Episoden, um mit der Zeit eine interne Linkstruktur aufzubauen. Für tiefere Mechanismen deckt der vollständige Leitfaden zur Transkription für Podcaster ab, was Rankings tatsächlich bewegt.
Den Workflow nach Genre anpassen
Interview-Podcasts. Lege mehr Gewicht auf die Gast-Biografie und den Zitate-Bereich. Der KI-Entwurf der Gast-Biografie ist meist generisch; füge eine spezifische Qualifikation hinzu, die für dieses konkrete Gespräch relevant ist.
Solo-Podcasts. Überspringe den Abschnitt zur Gast-Biografie. Erweitere die Ressourcenliste, da Solo-Episoden oft mehr Material zitieren.
Nachrichten und Kommentare. Der Ressourcenbereich wird zu einem Abschnitt mit verlinkten Quellen. Das Transkript ist hier besonders wichtig, weil Hörer zurückkehren, um Fakten zu überprüfen.
Bildung und Tutorials. Die Liste mit Zeitstempeln zu den Themen ist der wertvollste Abschnitt. Mache jede Zeitstempelbeschreibung so spezifisch, dass ein Hörer direkt zu dem Konzept springen kann, das er wiederholen möchte.
Der Interview-Podcast-Workflow behandelt die spezifischen Bearbeitungs- und Veröffentlichungsmuster für Interview-Formate.
Die Mathematik des Zinseszinses
Ein wöchentlicher Podcast veröffentlicht 50 Folgen pro Jahr. Wenn der Automatisierungs-Workflow im Vergleich zum manuellen Schreiben der Shownotes 60 Minuten pro Folge spart, sind das 50 Stunden pro Jahr, die du zurückgewinnst. Bei 100 Folgen reicht die Zeitersparnis für eine komplette zweite Staffel.
Die Systeme, die du jetzt aufbaust, wirken wie Zinseszins. Ein gespeicherter Prompt, eine Referenzdatei für Ressourcen, eine konsistente Struktur, eine zuverlässige Transkriptionsquelle: Jedes davon kostet einmalig 30 Minuten und spart dir danach jede Woche 10 Minuten, auf unbestimmte Zeit.
Meine Einschätzung: Das schwächste Glied in den Shownotes-Workflows der meisten Podcaster ist weder das KI-Modell noch die Transkriptionsqualität. Es ist die Gewohnheit, den Schritt mit dem Hinzufügen von Links zu überspringen, weil er sich mühsam anfühlt. Diese Ressourcen-Links sind es, wegen derer frühere Hörer zurückkommen, und sie sorgen für Empfehlungs-Traffic von Autoren und Unternehmen, die du erwähnst. Überspringe Schritt vier nicht.
Wenn du ein Transkript ohne Meeting-Bot oder Abo für eine komplette Suite willst, verarbeitet das Audio-zu-Text-Tool von ConvertAudioToText Dateien direkt mit Sprecherkennung und exportiert eine saubere TXT-Datei, die du direkt in deinen KI-Prompt einfügen kannst.
FAQ
Was ist der schnellste Weg, um Podcast-Shownotes automatisch zu erstellen?
Transkribiere die Folge, füge dann das Transkript in ein KI-Modell (ChatGPT, Claude oder Gemini) ein, mit einem Prompt, der die gewünschten Abschnitte vorgibt: Zusammenfassung, Zeitstempel-Themen, Schlüsselzitate und Ressourcen. Eine 45-minütige Folge liefert in der Regel in unter fünf Minuten einen brauchbaren Entwurf. Plane 15 bis 20 Minuten für das Bearbeiten und das Hinzufügen von Links ein.
Brauche ich ein eigenes Shownotes-Tool oder reicht eine allgemeine KI?
Allgemeine KI-Modelle funktionieren gut, sobald du ein sauberes Transkript hast. Speziell entwickelte Tools wie Podsqueeze, Riverside und Cleanvoice kombinieren Transkription und Notizenerstellung in einem Schritt, was den Copy-Paste-Schritt überflüssig macht. Wenn du bereits einen Workflow für Transkriptionen hast, ist ein allgemeines KI-Modell mit einem gespeicherten Prompt oft schneller und günstiger.
Wie genau sind KI-generierte Zeitstempel in Podcast-Shownotes?
Die Genauigkeit hängt davon ab, ob das zugrunde liegende Transkript Zeitstempel auf Wortebene enthält. Wenn die Transkriptions-Engine Zeitdaten auf Wortebene liefert, sind KI-generierte Kapitelmarker meist auf wenige Sekunden genau. Wenn Zeitstempel aus der Absatzposition geschätzt werden, können sie bei längeren Episoden um 30 bis 60 Sekunden abweichen.
Sollte ich das vollständige Transkript zusammen mit den Shownotes veröffentlichen?
Ja. Das Transkript ist der wichtigste SEO-Aktivposten der Seite. Hörer, die Audio wollen, hören zu; Leser, die Text wollen, lesen. Ein vollständiges Transkript zu ergänzen, erweitert dein Publikum, statt es zu kannibalisieren, und es macht die Episode für gehörlose und schwerhörige Menschen zugänglich.
Wie lang sollten Podcast-Shownotes sein?
Shownotes, die Hörern, Suchmaschinen und wiederkehrenden Lesern dienen, umfassen in der Regel 800 bis 2000 Wörter. Das beinhaltet die Zusammenfassung, Zeitstempel zu Themen, einen Abschnitt mit Schlüsselzitaten, eine Ressourcenliste und das vollständige Transkript. Shownotes mit einem einzigen Absatz bedienen keine dieser Zielgruppen gut.
Quellen
- ConvertAudioToText Tools-Seite - Funktionsprüfung
- ConvertAudioToText Meeting-Transkription - Bestätigung der KI-Zusammenfassung und Exportformate
- Riverside Show-Notes-Funktion - Prüfung des Funktionsumfangs
- Podsqueeze - Prüfung der Show-Notes-Generierung
- Cleanvoice AI Podcast-Zusammenfassung - Funktionsprüfung
- Fello AI: 50 essentielle KI-Prompts für Podcaster 2026 - Recherche zu Prompt-Mustern
Try transcription free
Convert any audio or video to clean, unwatermarked text — speaker labels, timestamps, and AI summaries included. First 10 minutes free, no account.
Related Articles

Best Transcription Tool Alternatives, Honestly Compared (2026)
Leaving Otter, Descript, Transkriptor, Rev, or TurboScribe? Honest, sourced comparisons of every major transcription tool: real limits, verified pricing, and where each one genuinely wins.

Looking for a Transkriptor Alternative? Here's the Honest Math (2026)
Transkriptor meters your minutes and lets unused ones expire monthly. Here is its real 2026 pricing decoded, when staying is rational, and the unlimited alternatives at the same sticker price.