Wenn du ein Transkript schon hast, brauchst du kein weiteres Werkzeug, sondern eine bessere Anweisung. Du gibst den Text in ChatGPT, Claude oder Microsoft Copilot und bittest nicht um eine Zusammenfassung, denn genau das ist der Fehler, der aus einem Protokoll eine Nacherzählung macht. Die Anweisung, die trägt, verlangt vier getrennte Blöcke: Kopf mit Datum und Teilnehmern, Beschlüsse im Präsens, Aufgaben mit Zuständigem und Frist, offene Punkte. Dazu drei Regeln, die den Unterschied zwischen brauchbar und gefährlich ausmachen: nur verwenden, was im Transkript steht, zu jedem Punkt die Zeitmarke der Belegstelle nennen, und alles Unsichere in einen fünften Block „unklar" schreiben statt zu raten. Danach folgt ein zweiter Durchgang, in dem das Modell zu jedem Beschluss und jeder Aufgabe den wörtlichen Satz aus dem Transkript zitieren muss und alles streicht, wofür es keinen findet. Belegt heißt aber noch nicht richtig eingeordnet, deshalb siehst du Zuständigkeiten, Fristen und die Frage Beschluss oder Idee selbst an. Und bevor der Text irgendwo hineingeht: Namen, Firmen, Beträge und private Details, die nicht ins Protokoll gehören, nimmst du vorher heraus.
Ich tippe bei solchen Aufgaben keinen Prompt mehr neu, sondern benutze eine gespeicherte Anweisung. Darin liegt der ganze Trick: Der Unterschied zwischen unbrauchbar und brauchbar liegt nicht am Modell, sondern an fünf Zeilen Text. Wie ich Prompts aufbaue, steht in Claude-Prompts, die im Alltag funktionieren, und welche Aufgaben sich für so eine Übergabe eignen, klärt Welche Aufgaben du an KI abgeben kannst.
Warum „fasse zusammen" das Falsche liefert
Eine Zusammenfassung verdichtet den Gesprächsverlauf, ein Protokoll die Ergebnisse. Bittest du um das Erste, bekommst du das Erste: kein Fehler des Modells, sondern eine korrekt ausgeführte Anweisung. In meiner Praxis liefern die drei Varianten drei verschiedene Sorten Text.
Die dritte Variante funktioniert, weil sie dem Modell eine Ablage vorgibt. Fehlt sie, entscheidet das Modell selbst, was wichtig war, und diese Entscheidung ist dann nicht deine.
Das Transkript übergeben: Datei oder eingefügter Text
Beides geht, die Länge entscheidet: Kurze Gespräche fügst du direkt ein, lange gibst du als Datei dazu. Claude nimmt in der Chat-Oberfläche laut Anbieter bis zu 20 Dateien je Unterhaltung mit bis zu 500 MB je Datei an (Hilfeartikel, Stand 23. Juli 2026). Bei einem reinen Texttranskript wird meist das Kontextfenster zuerst eng, also wie viel Text das Modell gleichzeitig im Blick behält, nicht die Dateigrenze. Beide Grenzen bleiben aber bestehen: Scans, Bilder oder große PDF erreichen auch die Dateigrenze. Wird die zweite Hälfte des Protokolls spürbar dünner als die erste, teilst du das Transkript nach Zeitabschnitten und führst die Teilprotokolle zusammen. Lange Eingaben gehören dabei nach oben, vor die Anweisung: Anthropic empfiehlt ausdrücklich, umfangreiche Dokumente über Frage und Anweisungen zu stellen.
Zwei Dinge wirf vorher nicht weg. Die Sprecherkennzeichnung, weil ohne sie keine Aufgabe einer Person zugeordnet werden kann und im Protokoll „jemand kümmert sich" steht. Und die Zeitstempel, weil sie später die Belegstelle sind, mit der du jeden Punkt nachprüfst. Beide kommen aus automatischer Erkennung und können danebenliegen, bei der Sprecherzuordnung wie bei der Zeit.
Kommt dein Transkript aus Microsoft Teams, holst du es dort als Datei ab. Wo die Funktion sitzt, was der Administrator freigeben muss und wie lange Teams die Dateien hält, steht in Telefonate in Teams transkribieren. Was Teams, Zoom und Meet von sich aus an Protokoll liefern, vergleicht Meeting-Protokoll automatisch erstellen.
Was du vorher herausnimmst
Ein Transkript in ein allgemeines Sprachmodell zu geben heißt: Gesprächsinhalt an einen Anbieter geben. Kein Grund, es zu lassen, aber einer, vorher zwei Minuten zu investieren. Ich ersetze Namen durch die Rolle, Firmennamen durch die Branche, Beträge durch die Größenordnung und Orte durch die Region. Passagen ohne Bezug zur Sache, also Gesundheit, Familie, private Finanzen, lösche ich ganz, statt sie zu ersetzen. Die Liste, welche Rolle zu welcher Person gehört, bleibt lokal bei mir. Fürs Protokoll verliere ich damit nichts: „Geschäftsführerin" trägt eine Aufgabenzeile genauso gut wie ein Nachname, solange nur eine im Gespräch war. Anonym ist der Text damit nicht: Solange die Liste existiert und Rolle, Branche und Betragsspanne zusammen auf eine Person führen können, bleibt er pseudonymisiert und damit personenbezogen (Art. 4 Nr. 5 DSGVO). Das senkt das Risiko, es nimmt dir die Pflichten nicht ab.
Was der Anbieter danach mit dem Text macht, hängt weniger vom Logo ab als vom Tarif:
- Claude: Anthropic schreibt für die Verbraucher-Tarife, dass Unterhaltungen zur Verbesserung des Modells nur mit deiner Zustimmung genutzt werden und Inkognito-Chats auch dann ausgenommen sind, wenn die Modellverbesserung eingeschaltet ist (Hilfeartikel vom 16. März 2026).
- Microsoft Copilot im geschäftlichen Umfeld: „Prompts, responses, and data accessed through Microsoft Graph aren't used to train foundation LLMs", und für Nutzer in der EU gilt zusätzlich die EU Data Boundary. Microsoft weist im selben Artikel darauf hin, dass als Unterauftragsverarbeiter eingebundene Anthropic-Modelle derzeit davon ausgenommen sind (Artikel-Stand 9. Juli 2026).
- OpenAI-API: Laut Anbieterdokumentation werden über die API gesendete Daten nicht zum Training genutzt, Protokolle zur Missbrauchserkennung liegen standardmäßig bis zu 30 Tage, und für berechtigte Kunden gibt es Zero Data Retention. Das gilt für die API, nicht automatisch für dieselbe Firma in der Chat-Oberfläche.
Konkret heißt das: Sieh in den Datenschutz-Einstellungen deines Kontos nach, ob die Modellverbesserung an oder aus ist, bevor das erste Kundengespräch hineingeht. Und dann gilt noch die Stufe davor, die keine Einstellung löst: Das unbefugte Aufnehmen des nichtöffentlich gesprochenen Wortes ist nach § 201 StGB eine Straftat, nicht eine Ordnungswidrigkeit, und befugt wird die Aufnahme durch die vorherige Zustimmung aller anderen Beteiligten. Wie eine tragfähige Einwilligung aussieht und was die DSGVO für die spätere Verarbeitung verlangt, steht in Gespräche transkribieren: was rechtlich gilt. Ich bin Entwickler und kein Anwalt, das hier ist Arbeitsgrundlage und keine Rechtsberatung.
Die Anweisung, die du übernehmen kannst
Das ist die Vorlage, die ich gespeichert habe. Sie funktioniert wortgleich in ChatGPT, Claude und Copilot, weil sie nichts Produktspezifisches enthält.
Du bist Protokollant. Unten steht das Transkript einer Besprechung.
<transkript>
[Transkript einfügen, mit Sprecherkennzeichnung und Zeitstempeln]
</transkript>
Schreibe daraus ein Ergebnisprotokoll, keine Zusammenfassung.
Halte dich genau an diese Gliederung:
1. Kopf: Datum, Anlass, Teilnehmer, Dauer. Nur, was im Transkript steht.
2. Beschlüsse: je ein Satz im Präsens, der beschreibt, was ab jetzt gilt.
Dahinter in Klammern die Zeitmarke der Stelle, an der es beschlossen wurde.
3. Aufgaben: Tabelle mit den Spalten Aufgabe, Zuständige Person, Frist,
Zeitmarke. Ohne benannte Person kommt die Zeile nicht in diese Tabelle,
sondern unter Punkt 4.
4. Offene Punkte: alles, was nicht entschieden wurde, mit der Frage, die
offen geblieben ist, und, falls genannt, wann und von wem sie
entschieden wird.
5. Unklar: alles, wo du nicht sicher bist, wem etwas zuzuordnen ist, was
gemeint war oder ob es ein Beschluss war. Lieber hier eintragen als raten.
Regeln:
- Verwende ausschließlich, was im Transkript steht. Nutze kein
Allgemeinwissen und ergänze nichts, was plausibel klingt.
- Erfinde keine Namen, keine Zahlen, keine Termine. Steht im Transkript
"nächste Woche", schreib "nächste Woche", nicht ein Datum.
- Bewerte nicht und empfiehl nichts.
- Bleibt ein Abschnitt leer, schreib "keine".
- Gib zu jedem Punkt unter 2, 3 und 4 die Zeitmarke an. Findest du keine
Belegstelle, gehört der Punkt unter Punkt 5.
Zwei Details darin tragen mehr, als sie aussehen. Der Block „unklar" gibt dem Modell einen erlaubten Ausweg. Anthropic nennt „Allow Claude to say 'I don't know'" in seiner Anleitung gegen Halluzinationen als erste Grundtechnik und schreibt dazu, sie könne Falschinformationen deutlich verringern. Die Zeitmarken-Pflicht zwingt zu einer Belegstelle je Aussage, was dieselbe Anleitung unter „Ground responses in quotes" empfiehlt. Eine Formulierung fehlt bewusst: die Bitte um schöne Sprache. Ein Protokoll soll nicht gut klingen, es soll stimmen.
Der zweite Durchgang gegen Erfundenes
Das fertige Protokoll ist ein Entwurf, kein Ergebnis. Microsoft schreibt zu den eigenen Copilot-Ausgaben, dass die Antworten generativer KI nicht garantiert zu hundert Prozent faktisch sind und man sie vor dem Weiterleiten prüfen soll. Deshalb hänge ich einen zweiten Prompt an, der im selben Chat läuft:
Prüfe jetzt dein eigenes Protokoll gegen das Transkript.
Zitiere zu jedem Beschluss und jeder Aufgabe wörtlich den Satz aus dem
Transkript, auf den du dich stützt.
Findest du keinen wörtlichen Beleg, streich den Punkt und schreib an seine
Stelle: [gestrichen, kein Beleg].
Nenne am Ende die Punkte, deren Beleg nur teilweise trägt.
Das ist die Technik, die Anthropic als „Verify with citations" beschreibt: jede Aussage mit einem Zitat belegen lassen und zurückziehen, wenn sich keines findet. Der Durchgang prüft allerdings den Wortlaut, nicht die Einordnung: Ein Satz kann wörtlich belegt und trotzdem der falschen Person oder der falschen Kategorie zugeordnet sein. Danach bleiben drei Stellen, die du selbst ansiehst, weil kein Modell sie aus dem Text ableiten kann:
- Zuständigkeiten. „Machst du das?" ergibt keinen Namen. Wenn im Protokoll ein Name steht, der im Transkript nicht gefallen ist, ist er geraten.
- Fristen. „Nächste Woche" ist kein Datum. Ein Modell, das daraus den 27. macht, hat gerechnet und nicht gelesen.
- Beschluss oder Idee. Ob „wir sollten das mal prüfen" ein Auftrag war, entscheidet der Kontext im Raum, nicht der Wortlaut.
Wenn aus einem Protokoll fünfzig werden
Bis hierher geht es um ein Gespräch, und für die meisten Besprechungen ist damit Schluss. Führst du Kundengespräche, fängt etwas anderes an: Nach fünfzig Calls hast du fünfzig richtige Protokolle und immer noch keine Antwort darauf, welche Frage deine Kundinnen und Kunden immer wieder stellen und welche deiner eigenen Antworten am besten funktioniert hat.
Genau dafür gibt es Gustav, meinen KI-Mitarbeiter für die Auswertung von Call-Transkripten. Sein erster Arbeitsschritt ist keine Auswertung, sondern derselbe Ersetzungspass wie oben, fest verdrahtet statt optional, mit der Gegenprobe, ob Rolle, Branche und ein seltener Inhalt zusammen doch wieder auf eine Person zeigen. Besteht ein Eintrag sie, ist er anonym im Sinne von Erwägungsgrund 26 DSGVO, sonst bleibt er pseudonymisiert und bekommt Zweck, Frist und Zugriffsschutz. Die Spracherkennung läuft über ein lokales Whisper-Modell, verarbeitet wird in Etappen von zehn bis zwanzig Gesprächen mit einer Stichprobe nach jeder. Sein Produkt ist nicht das einzelne Protokoll, sondern ein Muster-Register: die wiederkehrenden Fragen samt deiner besten eigenen Antwort, woraus Playbook, FAQ, Einwand-Bibliothek und Rohstoff für Beiträge werden. Was er nicht liefert, ist eine neue Meinung. Wie das Verfahren im Einzelnen abläuft, steht in Gesprächsanalyse mit KI: das Muster-Register, welche Daten bei mir in Richtung KI gehen in KI und Datenschutz: was die KI sehen darf, und die übrigen Rollen sammle ich unter KI-Mitarbeiter.
Häufige Fragen
Kann ChatGPT ein Protokoll aus einem Transkript schreiben?
Ja, und ebenso in Claude oder Copilot, nicht nur in ChatGPT. Entscheidend ist die Anweisung: Wer um eine Zusammenfassung bittet, bekommt Fließtext über den Gesprächsverlauf. Wer eine Gliederung aus Beschlüssen, Aufgaben mit Zuständigem und Frist sowie offenen Punkten vorgibt und Belegstellen verlangt, bekommt ein Protokoll, das man weiterverschicken kann.
Was ist der Unterschied zwischen Zusammenfassung und Protokoll?
Eine Zusammenfassung bildet ab, worüber gesprochen wurde, ein Protokoll, was jetzt gilt. Die Zusammenfassung ist ein Rückblick, das Protokoll eine Vorgabe für die Zukunft. Deshalb besteht ein Protokoll aus Beschlüssen, Aufgaben und Fristen, und deshalb ist die Aufgabe ohne Namen und Datum keine Aufgabe, sondern ein Wunsch.
Ist Copilot dafür besser als ChatGPT oder Claude?
Für die Protokollarbeit selbst macht die Anweisung den Unterschied, nicht das Produkt. Copilot hat den praktischen Vorteil, dass er im geschäftlichen Umfeld ohnehin an den Microsoft-Daten sitzt, aus denen das Transkript kommt. Bei der Datenfrage unterscheiden sich die Anbieter deutlicher als bei der Textqualität, dort lohnt der Blick in den Tarif.
Darf ich ein Kundengespräch einfach in ein Sprachmodell geben?
Zwei Stufen, die oft vermischt werden. Das unbefugte Aufnehmen des nichtöffentlich gesprochenen Wortes ist nach § 201 StGB eine Straftat, befugt wird die Aufnahme durch die vorherige Zustimmung aller anderen Beteiligten. Die spätere Verarbeitung durch einen Anbieter braucht eine eigene Rechtsgrundlage nach DSGVO. Praktisch heißt das: vorher fragen, Namen ersetzen, Aufbewahrungsfrist setzen.
Wie erkenne ich, ob das Modell etwas erfunden hat?
Über den zweiten Durchgang: zu jedem Beschluss und jeder Aufgabe ein wörtliches Zitat aus dem Transkript verlangen und alles streichen lassen, wofür sich keines findet. Das findet Erfundenes, nicht Fehleinordnungen. Von Hand prüfst du danach drei Stellen, an denen erfahrungsgemäß geraten wird: Namen, die im Gespräch nie gefallen sind, aus vagen Angaben gerechnete Daten und Ideen, die zu Beschlüssen befördert wurden.
Wie du weitermachst
Nimm dein letztes Transkript und lass es zweimal laufen: einmal mit „fasse das zusammen", einmal mit der Anweisung von oben samt Prüfdurchgang. Der Abstand zwischen beiden Ergebnissen ist genau der Teil der Arbeit, den du bisher von Hand oder gar nicht gemacht hast. Ob eine Aufgabe wie diese überhaupt an KI gehört, entscheide ich vorher an der Frage, welches Problem sie lösen soll; wie ich dabei vorgehe, steht in meiner KI-Strategie. Deine eigene Fassung der Anweisung baust du nicht allein: Andere teilen ihre, und in den Calls gehen wir deine gemeinsam durch.
Und wenn du danach nicht ein Gespräch, sondern deinen ganzen Stapel auswerten willst, liegt Gustav als fertiges Paket in meiner Community, mit Anonymisierungs-Pass, Einwilligungs-Vorlagen und einem erfundenen Demo-Transkript zum Üben. Die Vorlagen sind Muster ohne Gewähr und ersetzen keine anwaltliche Prüfung deines Falls. Alles dazu unter Community.