Die Handy-Tastatur ist für ernsthafte Texte ungefähr so geeignet wie ein Taschenmesser für eine Operation. Diktieren wäre die Lösung – aber viele (zumimdest ich) scheitern immer wieder daran. Und zwar nicht an der Technik, denn die Transkription ist längst gut genug. Woran es hakt, ist eine Fähigkeit, die wir nie gelernt haben: reden, um zu schreiben. Genau darum geht es jetzt. Vielleicht ist das ein Weg, der auch für dich funktioniert.
Ich sage das als jemand, der es mehrfach versucht und mehrfach vergeigt hat. Ich habe mir Stichpunkte gemacht und bin trotzdem abgeschweift. Ich war beim Diktieren irgendwie aufgeregt, als würde jemand zuhören. Und ich habe es im Dialog mit einer KI versucht, die mich strukturieren sollte – und die dann so viel geredet hat, dass der Druck größer wurde statt kleiner. Falls dir das bekannt vorkommt: Es liegt nicht an dir. Es liegt an zwei Denkfehlern, die fast jeder macht.
Warum klappt das nicht einfach so?
Denkfehler eins: Du versuchst, druckreif zu sprechen. Gesprochene und geschriebene Sprache sind zwei verschiedene Systeme. Wer diktiert und dabei fertige Sätze produzieren will, macht zwei Jobs gleichzeitig – reden und redigieren. Das ist, als würdest du ein Interview führen und parallel den fertigen Artikel im Kopf setzen. Kein Redakteur arbeitet so. Erst kommt das Gespräch, dann das Redigat.
Denkfehler zwei: Du machst aus dem Diktat ein Gespräch. Die Voice-Modes der KI-Assistenten sind Dialoge – die KI antwortet, fragt nach, schlägt vor. Klingt hilfreich, erzeugt aber Gesprächsdruck: Du musst reagieren, statt zu denken. Und wenn dein Gegenüber dann auch noch viel redet, wird aus dem entspannten Denken-beim-Gehen eine Prüfungssituation.
Das bedeutet konkret: Nicht das Diktieren ist das Problem. Das Problem ist dein Ziel beim Reden und das Format. Beides lässt sich ändern.
Probier das aus: Diktiere heute eine einzige Sprachnotiz von zwei Minuten zu irgendeinem Thema – mit der Regel, dass daraus kein Text werden muss. Nur reden. Du wirst merken, wie viel lockerer das geht, sobald die Messlatte weg ist. Und ich fand, dass zwei Minuten ganz schön lang sind 😉
Es gibt noch einen Tipp, wie wir unserem Kopf das Denken in Textstruktur vereinfachen können: Sprich Punkt, Komma und Absätze mit. Das müsste beim Reden mit KI gar nicht sein. Aber es scheint unser Gehirn in einen strukturierteren Modus zu bringen.
Was heißt hier eigentlich „diktieren“?
Vergiss das Bild vom Chef, der seiner Sekretärin druckreife Briefe in den Block diktiert. Das ist eine Kunstform, die jahrelange Übung in Formeln braucht – und ehrlich gesagt auch ziemlich tote Texte produziert.
Das neue Diktieren funktioniert anders, in drei sauber getrennten Phasen:
Phase 1: Der Braindump. Du sprichst fünf bis fünfzehn Minuten frei in die Diktierfunktion – wichtig: in die Transkription, nicht in den Gesprächsmodus. Niemand unterbricht, niemand antwortet. Abschweifen ist ausdrücklich erlaubt. In meiner Erfahrung sind die Abschweifungen sogar oft das beste Material: Da stecken die Anekdoten, die Vergleiche, die Sätze, die du am Schreibtisch nie getippt hättest.
Phase 2: Der Struktur-Spiegel. Erst jetzt kommt die KI ins Spiel – und zwar mit einem strengen Maulkorb. Sie bekommt dein Transkript und darf genau drei Dinge liefern: die Kernthese in einem Satz, eine Gliederung in Stichworten, und deine stärkste Formulierung als wörtliches Zitat. Plus höchstens eine Frage. Kein Lob, keine Vorschläge, kein Coaching-Ton.
Phase 3: Die Regie. Aus Gliederung und Rohmaterial entsteht ein Entwurf. Den liest du – und diktierst dann keine Formulierungen, sondern Anweisungen: „Absatz zwei raus. Das Beispiel mit dem Verlag nach vorne. Der Einstieg ist zu brav.“ Das ist der Trick an der Sache: Regieanweisungen zu sprechen ist leicht, weil du dabei nicht performen musst. Meckern kann jeder, auch aufgeregt.
Probier das aus: Nimm einen alten, halbfertigen Text und übe nur Phase 3 – lies ihn am Handy und sprich deine Änderungswünsche ein. Das ist der schnellste Einstieg, weil hier gar nichts schiefgehen kann.
Und die Aufregung?
Die verschwindet nicht durch gutes Zureden, sondern durch niedrige Fallhöhe und Wiederholung. Wie beim Instrument-Lernen: Niemand fängt mit dem Konzert an, man fängt mit Tonleitern an, die keiner hört.
Übersetzt in einen Trainingsplan:
- Stufe 1: Kurzformate. Social-Media-Posts, 500 Zeichen. Wenn’s schiefgeht, hat es drei Minuten gekostet. Ziel dieser Stufe ist nicht der Post – Ziel ist, dass du aufs Mikro drückst, ohne vorher den ersten Satz im Kopf zu bauen.
- Stufe 2: Textbausteine. Ein Abschnitt aus einem Newsletter, eine Produktbeschreibung, ein Absatz für einen Artikel. 100 bis 300 Wörter, die wirklich veröffentlicht werden.
- Stufe 3: Ganze Texte. Erst hier kommen längere Braindumps und komplette Artikel. Und erst hier lohnt sich die nächste Ausbaustufe: dass du nach der Gliederung Absatz für Absatz selbst diktierst und die KI nur noch glättet – damit der Text wirklich nach dir klingt und nicht nach Maschine.
Dazu drei Regeln, die auf allen Stufen gelten:
- Diktiere im Gehen. Bewegung taktet das Sprechen, und ein Spaziergang fühlt sich nicht nach Prüfung an. Der Schreibtisch ist fürs Diktieren womöglich der schlechteste Ort überhaupt.
- Nie abbrechen und neu anfangen. Ein Neustart trainiert deinen Perfektionismus. Weiterreden trainiert das Diktieren. Versprecher stehen lassen – die Transkription verzeiht mehr, als du denkst.
- Abschweifungen laut benennen. Ein kurzes „kleiner Umweg:“ ins Mikro, und der Druck ist weg, heimlich zurückfinden zu müssen.
Probier das aus: Sende auch die Sessions ab, die sich komplett verunglückt anfühlen. Du wirst überrascht sein, was die KI daraus noch zieht – und genau das kalibriert dein Gefühl dafür, wie schlecht Rohmaterial sein darf. (Spoiler: ziemlich schlecht.)
Welcher Prompt macht die KI zum guten Zuhörer?
Der entscheidende Punkt ist: Die KI braucht Regeln, bevor du diktierst – am besten als feste Projekt-Anweisung bzw. als Skill, damit du sie nicht jedes Mal mitschicken musst. Hier ist eine Vorlage, die du an dein Tool anpassen kannst:
Ich diktiere unterwegs am Handy. Meine Nachrichten sind Sprach-Transkripte:
mäandernd, mit Füllwörtern, manchmal mit Erkennungsfehlern. Das ist gewollt.
Wenn ich dir ein Roh-Diktat schicke:
- Antworte in maximal 150 Wörtern.
- Liefere genau drei Dinge:
(1) die Kernthese in einem Satz,
(2) eine Gliederung aus 3–5 Stichworten,
(3) meine stärkste Formulierung, wörtlich zitiert.
- Stelle höchstens EINE Frage – nur wenn etwas Entscheidendes fehlt.
- Keine Vorschläge, keine Bewertung, kein Lob.
Wenn ich "Draft" sage:
- Schreibe den Text aus meinem Rohmaterial. Übernimm meine
Formulierungen wörtlich, wo es geht. Markiere alles, was von dir
statt von mir stammt, mit [NEU].
Wenn ich Änderungsanweisungen diktiere:
- Führe genau das aus. Keine ungefragten Verbesserungen anderswo.
- Antworte nur mit dem geänderten Text.
Zwei Details daraus sind wichtiger, als sie aussehen. Das wörtliche Zitat in Phase 1 zeigt dir jedes Mal, dass in deinem Gebrabbel brauchbare Sätze stecken – das baut mehr Vertrauen auf als jedes Lob. Und der [NEU]-Marker im Draft macht sichtbar, wie viel Text wirklich von dir kommt. Wenn da zu viel [NEU] steht, hast du zu wenig diktiert – dann ist der Text nicht mehr deiner, sondern der der Maschine. Und das merken deine Leser, so eine Art Beipackzettel-Ton, den man nicht genau benennen kann, aber sofort spürt.
Kurz gesagt
Diktieren lernen heißt nicht, druckreif sprechen zu lernen. Es heißt, drei Dinge zu trennen, die du beim Tippen unbewusst vermischst: denken, strukturieren, redigieren. Das Denken machst du sprechend, im Gehen, ohne Publikum. Das Strukturieren macht eine KI mit Maulkorb. Das Redigieren machst du wieder sprechend – als Regisseur, nicht als Autor am Blatt.
Fang mit dem kleinsten Format an, das du hast. Heute. Zwei Minuten, ein Thema, keine Erwartung. Der Rest ist Tonleitern üben.


Schreibe einen Kommentar