Wie nutzen Sie Sprachdiktat in Cursor? Sie haben zwei Optionen. Der integrierte Voice Mode von Cursor (Cmd+Shift+Space) diktiert Prompts in den Agent. Eine systemweite Diktier-App wie Weesper Neon Flow schreibt dagegen in jedes Feld: Agent, Cmd+K-Inline-Edit, Terminal, Kommentare und Commit-Messages. Wenn Sie Weesper nutzen, verlegen Sie dessen Standard-Tastenkombination Shift+Tab, denn Cursor verwendet Shift+Tab zum Wechseln der Agent-Modi.

KI-Code-Editoren haben verändert, was Entwickler schreiben. In Cursor sind es immer öfter ganze Sätze: Anweisungen für den Agent, Änderungswünsche, Bug-Beschreibungen und Review-Notizen. Solche längeren Prompts lassen sich oft schneller sprechen als tippen. Dieser Leitfaden erklärt, wie Sie Sprachdiktat in Cursor einrichten, Prompts in Cursor diktieren, ohne dass Tastenkombinationen kollidieren, und wann Offline-Diktat in Cursor sinnvoll ist, wenn Sie Audio zu sensiblem Code lokal verarbeiten möchten.

Warum überhaupt Prompts in Cursor diktieren?

Gute Prompts sind oft lang und kosten beim Tippen Zeit. Wenn Sie sprechen, können Sie dem Agent den nötigen Kontext geben, ohne Ihre Anweisung zu verkürzen.

Sprachdiktat in Cursor bedeutet, in ein Mikrofon zu sprechen und Ihre Worte als Text in den Eingabefeldern von Cursor erscheinen zu lassen, meist im Agent-Prompt, sodass die KI darauf reagiert, als hätten Sie sie getippt.

Sprache funktioniert am besten für Aufgaben in natürlicher Sprache:

Für exakte Syntax funktioniert es schlecht. Einen regulären Ausdruck oder eine verschachtelte Typsignatur wollen Sie nicht diktieren; tippen Sie diese, und lassen Sie Ihre Stimme die Erklärung darum herum übernehmen. Unser Leitfaden zum Vibe Coding behandelt den breiteren Entwickler-Workflow; dieser Artikel konzentriert sich auf Cursor selbst.

Was macht der integrierte Voice Mode von Cursor?

Cursor 2.0, veröffentlicht am 29. Oktober 2025, führte Voice Mode ein. Das Changelog beschreibt es in einer Zeile: „Steuern Sie den Agent mit Ihrer Stimme durch integrierte Sprache-zu-Text-Umwandlung.”

So wird es verwendet:

  1. Öffnen Sie das Agent-Seitenpanel mit Cmd+I oder Cmd+L. Die Dokumentation von Cursor listet die Mac-Tastenkombinationen; unter Windows prüfen Sie Keyboard Shortcuts in den Einstellungen von Cursor.
  2. Drücken Sie Cmd+Shift+Space, um Voice Mode umzuschalten, oder klicken Sie auf das Mikrofon im Agent-Eingabefeld.
  3. Sprechen Sie Ihre Anweisung und prüfen Sie das Transkript, bevor Sie es senden.

Cursor erlaubt es außerdem, in den Einstellungen benutzerdefinierte Sende-Schlüsselwörter festzulegen, sodass ein gesprochenes Wort wie „senden” den Agent auslösen kann, ohne die Tastatur zu berühren.

Voice Mode ist bereits in Cursor enthalten und braucht keine zusätzliche Software, was es zum richtigen ersten Schritt macht. Seine Grenzen ergeben sich aus seinem Design: Es ist um den Agent-Prompt herum gebaut. Es hilft nicht, wenn Sie im Terminal schreiben, in einem Cmd+K-Inline-Edit, in einem GitHub-Pull-Request im Browser oder in Slack, während Sie die Änderung diskutieren. Das öffentliche Changelog und die Data-Use-Seite von Cursor geben außerdem nicht an, wo Voice Mode Ihr Audio verarbeitet — fragen Sie bei Cursor nach, falls das für Ihr Team relevant ist.

Integrierter Voice Mode im Vergleich zu einer systemweiten Diktier-App

Eine systemweite Diktier-App arbeitet auf Betriebssystemebene: Sie halten eine Tastenkombination gedrückt, sprechen, und der Text wird dort eingefügt, wo sich Ihr Textcursor befindet — in jeder Anwendung. Das verändert, was Sprache in einem Cursor-Workflow leisten kann.

Cursor Voice ModeSystemweite App (z. B. Weesper Neon Flow)
Agent-Prompt✅✅
Cmd+K-Inline-EditNicht der Fokus✅
Terminal-EingabezeileNicht der Fokus✅
Code-Kommentare, Commit-MessagesNicht der Fokus✅
Browser, Slack, E-Mail, Dokumente❌✅
Gesprochenes Sende-Schlüsselwort✅❌ (Sie drücken Enter)
Benutzerdefiniertes VokabularNicht dokumentiert✅ Benutzerdefiniertes Wörterbuch
Wo das Audio transkribiert wirdNicht dokumentiertAuf Ihrem Computer
Zusätzliche InstallationKeineDesktop-App (macOS oder Windows)

Nutzen Sie Voice Mode, wenn Sie hauptsächlich mit dem Agent sprechen und keine Einrichtung wollen.

Nutzen Sie eine systemweite App, wenn Sie in Cursor, im Terminal, im Browser und in Chat-Tools auf dieselbe Weise diktieren oder Fachbegriffe lokal transkribieren möchten. Viele Entwickler kombinieren beide Optionen: Voice Mode für schnelle Befehle an den Agent, die systemweite App für andere Eingabefelder. Laden Sie Weesper Neon Flow herunter, um es auf macOS oder Windows auszuprobieren.

Weesper Neon Flow für Cursor einrichten

Die Einrichtung dauert etwa fünf Minuten. Der einzige Cursor-spezifische Schritt ist die Tastenkombination.

1. Die Diktier-Tastenkombination von Shift+Tab verlegen

Das ist der Schritt, den die meisten übersehen. Cursor nutzt Shift+Tab, um über das Chat-Eingabefeld zwischen den Agent-Modi zu wechseln, zum Beispiel von Agent zu Plan. Weesper Neon Flow verwendet Shift+Tab sowohl auf macOS als auch auf Windows als Standard-Diktier-Tastenkombination.

Geben Sie jeder Tastenkombination eine einzige Aufgabe:

  1. Öffnen Sie bei Weesper Neon Flow Einstellungen → Tastenkombination.
  2. Klicken Sie auf das Tastenkombinationsfeld und drücken Sie eine neue Kombination. Die Fn-Taste funktioniert ebenfalls als Auslöser.
  3. Testen Sie sie im Agent-Eingabefeld von Cursor: halten, sprechen, loslassen.

Weesper verwendet Halten-zum-Sprechen: Die Aufnahme läuft, solange die Taste gedrückt ist, und stoppt, wenn Sie sie loslassen. Die Anleitung zur Tastenkombination behandelt Konflikte im Detail.

2. Das Vokabular Ihres Stacks lernen lassen

Sprachmodelle kennen Englisch, nicht Ihre Codebasis. Wörter wie „Tailwind”, „Zustand”, „pnpm”, „tRPC” oder Ihre internen Service-Namen sind die häufigste Fehlerquelle.

Fügen Sie sie einmal unter Einstellungen → Wörterbuch hinzu und ergänzen Sie Autokorrektur-Regeln für Wörter, die immer wieder falsch erkannt werden. Die Anleitung zum benutzerdefinierten Wörterbuch erklärt beides, und unser Artikel zu benutzerdefiniertem Vokabular für Fachbegriffe zeigt, wie Sie eine gute Liste aufbauen.

3. Einen wörtlichen Schreibstil für Prompts wählen

Die Ausgabestil-Presets von Weesper können Ihr Diktat umformulieren. Für Cursor-Prompts ist ein wörtlicher Stil meist besser: Das KI-Modell kommt gut mit unordentlicher Formulierung zurecht, und Sie wollen, dass Ihre exakten Vorgaben erhalten bleiben. Behalten Sie einen ausgefeilteren Stil für E-Mails und Dokumentation.

Prompt-Muster, die per Sprache funktionieren

Gesprochene Prompts scheitern auf eine vorhersehbare Weise: Sie schweifen ab. Eine einfache Struktur behebt das meiste davon. Sprechen Sie die Teile in dieser Reihenfolge:

  1. Ziel. „Rate Limiting für den Login-Endpunkt hinzufügen.”
  2. Kontext. „Wir nutzen bereits Redis für Sessions, die Middleware liegt im auth-Ordner.”
  3. Vorgaben. „Die öffentliche API nicht ändern, die bestehenden Tests weiter bestehen lassen, keine neuen Abhängigkeiten.”
  4. Ausgabe. „Zeig mir erst den Plan, dann warte.”

Diese letzte Zeile passt gut zum Plan-Modus: Sie wechseln mit Shift+Tab dorthin — ein weiterer Grund, diese Taste frei zu halten.

Ein paar Gewohnheiten helfen:

Wenn Sie sich aus gesundheitlichen Gründen für Voice Coding interessieren, behandelt unser Leitfaden zu Sprachdiktat für Entwickler mit RSI Ergonomie und freihändige Setups.

Ist das Diktieren in Cursor privat?

Teilweise — und es hilft, Audio von Text zu trennen.

Audio ist Ihre Sprachaufnahme. Bei einer Offline-Diktier-App wird sie auf Ihrem eigenen Computer transkribiert und nie hochgeladen. Bei einem Cloud-Diktierdienst geht die Aufnahme an die Server des Anbieters, bevor Sie ein einziges Wort sehen. Sprachaufnahmen können außerdem Dinge einfangen, die Sie nicht teilen wollten: den Namen eines Kollegen, einen Kunden in einem Anruf, den Raum um Sie herum.

Text ist der Prompt selbst. Unabhängig davon, mit welchem Tool Sie ihn erzeugen, schickt Cursor Prompts über sein eigenes Backend an das KI-Modell; die Data-Use-Seite von Cursor erklärt, dass Anfragen selbst mit einem eigenen API-Schlüssel über das Backend von Cursor laufen. Privacy Mode steuert, was danach passiert: Cursor erklärt, dass die Daten dann nicht für das Training verwendet werden und dass es Zero-Data-Retention-Vereinbarungen mit seinen Modellanbietern hat.

Das ehrliche Bild sieht also so aus: Offline-Diktat entfernt einen Datenfluss, Ihre Stimme, und lässt den Prompt unter den Richtlinien von Cursor. Für Teams, die an proprietärem Code arbeiten, lohnt sich das trotzdem, weil es vermeidet, einen zweiten Cloud-Anbieter hinzuzufügen, der Aufnahmen Ihrer Arbeit erhält. Unser Artikel darüber, warum Offline-Diktat Ihre Privatsphäre schützt, geht darauf noch genauer ein.

Erste Schritte

Beginnen Sie mit dem, was nichts kostet. Schalten Sie Voice Mode in Cursor ein, diktieren Sie Ihre nächsten drei Agent-Prompts, und achten Sie darauf, wie viel mehr Kontext Sie geben, wenn Sie sprechen.

Wenn Sie sich dieselbe Gewohnheit auch im Terminal, in Cmd+K, in Ihren Pull-Requests und in Slack wünschen, ergänzen Sie ein systemweites Tool. Weesper Neon Flow führt Whisper lokal auf macOS und Windows aus, schreibt in jede App und lernt Ihren Stack über sein benutzerdefiniertes Wörterbuch. Verlegen Sie nur zuerst seine Tastenkombination von Shift+Tab.

Bereit, mit Ihrem KI-Editor zu sprechen? Testen Sie Weesper Neon Flow 15 Tage kostenlos, keine Kreditkarte erforderlich, und diktieren Sie Ihren nächsten Cursor-Prompt, statt ihn zu tippen.