¿Cómo se usa el dictado por voz en Cursor? Tienes dos opciones. El Voice Mode integrado de Cursor (Cmd+Shift+Space) dicta prompts en el Agent. Una app de dictado que funciona en todo el sistema, como Weesper Neon Flow, escribe en cualquier campo: Agent, edición en línea Cmd+K, terminal, comentarios y mensajes de commit. Si usas Weesper, cambia su atajo predeterminado Shift+Tab, porque Cursor usa Shift+Tab para cambiar de modo del Agent.

Los editores de código con IA han cambiado lo que escriben los programadores. En Cursor, cada vez más texto son instrucciones para el Agent, peticiones de edición, descripciones de errores y notas de revisión. Es más rápido dictar esos prompts largos que escribirlos. Esta guía explica cómo configurar el dictado por voz en Cursor, cómo dictar prompts a Cursor sin conflictos de atajos y cuándo conviene el dictado offline en Cursor para proteger el audio de código sensible.

¿Por qué dictar prompts en Cursor?

Porque los buenos prompts suelen ser largos y cuesta escribirlos. Al hablar, puedes darle al Agent el contexto que necesita sin recortar la instrucción para ahorrar tiempo.

El dictado por voz en Cursor consiste en hablar a un micrófono y que tus palabras aparezcan como texto en los campos de entrada de Cursor, normalmente el prompt del Agent, de modo que la IA actúe sobre ellas como si las hubieras escrito.

La voz funciona mejor para tareas de lenguaje natural:

Funciona mal para la sintaxis exacta. No vas a querer dictar una expresión regular o una firma de tipo anidada; escribe eso a mano y deja que tu voz se encargue de la explicación alrededor. Nuestra guía de vibe coding cubre el flujo de trabajo más amplio del desarrollador; este artículo se centra en Cursor en sí.

¿Qué hace el Voice Mode integrado de Cursor?

Cursor 2.0, lanzado el 29 de octubre de 2025, añadió Voice Mode. El registro de cambios lo describe en una línea: «Controla el Agent con tu voz usando conversión de voz a texto integrada».

Cómo usarlo:

  1. Abre el panel lateral del Agent con Cmd+I o Cmd+L. La documentación de Cursor enumera los atajos de Mac; en Windows, consulta Keyboard Shortcuts en los ajustes de Cursor.
  2. Pulsa Cmd+Shift+Space para activar o desactivar Voice Mode, o haz clic en el micrófono del campo de entrada del Agent.
  3. Di tu instrucción y revisa la transcripción antes de enviarla.

Cursor también te permite definir palabras clave de envío personalizadas en sus ajustes, de modo que una palabra hablada como «enviar» pueda activar el Agent sin tocar el teclado.

Voice Mode ya viene integrado en Cursor y no necesita software adicional, lo que lo convierte en el primer paso lógico. Sus límites vienen de su diseño: está construido alrededor del prompt del Agent. No ayuda cuando escribes en la terminal, en una edición en línea Cmd+K, en una pull request de GitHub en el navegador, o en Slack mientras comentas el cambio. El changelog público de Cursor y su página de uso de datos tampoco indican dónde procesa Voice Mode tu audio, así que consúltalo con Cursor si eso le importa a tu equipo.

Voice Mode integrado frente a una app de dictado de todo el sistema

Una app de dictado que funciona en todo el sistema opera a nivel del sistema operativo: mantienes pulsado un atajo, hablas y el texto aparece donde esté el cursor, en cualquier aplicación. Así puedes usar la voz en más partes de tu trabajo con Cursor.

Voice Mode de CursorApp de todo el sistema (p. ej. Weesper Neon Flow)
Prompt del Agent✅✅
Edición en línea Cmd+KNo es su objetivo✅
Barra de comandos de la terminalNo es su objetivo✅
Comentarios de código, mensajes de commitNo es su objetivo✅
Navegador, Slack, correo, documentos❌✅
Palabra clave de envío hablada✅❌ (pulsas Enter)
Vocabulario personalizadoNo documentado✅ Diccionario personalizado
Dónde se transcribe el audioNo documentadoEn tu ordenador
Instalación adicionalNingunaApp de escritorio (macOS o Windows)

Usa Voice Mode si hablas principalmente con el Agent y no quieres instalar nada.

Usa una app que funcione en todo el sistema si quieres dictar igual en Cursor, la terminal, el navegador y tus herramientas de chat, o si necesitas vocabulario técnico y transcripción local. Muchos desarrolladores combinan ambas opciones: Voice Mode para órdenes rápidas al Agent y la app de dictado para los demás campos. Para probarla, descarga Weesper Neon Flow para macOS o Windows.

Cómo configurar Weesper Neon Flow para Cursor

La configuración tarda unos cinco minutos. El único paso específico de Cursor es el atajo de teclado.

1. Cambia el atajo de dictado para que no sea Shift+Tab

Este es el paso que más gente se salta. Cursor usa Shift+Tab para rotar entre los modos del Agent desde el campo de chat, por ejemplo de Agent a Plan. Weesper Neon Flow usa Shift+Tab como su atajo de dictado predeterminado tanto en macOS como en Windows.

Dale a cada atajo una única función:

  1. Abre Configuración → Atajo de Teclado de Weesper Neon Flow.
  2. Haz clic en el campo del atajo y pulsa una nueva combinación. La tecla Fn también funciona como disparador.
  3. Pruébalo en el campo de entrada del Agent de Cursor: mantén pulsado, habla, suelta.

Weesper usa el modelo de mantener pulsado para hablar: la grabación se ejecuta mientras mantienes la tecla pulsada y se detiene al soltarla. La guía de configuración del atajo de teclado explica los conflictos en detalle.

2. Enséñale el vocabulario de tu stack

Los modelos de voz conocen el inglés, no tu base de código. Palabras como «Tailwind», «Zustand», «pnpm», «tRPC» o los nombres de tus servicios internos son de donde vienen la mayoría de los errores.

Añádelas una vez en Configuración → Diccionario, y añade reglas de corrección automática para las palabras que sigan saliendo mal. La guía del diccionario personalizado explica ambas cosas, y nuestro artículo sobre vocabulario personalizado para términos técnicos muestra cómo crear una buena lista.

3. Elige un estilo de escritura literal para los prompts

Los presets de Estilo de salida de Weesper pueden reformular tu dictado. Para los prompts de Cursor, un estilo literal suele ser mejor: el modelo de IA maneja bien una redacción desordenada, y quieres que se conserven exactamente tus restricciones. Reserva un estilo más pulido para los correos y la documentación.

Patrones de prompt que funcionan por voz

Los prompts hablados fallan de una manera predecible: se van por las ramas. Una estructura sencilla soluciona la mayoría de los casos. Di las partes en este orden:

  1. Objetivo. «Añade limitación de peticiones al endpoint de login.»
  2. Contexto. «Ya usamos Redis para las sesiones, el middleware está en la carpeta de auth.»
  3. Restricciones. «No cambies la API pública, mantén los tests actuales pasando, sin nuevas dependencias.»
  4. Resultado. «Muéstrame primero el plan y espera.»

Esta última línea combina bien con el modo Plan: cambias con Shift+Tab, lo que es una razón más para dejar esa tecla libre.

Algunos hábitos ayudan:

Si el voice coding te interesa por motivos de salud, nuestra guía sobre dictado por voz para desarrolladores con LER cubre la ergonomía y las configuraciones manos libres.

¿Es privado dictar en Cursor?

En parte, y ayuda separar el audio del texto.

El audio es tu grabación de voz. Con una app de dictado offline, se transcribe en tu propio ordenador y nunca se sube a ningún servidor. Con un servicio de dictado en la nube, la grabación llega a los servidores de ese proveedor antes de que veas una sola palabra. Las grabaciones de voz también pueden capturar cosas que no querías compartir: el nombre de un compañero, un cliente en una llamada, la sala que te rodea.

El texto es el propio prompt. Sea cual sea la herramienta que uses para producirlo, Cursor envía los prompts a través de su propio backend hacia el modelo de IA; su página de uso de datos indica que las peticiones pasan por el backend de Cursor incluso con tu propia clave de API. Privacy Mode controla lo que ocurre después: Cursor afirma que esos datos no se usan para entrenamiento y que tiene acuerdos de retención cero de datos con sus proveedores de modelos.

Así que el panorama honesto es este: el dictado offline elimina un flujo de datos, tu voz, y deja el prompt bajo las políticas de Cursor. Para equipos que trabajan con código propietario, sigue mereciendo la pena, porque evita añadir un segundo proveedor en la nube que recibe grabaciones de tu trabajo. Nuestro artículo sobre por qué el dictado offline protege tu privacidad profundiza en el tema.

Primeros pasos

Empieza por lo que no cuesta nada. Activa el Voice Mode de Cursor, dicta tus próximos tres prompts al Agent, y fíjate en cuánto más contexto das cuando hablas.

Cuando te des cuenta de que quieres ese mismo hábito en la terminal, en Cmd+K, en tus pull requests y en Slack, añade una herramienta de todo el sistema. Weesper Neon Flow ejecuta Whisper localmente en macOS y Windows, escribe en cualquier app, y aprende tu stack a través de su diccionario personalizado. Solo cambia primero su atajo para que no sea Shift+Tab.

¿Listo para hablar con tu editor de IA? Prueba Weesper Neon Flow gratis durante 15 días, sin tarjeta de crédito, y dicta tu próximo prompt en Cursor en lugar de escribirlo.