Como usar o ditado de voz no Cursor? Você tem duas opções. O Voice Mode nativo do Cursor (Cmd+Shift+Space) dita prompts para o Agent. Já um app de ditado que funciona em todo o sistema, como o Weesper Neon Flow, digita em qualquer campo: Agent, edição inline do Cmd+K, terminal, comentários e mensagens de commit. Se você usar o Weesper, mude seu atalho padrão Shift+Tab, porque o Cursor usa Shift+Tab para trocar os modos do Agent.
Os editores de código com IA mudaram a forma como os desenvolvedores escrevem. No Cursor, cada vez mais o texto são instruções para o Agent, pedidos de edição, descrições de bugs e notas de revisão. Ditar esses prompts mais longos pode ser mais rápido do que digitá-los. Este guia explica como configurar o ditado de voz no Cursor, como ditar prompts para o Cursor sem conflitos entre atalhos e quando o ditado offline no Cursor ajuda a manter o áudio de código sensível no seu dispositivo.
Por que ditar prompts no Cursor?
Porque bons prompts costumam ser longos e levam tempo para digitar. Ao falar, você consegue dar ao Agent o contexto necessário sem encurtar a instrução.
Ditado de voz no Cursor significa falar em um microfone e ver suas palavras aparecerem como texto nos campos de entrada do Cursor, geralmente o prompt do Agent, para que a IA aja sobre elas como se você as tivesse digitado.
A voz funciona melhor para tarefas em linguagem natural:
- Explicar uma funcionalidade ou um bug antes de pedir ao Agent para agir
- Descrever as restrições de uma refatoração: o que não pode mudar, quais testes precisam passar
- Escrever comentários de revisão, mensagens de commit e descrições de pull request
- Pensar em voz alta no modo Plan antes de qualquer código ser escrito
Ela funciona mal para sintaxe exata. Você não vai querer ditar uma expressão regular ou uma assinatura de tipo aninhada; digite essas partes e deixe a voz cuidar da explicação em torno delas. Nosso guia de vibe coding cobre o fluxo de trabalho mais amplo do desenvolvedor; este artigo foca no próprio Cursor.
O que o Voice Mode nativo do Cursor faz?
O Cursor 2.0, lançado em 29 de outubro de 2025, adicionou o Voice Mode. O changelog o descreve em uma linha: “Controle o Agent com sua voz usando conversão de fala em texto nativa.”
Como usar:
- Abra o painel lateral do Agent com Cmd+I ou Cmd+L. A documentação do Cursor lista os atalhos para Mac; no Windows, verifique Atalhos de Teclado nas configurações do Cursor.
- Pressione Cmd+Shift+Space para ativar o Voice Mode, ou clique no microfone no campo do Agent.
- Fale sua instrução e revise a transcrição antes de enviar.
O Cursor também permite definir palavras-chave de envio personalizadas nas configurações, de modo que uma palavra falada como “enviar” possa acionar o Agent sem tocar no teclado.
O Voice Mode já vem embutido no Cursor e não exige software adicional, o que o torna o primeiro passo certo. Seus limites vêm do seu próprio design: ele foi construído em torno do prompt do Agent. Ele não ajuda quando você está escrevendo no terminal, em uma edição inline do Cmd+K, em um pull request do GitHub no navegador, ou no Slack enquanto discute a mudança. O changelog público do Cursor e sua página de uso de dados também não dizem onde o Voice Mode processa seu áudio, então verifique com o Cursor se isso for importante para sua equipe.
Voice Mode nativo vs. um app de ditado de todo o sistema
Um app de ditado que funciona em todo o sistema opera no nível do sistema operacional: você mantém um atalho pressionado, fala e o texto aparece onde estiver o cursor, em qualquer aplicativo. Assim, você pode usar a voz em mais etapas do seu trabalho no Cursor.
| Voice Mode do Cursor | App de todo o sistema (ex.: Weesper Neon Flow) | |
|---|---|---|
| Prompt do Agent | ✅ | ✅ |
| Edição inline Cmd+K | Não é o foco | ✅ |
| Barra de comando do terminal | Não é o foco | ✅ |
| Comentários de código, mensagens de commit | Não é o foco | ✅ |
| Navegador, Slack, e-mail, docs | ❌ | ✅ |
| Palavra-chave de envio falada | ✅ | ❌ (você pressiona Enter) |
| Vocabulário personalizado | Não documentado | ✅ Dicionário personalizado |
| Onde o áudio é transcrito | Não documentado | No seu computador |
| Instalação extra | Nenhuma | App para desktop (macOS ou Windows) |
Use o Voice Mode se você fala principalmente com o Agent e quer configuração zero.
Use um app que funciona em todo o sistema se você quer ditar da mesma forma no Cursor, no terminal, no navegador e nas ferramentas de chat, ou se precisa de vocabulário técnico e transcrição local. Muitos desenvolvedores combinam as duas opções: o Voice Mode para comandos rápidos ao Agent e o app de ditado nos outros campos. Para experimentar, baixe o Weesper Neon Flow para macOS ou Windows.
Como configurar o Weesper Neon Flow para o Cursor
A configuração leva cerca de cinco minutos. A única etapa específica do Cursor é o atalho.
1. Mude o atalho de ditado para fora do Shift+Tab
Essa é a etapa que mais gente deixa passar. O Cursor usa Shift+Tab para alternar entre os modos do Agent a partir do campo de chat, por exemplo de Agent para Plan. O Weesper Neon Flow usa Shift+Tab como seu atalho de ditado padrão tanto no macOS quanto no Windows.
Dê a cada atalho uma única função:
- Abra o Weesper Neon Flow em Configurações → Atalho de Teclado.
- Clique no campo do atalho e pressione uma nova combinação. A tecla Fn também funciona como acionador.
- Teste no campo do Agent no Cursor: mantenha pressionado, fale, solte.
O Weesper usa manter pressionado para falar: a gravação roda enquanto a tecla está pressionada e para quando você a solta. O guia de configuração do atalho cobre os conflitos em detalhe.
2. Ensine o vocabulário da sua stack
Os modelos de fala conhecem inglês, não a sua base de código. Palavras como “Tailwind”, “Zustand”, “pnpm”, “tRPC” ou os nomes internos dos seus serviços são de onde vêm a maioria dos erros.
Adicione-as uma vez em Configurações → Dicionário, e adicione regras de correção automática para palavras que continuam saindo erradas. O guia do dicionário personalizado explica os dois recursos, e nosso artigo sobre vocabulário personalizado para termos técnicos mostra como montar uma boa lista.
3. Escolha um estilo literal para os prompts
Os presets de Estilo de Saída do Weesper podem reformular seu ditado. Para prompts no Cursor, um estilo literal costuma ser melhor: o modelo de IA lida bem com frases desorganizadas, e você quer que suas restrições exatas sejam preservadas. Mantenha um estilo mais elaborado para e-mails e documentação.
Padrões de prompt que funcionam por voz
Prompts falados falham de um jeito previsível: eles ficam divagando. Uma estrutura simples resolve a maior parte disso. Diga as partes nesta ordem:
- Objetivo. “Adicione limitação de taxa ao endpoint de login.”
- Contexto. “Já usamos o Redis para sessões, o middleware está na pasta auth.”
- Restrições. “Não mude a API pública, mantenha os testes existentes passando, sem novas dependências.”
- Resultado. “Me mostre o plano primeiro, depois espere.”
Essa última linha combina bem com o modo Plan: você alterna com Shift+Tab, o que é mais um motivo para manter essa tecla livre.
Alguns hábitos ajudam:
- Diga os nomes de arquivo de forma simples. “auth middleware ponto ts” já é claro o suficiente; o Agent resolve o caminho a partir do seu projeto.
- Dite feedback de revisão em frases completas. “Esse loop refaz a consulta ao banco de dados em cada iteração, agrupe isso” dá ao Agent um motivo, não só um comando.
- Use o Cmd+K para edições locais. Selecione uma função, pressione Cmd+K, depois dite: “converta isso para async e adicione tratamento de erros.”
- Releia antes de enviar. Uma olhada rápida já pega aquela palavra ocasional mal reconhecida antes que chegue ao modelo.
Se a codificação por voz te interessa por motivos de saúde, nosso guia sobre ditado de voz para desenvolvedores com LER cobre ergonomia e configurações mãos livres.
Ditar no Cursor é privado?
Parcialmente, e ajuda separar áudio de texto.
Áudio é sua gravação de voz. Com um app de ditado offline, ela é transcrita no seu próprio computador e nunca é enviada para a nuvem. Com um serviço de ditado em nuvem, a gravação vai para os servidores desse fornecedor antes mesmo de você ver uma única palavra. Gravações de voz também podem capturar coisas que você não pretendia compartilhar: o nome de um colega, um cliente em uma chamada, o ambiente ao seu redor.
Texto é o prompt em si. Seja qual for a ferramenta usada para produzi-lo, o Cursor envia os prompts através do seu próprio backend até o modelo de IA; sua página de uso de dados afirma que as solicitações passam pelo backend do Cursor mesmo com sua própria chave de API. O Privacy Mode controla o que acontece depois: o Cursor afirma que, nesse caso, os dados não são usados para treinamento e que a empresa tem acordos de retenção zero de dados com seus provedores de modelo.
Na prática, o ditado offline evita enviar sua voz a outro fornecedor; o prompt continua sujeito às políticas do Cursor. Para equipes que trabalham com código proprietário, isso evita incluir mais um serviço na nuvem que recebe gravações do trabalho. Nosso artigo sobre por que o ditado offline protege sua privacidade explica melhor.
Para começar
Comece com o que não custa nada. Ative o Voice Mode do Cursor, dite seus próximos três prompts para o Agent, e perceba quanto mais contexto você dá quando fala.
Quando você perceber que quer o mesmo hábito no terminal, no Cmd+K, nos seus pull requests e no Slack, adicione uma ferramenta de todo o sistema. O Weesper Neon Flow executa o Whisper localmente no macOS e no Windows, digita em qualquer aplicativo e aprende sua stack através do dicionário personalizado. Só mude o atalho para fora do Shift+Tab primeiro.
Pronto para falar com seu editor de IA? Experimente o Weesper Neon Flow gratuitamente por 15 dias, sem necessidade de cartão de crédito, e dite seu próximo prompt no Cursor em vez de digitá-lo.