Saltar para o conteúdo principal

Entrada de Voz para o Deep Code: Fale o Que Pensar. a IA Trata do Resto.

A IA tornou-nos drasticamente mais produtivos, mas a digitação continua a ser o estrangulamento. Ferramentas de ditado de voz como o Siri ou a voz do Google funcionam bem para enviar uma mensagem de texto, mas têm uma falha fundamental: não sabem nada sobre o seu projeto. Transcrevem palavras — não compreendem a intenção.

Não precisa que o seu computador transcreva o que disse. Precisa que compreenda o que quer fazer.

O Deep Code resolve isto integrando a entrada de voz diretamente na interface, com total consciência do contexto do seu projeto.

Por Que as Ferramentas de Voz Genéricas São Insuficientes

Transcrevem. Não Compreendem.

As ferramentas de voz para consumidor são concebidas para conversas do quotidiano — mensagens de texto, notas rápidas, pesquisas. A sua função é a transcrição literal, palavra por palavra.

Controlar a IA com a voz é um problema completamente diferente. Não está a ditar uma mensagem — está a dar instruções. A diferença importa:

  • Ditado: "Lembrar-me de comprar leite" → transcrito como "Lembrar-me de comprar leite"
  • Controlo por IA: "Muda a porta naquele ficheiro de configuração que editei ontem para 8080" → a IA precisa de saber que ficheiro de configuração, que campo e que valor — nada do qual se encontra apenas nas palavras.

Uma ferramenta genérica captura cada palavra fielmente. Não consegue resolver o que essas palavras realmente referenciam.

O Seu Cérebro Não É Linear. A Transcrição Deles Sim.

Pensa em tangentes. Muda de ideias a meio da frase. Volta a ideias anteriores. Isto é normal.

As ferramentas de ditado de voz utilizam transcrição em fluxo contínuo — o texto aparece em tempo real enquanto fala. Para chat, funciona bem. Para dar instruções técnicas, cria problemas:

  • Muda de ideias a meio? A primeira metade polui o prompt final.
  • Associa ideias livremente? Aparecem em ordem cronológica, não lógica.
  • Pausa para pensar? A ferramenta não distingue entre uma pausa e um ponto final.

A sua mente funciona como um mapa mental. Uma transcrição linear é uma linha reta — muito se perde pelo caminho.

Entrada de Voz do Deep Code: Concebida Para Controlo por IA

Entrada de voz que compreende o contexto. Fale naturalmente em qualquer língua, misture termos livremente — tudo é organizado. Enganou-se? Sem problema — a correção consciente do contexto trata disso automaticamente.

Transcrição Consciente do Contexto

A sua fala é transcrita e depois refinada pela IA uma segunda vez utilizando o contexto atual da conversação e a estrutura de ficheiros do seu projeto.

O que isto significa na prática:

  • Nomes de ficheiros, caminhos de diretórios e nomes de variáveis que menciona são correspondidos às suas contrapartes reais no projeto.
  • O que disser e corrigir imediatamente a seguir é filtrado — não transcrito.
  • Pensamentos dispersos e não lineares são reorganizados por importância e ordem lógica.

Exemplo: está a trabalhar com config/app.yaml e quer mudar a porta para 8080. Diz:

"Muda a porta naquele ficheiro de configuração — o da app, aquele em que trabalhaste antes — para 8080. Acho que já a mudei uma vez mas não parece ter ficado..."

Uma ferramenta de ditado padrão transcreve esse emaranhado literalmente. O Deep Code dá-lhe:

"Muda o campo da porta em config/app.yaml para 8080."

Fale Livremente. Tropeçar Não Há Problema.

Este é o ponto fulcral.

O ditado padrão penaliza a fala descuidada — cada palavra é registada, pelo que um erro significa recomeçar. O módulo de entrada de voz inverte esse pressuposto. Fale como quiser. O sistema limpa tudo.

Trata automaticamente de:

  • Correções a meio da frase: o conteúdo anterior contradito é descartado.
  • Referências vagas: "aquele ficheiro," "o de ontem," "a coisa de que acabámos de falar" — resolvidas a partir do contexto.
  • Repetições: ideias duplicadas são desduplicadas.
  • Palavras de preenchimento: eh, hum, tipo, sabes — removidas.

Dê a ideia geral. O sistema faz o resto.

Troca de Código e Termos Mistos

Os programadores misturam constantemente termos técnicos na fala quotidiana — nomes de ficheiros, nomes de funções, nomes de frameworks, comandos CLI. As ferramentas de voz genéricas são notoriamente más nisto, frequentemente transformando useSnippets.ts em algo incompreensível ou partindo npm install em palavras aleatórias.

O módulo de entrada de voz é otimizado para contextos de programação. Consulta a árvore de ficheiros do seu projeto para saber o que é um identificador real e o que é ruído:

  • Nomes de ficheiros como useSnippets.ts e src/utils/index.ts são preservados intactos.
  • Nomes de variáveis e funções são reconhecidos corretamente.
  • Nomes de frameworks e ferramentas (Java, C++, npm, git) simplesmente funcionam.

Sem Pressa — Até 5 Minutos

A maioria das ferramentas de mensagens de voz limita-o a 60 segundos e inicia uma contagem decrescente que faz com que tudo pareça apressado.

O Deep Code suporta gravação contínua até 5 minutos. Pense ao seu ritmo. Pausa quando precisar. Não há relógio a contar.

Como Utilizar

O módulo de entrada de voz encontra-se no canto inferior direito da janela do Deep Code. Sem menus para abrir, sem painéis para ativar — está sempre lá.

Passo 1: Iniciar a Gravação

Passe o cursor sobre o botão de gravação no canto inferior direito para ver a dica. Clique para iniciar.

Passo 2: Falar

Durante a gravação, o botão mostra uma onda sonora em tempo real que reflete os seus níveis de áudio. Está a ser captado em tempo real.

Durante a gravação, pode:

  • Dizer tudo o que lhe vier à mente, em qualquer ordem.
  • Auto-corriger-se ou ignorar erros — o sistema trata deles.
  • Pausa para pensar — a gravação continua. Retome quando estiver pronto.

Passo 3: Parar a Gravação

Clique no mesmo botão para parar. O áudio é enviado e a transcrição começa.

Passo 4: Rever e Enviar

Quando a transcrição terminar, verá o texto processado para revisão. A partir daqui, pode:

  • Verificar se o texto refinado pela IA corresponde à sua intenção.
  • Editar o texto diretamente se necessário.
  • Inserir referências a ficheiros a partir do Painel do Explorador de Ficheiros.
  • Inserir modelos de prompts a partir do Painel de Fragmentos.
  • Clique em enviar quando estiver satisfeito.

Tudo acontece numa única janela — sem troca de contexto.

Comparação

Ferramentas de voz genéricas (Siri, ditado Google, etc.)Entrada de Voz do Deep Code
FinalidadeChat do quotidiano, notas, pesquisasControlo por IA — compreende o que quer fazer
TranscriçãoEm fluxo, palavra por palavra enquanto falaProcessamento IA consciente do contexto, organizado antes de apresentar
Estilo de pensamentoExige fala linear e cuidadosaLivre, não linear — diga o que lhe vier à mente
Tratamento de errosRecomeçarFiltrado e corrigido automaticamente
Termos técnicosMutila frequentemente identificadores de códigoReconhece ficheiros do projeto, nomes de funções, comandos CLI
Limite de tempoTipicamente ~60 segundosAté 5 minutos
Consciência do projetoNenhumaIntegração profunda com os painéis do Explorador de Ficheiros e de Fragmentos

Resumo

O módulo de entrada de voz não é uma ferramenta de voz para texto — é uma ponte de pensamento para instrução. Toma a forma como naturalmente pensa e fala e transforma-a em algo que a IA pode executar.

Uma coisa a ter em mente:

Fale livremente. O sistema trata do resto.