✨ IA de nova geração, OpenAI Whisper

Reconhecimento de voz
para Windows
, finalmente à altura

Esqueça o reconhecimento de voz do Windows, demasiado impreciso, dependente da Internet, incapaz de gerir sotaques. StarWhisper usa OpenAI Whisper localmente para uma precisão de 99 %, sem enviar os seus dados para lado nenhum.

Transferir para Windows
Microsoft Store
  • Confiável pelo Windows
  • Configuração rápida de 30 segundos
Mais
« Precisão 99 %, em português, sem cloud »

Reconhecimento de voz Windows: as verdadeiras opções em 2025

O Windows 10 e o Windows 11 integram uma função de reconhecimento de voz Windows nativa, chamada « Windows Speech Recognition » na versão clássica, e « Voice Typing » (Win+H) nas versões recentes. Para um uso ocasional e básico, ela basta. Mas assim que precisa de uma dictação profissional, de tratar dados sensíveis, ou de funcionar sem ligação à internet, os seus limites tornam-se rapidamente bloqueadores.

StarWhisper é uma alternativa de ambiente de trabalho Windows que utiliza o motor OpenAI Whisper para oferecer um reconhecimento de voz Windows offline com uma precisão de 99% em português. Nenhum áudio transita pelos servidores da Microsoft ou qualquer outra infraestrutura cloud. O processamento é totalmente local.

Critério Voice Typing Windows StarWhisper
Precisão em português padrão ~85-90% 99%+
Sotaques regionais Limitado (padrão de Lisboa/São Paulo) Todos os sotaques lusófonos
Funcionamento offline Parcial (requer internet) 100% offline
Dados de áudio enviados Para os servidores Microsoft Nunca, processamento local
Transcrição de ficheiros de áudio Não Sim (MP3, WAV, M4A, MP4)
Aceleração GPU Não NVIDIA CUDA
Terminologia especializada Medíocre Excelente (large-v3)
Preço Incluído no Windows Gratuito ou 10 $/mês Pro
Transferir StarWhisper gratuitamente

Porquê o reconhecimento de voz Windows nativo não chega para um uso profissional

A função Voice Typing do Windows é gratuita e acessível pelo atalho Win+H. Para ditar algumas linhas num e-mail ou numa nota rápida, ela é funcional. Mas vários problemas estruturais a tornam inadaptada a um uso intensivo ou profissional.

O problema da confidencialidade

O Voice Typing envia os seus dados de áudio para os servidores da Microsoft para processamento. Para os profissionais sujeitos a sigilo médico, segredo profissional, ou ao RGPD, isto é uma restrição maior. Um médico no Porto não pode ditar notas de consulta para os servidores Microsoft. Um advogado em Lisboa não pode confiar as suas alegações a uma infraestrutura cloud estrangeira. O reconhecimento de voz Windows offline via StarWhisper elimina este problema: nenhum áudio deixa o seu computador.

A precisão fora do português padrão

O modelo Microsoft Voice Typing é bem calibrado para o português padrão. Mas um utilizador com sotaque do Norte, um madeirense, um africano lusófono, ou mesmo alguém que use muitos termos técnicos, constatará rapidamente uma degradação da precisão. O Whisper large-v3, o modelo que corre no StarWhisper, foi treinado em 680 000 horas de áudio multilingue incluindo uma grande diversidade de variantes lusófonas.

A ausência de transcrição de ficheiros

O Voice Typing transcreve apenas a fala em direto, é incapaz de processar um ficheiro de áudio existente. O StarWhisper faz ambos: dictação em tempo real e transcrição de ficheiros MP3, WAV, M4A, MP4 largados na interface. Para jornalistas, investigadores, ou qualquer pessoa que trabalhe com gravações, isto é uma diferença fundamental.

A dependência da ligação

O Voice Typing necessita de uma ligação à internet ativa. Em deslocação, num escritório com restrições de rede, ou em zona mal coberta, a função fica indisponível. O reconhecimento de voz Windows do StarWhisper funciona inteiramente offline, a ligação só é necessária no download inicial dos modelos.

Como o StarWhisper assegura um reconhecimento de voz Windows offline

StarWhisper é uma aplicação Electron que faz rodar o motor whisper.cpp diretamente no seu PC Windows. Este motor é uma implementação C++ otimizada do modelo Whisper da OpenAI, capaz de tirar partido do seu CPU ou da sua GPU NVIDIA para a inferência.

Modo dictação tempo real

Um widget flutuante permanece visível acima de todas as suas aplicações. Ative a dictação, fale, e o texto insere-se diretamente na localização do seu cursor, no Word, Outlook, um CRM, um navegador web ou qualquer outra apli Windows.

Transcrição de ficheiros

Arraste e largue um ficheiro de áudio ou vídeo no StarWhisper. O modelo processa-o em poucos minutos e produz uma transcrição pontuada, pronta a ser copiada ou exportada. Formatos aceites: MP3, WAV, M4A, MP4, FLAC, OGG.

Aceleração GPU

Com uma placa NVIDIA compatível com CUDA, a transcrição é 5 a 10 vezes mais rápida que em modo CPU. Uma RTX 3060 processa 1 hora de áudio em menos de 5 minutos com o modelo large-v3.

Para utilizadores que procuram transcrever podcasts ou reuniões, o software de transcrição de podcast do StarWhisper é particularmente adequado. Para a transcrição de áudio offline em geral, consulte a nossa página dedicada à transcrição de áudio offline.

Ver os planos Pro, 10 $/mês

Quem usa o reconhecimento de voz Windows com StarWhisper?

Profissionais de saúde

Dictação de relatórios de consulta, receitas, correspondência médica. O modo offline garante que os dados dos pacientes nunca saem do consultório. Funcional em hospitais e redes médicas com acesso à internet restrito.

Juristas e notários

Redação de conclusões, correspondência, atas notariais por dictação por voz. Terminologia jurídica portuguesa bem gerida pelo modelo large. Segredo profissional preservado pelo processamento local.

Redatores e autores

Dictação de primeiros rascunhos de capítulos, artigos, newsletters. A velocidade da fala (150 palavras/min) supera a da digitação (60-80 palavras/min), um ganho de produtividade real para redatores prolixos.

Empreendedores e PME

Dictação de e-mails, relatórios de reunião, propostas comerciais. Ganho de tempo estimado em 30-40% nas tarefas de redação diárias. Funciona em todas as aplicações CRM, ERP, mensagens.

Perguntas frequentes, reconhecimento de voz Windows

Qual é a diferença entre Voice Typing Windows e StarWhisper?

Voice Typing (Win+H) está integrado no Windows, é gratuito, mas envia o áudio para os servidores Microsoft e não funciona verdadeiramente offline. A sua precisão em português é correta para um uso básico. StarWhisper usa Whisper large-v3, oferece uma precisão nitidamente superior, funciona 100% offline, e processa também ficheiros de áudio existentes, não apenas a dictação em direto.

O StarWhisper gere o português do Brasil e sotaques regionais?

Sim. Esta é uma das grandes vantagens do Whisper em relação às soluções Microsoft e Google. O modelo foi treinado num corpus muito diversificado incluindo português do Brasil, de Portugal, e variantes de África lusófona. Nenhuma configuração de sotaque é necessária, a deteção é automática.

Posso usar o StarWhisper em qualquer aplicação Windows?

Sim. O widget flutuante do StarWhisper funciona sobre todas as aplicações Windows, injetando o texto transcrito diretamente na localização do cursor ativo. Word, Excel, Outlook, Notepad, Chrome, Firefox, o seu CRM, o seu ERP, tudo funciona.

É preciso treinar o StarWhisper com a minha voz?

Não. Ao contrário do Dragon NaturallySpeaking que pedia sessões de treino, o Whisper funciona com precisão desde a primeira utilização, sem calibração de voz. Instale, abra, dite, é tudo.

O StarWhisper é adequado para dictação médica no Windows?

Sim, este é um dos casos de uso mais comuns. O modelo large-v3 gere bem a terminologia médica portuguesa (patologias, medicamentos, atos). O processamento 100% local assegura a conformidade com o segredo médico e o RGPD. Nenhum dado de paciente é transmitido para servidores de terceiros.

O reconhecimento de voz Windows que respeita a sua privacidade

99% de precisão em português. Totalmente offline. Nenhum dado enviado para a Microsoft ou outros. Dictação em tempo real e transcrição de ficheiros. Comece gratuitamente.

Transferir StarWhisper, Grátis

Windows 10/11 • Plano gratuito sem conta • Pro a 10 $/mês ilimitado