Esqueça o reconhecimento de voz do Windows, demasiado impreciso, dependente da Internet, incapaz de gerir sotaques. StarWhisper usa OpenAI Whisper localmente para uma precisão de 99 %, sem enviar os seus dados para lado nenhum.
O Windows 10 e o Windows 11 integram uma função de reconhecimento de voz Windows nativa, chamada « Windows Speech Recognition » na versão clássica, e « Voice Typing » (Win+H) nas versões recentes. Para um uso ocasional e básico, ela basta. Mas assim que precisa de uma dictação profissional, de tratar dados sensíveis, ou de funcionar sem ligação à internet, os seus limites tornam-se rapidamente bloqueadores.
StarWhisper é uma alternativa de ambiente de trabalho Windows que utiliza o motor OpenAI Whisper para oferecer um reconhecimento de voz Windows offline com uma precisão de 99% em português. Nenhum áudio transita pelos servidores da Microsoft ou qualquer outra infraestrutura cloud. O processamento é totalmente local.
| Critério | Voice Typing Windows | StarWhisper |
|---|---|---|
| Precisão em português padrão | ~85-90% | 99%+ |
| Sotaques regionais | Limitado (padrão de Lisboa/São Paulo) | Todos os sotaques lusófonos |
| Funcionamento offline | Parcial (requer internet) | 100% offline |
| Dados de áudio enviados | Para os servidores Microsoft | Nunca, processamento local |
| Transcrição de ficheiros de áudio | Não | Sim (MP3, WAV, M4A, MP4) |
| Aceleração GPU | Não | NVIDIA CUDA |
| Terminologia especializada | Medíocre | Excelente (large-v3) |
| Preço | Incluído no Windows | Gratuito ou 10 $/mês Pro |
A função Voice Typing do Windows é gratuita e acessível pelo atalho Win+H. Para ditar algumas linhas num e-mail ou numa nota rápida, ela é funcional. Mas vários problemas estruturais a tornam inadaptada a um uso intensivo ou profissional.
O Voice Typing envia os seus dados de áudio para os servidores da Microsoft para processamento. Para os profissionais sujeitos a sigilo médico, segredo profissional, ou ao RGPD, isto é uma restrição maior. Um médico no Porto não pode ditar notas de consulta para os servidores Microsoft. Um advogado em Lisboa não pode confiar as suas alegações a uma infraestrutura cloud estrangeira. O reconhecimento de voz Windows offline via StarWhisper elimina este problema: nenhum áudio deixa o seu computador.
O modelo Microsoft Voice Typing é bem calibrado para o português padrão. Mas um utilizador com sotaque do Norte, um madeirense, um africano lusófono, ou mesmo alguém que use muitos termos técnicos, constatará rapidamente uma degradação da precisão. O Whisper large-v3, o modelo que corre no StarWhisper, foi treinado em 680 000 horas de áudio multilingue incluindo uma grande diversidade de variantes lusófonas.
O Voice Typing transcreve apenas a fala em direto, é incapaz de processar um ficheiro de áudio existente. O StarWhisper faz ambos: dictação em tempo real e transcrição de ficheiros MP3, WAV, M4A, MP4 largados na interface. Para jornalistas, investigadores, ou qualquer pessoa que trabalhe com gravações, isto é uma diferença fundamental.
O Voice Typing necessita de uma ligação à internet ativa. Em deslocação, num escritório com restrições de rede, ou em zona mal coberta, a função fica indisponível. O reconhecimento de voz Windows do StarWhisper funciona inteiramente offline, a ligação só é necessária no download inicial dos modelos.
StarWhisper é uma aplicação Electron que faz rodar o motor whisper.cpp diretamente no seu PC Windows. Este motor é uma implementação C++ otimizada do modelo Whisper da OpenAI, capaz de tirar partido do seu CPU ou da sua GPU NVIDIA para a inferência.
Um widget flutuante permanece visível acima de todas as suas aplicações. Ative a dictação, fale, e o texto insere-se diretamente na localização do seu cursor, no Word, Outlook, um CRM, um navegador web ou qualquer outra apli Windows.
Arraste e largue um ficheiro de áudio ou vídeo no StarWhisper. O modelo processa-o em poucos minutos e produz uma transcrição pontuada, pronta a ser copiada ou exportada. Formatos aceites: MP3, WAV, M4A, MP4, FLAC, OGG.
Com uma placa NVIDIA compatível com CUDA, a transcrição é 5 a 10 vezes mais rápida que em modo CPU. Uma RTX 3060 processa 1 hora de áudio em menos de 5 minutos com o modelo large-v3.
Para utilizadores que procuram transcrever podcasts ou reuniões, o software de transcrição de podcast do StarWhisper é particularmente adequado. Para a transcrição de áudio offline em geral, consulte a nossa página dedicada à transcrição de áudio offline.
Dictação de relatórios de consulta, receitas, correspondência médica. O modo offline garante que os dados dos pacientes nunca saem do consultório. Funcional em hospitais e redes médicas com acesso à internet restrito.
Redação de conclusões, correspondência, atas notariais por dictação por voz. Terminologia jurídica portuguesa bem gerida pelo modelo large. Segredo profissional preservado pelo processamento local.
Dictação de primeiros rascunhos de capítulos, artigos, newsletters. A velocidade da fala (150 palavras/min) supera a da digitação (60-80 palavras/min), um ganho de produtividade real para redatores prolixos.
Dictação de e-mails, relatórios de reunião, propostas comerciais. Ganho de tempo estimado em 30-40% nas tarefas de redação diárias. Funciona em todas as aplicações CRM, ERP, mensagens.
Voice Typing (Win+H) está integrado no Windows, é gratuito, mas envia o áudio para os servidores Microsoft e não funciona verdadeiramente offline. A sua precisão em português é correta para um uso básico. StarWhisper usa Whisper large-v3, oferece uma precisão nitidamente superior, funciona 100% offline, e processa também ficheiros de áudio existentes, não apenas a dictação em direto.
Sim. Esta é uma das grandes vantagens do Whisper em relação às soluções Microsoft e Google. O modelo foi treinado num corpus muito diversificado incluindo português do Brasil, de Portugal, e variantes de África lusófona. Nenhuma configuração de sotaque é necessária, a deteção é automática.
Sim. O widget flutuante do StarWhisper funciona sobre todas as aplicações Windows, injetando o texto transcrito diretamente na localização do cursor ativo. Word, Excel, Outlook, Notepad, Chrome, Firefox, o seu CRM, o seu ERP, tudo funciona.
Não. Ao contrário do Dragon NaturallySpeaking que pedia sessões de treino, o Whisper funciona com precisão desde a primeira utilização, sem calibração de voz. Instale, abra, dite, é tudo.
Sim, este é um dos casos de uso mais comuns. O modelo large-v3 gere bem a terminologia médica portuguesa (patologias, medicamentos, atos). O processamento 100% local assegura a conformidade com o segredo médico e o RGPD. Nenhum dado de paciente é transmitido para servidores de terceiros.
99% de precisão em português. Totalmente offline. Nenhum dado enviado para a Microsoft ou outros. Dictação em tempo real e transcrição de ficheiros. Comece gratuitamente.
Transferir StarWhisper, GrátisWindows 10/11 • Plano gratuito sem conta • Pro a 10 $/mês ilimitado