Processamento 100% offline. Gravações de entrevistas e transcrições nunca saem do seu dispositivo.
Transcreva entrevistas, anotações de campo e coletivas de imprensa com prazos apertados. O processamento 100% offline protege suas fontes e material sensível.
Processamento 100% offline. Gravações de entrevistas e transcrições nunca saem do seu dispositivo.
Todo jornalista trabalhador carrega uma versão da mesma sobrecarga cognitiva: você tem a história na cabeça, você tem as citações do seu gravador e, entre você e uma peça publicada, está o processo lento e mecânico de converter áudio em texto. O repórter médio transcreve manualmente a 40-60 palavras por minuto, o que significa que uma entrevista de fonte de 45 minutos produz 90-120 minutos de digitação antes que uma única palavra de escrita real comece.
Um bom software de ditado jornalístico ataca esse problema em duas direções simultaneamente: ele permite que você dite seus rascunhos de artigos mais rápido do que pode digitar e transcreve seu áudio gravado enquanto você faz outra coisa. Juntas, essas duas capacidades podem recuperar de duas a quatro horas por dia de trabalho, tempo que retorna para reportagem, cultivo de fontes e desenvolvimento de histórias, em vez de trabalho de teclado.
O fator complicador no jornalismo especificamente é a confidencialidade. Quando um serviço de ditado baseado na nuvem processa seu áudio, esse áudio viaja pela internet para o servidor de outra pessoa. Uma fonte que confiou em você com informações sensíveis não consentiu que sua voz fosse armazenada na infraestrutura de uma empresa de tecnologia. Para repórteres investigativos, correspondentes estrangeiros e qualquer pessoa que lide com material sensível de denunciantes, isso cria um risco profissional e legal genuíno que o software na nuvem não pode resolver por design.
O Dragon há muito tempo é a resposta padrão para digitação por voz, mas não foi projetado em torno de fluxos de trabalho jornalísticos. Ele requer treinamento de perfil de voz que leva horas para ser configurado corretamente. Ele tem dificuldades com nomes próprios, nomes e lugares, exatamente o vocabulário que os jornalistas mais usam. Ele não faz transcrição de arquivos de áudio, apenas ditado ao vivo. E a $200-$600 por licença, dependendo da versão, ele torna-se inacessível para a maioria dos freelancers e muitos repórteres de equipe em orçamentos editoriais. Um software de ditado jornalístico específico resolve essas lacunas de forma diferente.
O StarWhisper combina o reconhecimento de fala do OpenAI Whisper com uma interface de desktop Windows projetada para fluxos de trabalho profissionais do mundo real. Todo o processamento é local, seus dados de voz nunca tocam um servidor externo. Veja o que isso significa na prática para um jornalista trabalhador.
O widget flutuante fica no topo do seu CMS, documento Word ou Google Doc. Você fala; o texto aparece. Não há treinamento necessário, o modelo do Whisper funciona imediatamente com seu sotaque e vocabulário. A maioria dos jornalistas digita 60-70 ppm. Ditar confortavelmente roda 130-150 ppm. Essa é uma vantagem de velocidade 2x em primeiros esboços, e a prosa frequentemente lê mais naturalmente porque você está falando a história em vez de compô-la palavra por palavra.
Importe qualquer arquivo de áudio, WAV, MP3, M4A, MP4, e o StarWhisper transcreve localmente. Uma entrevista telefônica de 60 minutos se torna um arquivo de texto pesquisável em 5-15 minutos, dependendo do seu hardware. A transcrição fica na sua máquina. Sem upload, sem processamento de terceiros, sem exposição. Veja também: software de transcrição de entrevistas para mais detalhes sobre o fluxo de importação de arquivos.
Uma vez instalado, o StarWhisper não requer conexão com a internet para operar. Isso é enormemente importante para notícias de última hora de locais remotos, correspondência estrangeira, reportagem embarcada ou cobertura de eventos onde o Wi-Fi está ausente ou não é confiável. Dite suas notas no campo; sincronize sua cópia quando estiver de volta em uma conexão.
O modelo multilíngue do Whisper lida com espanhol, francês, alemão, árabe, mandarim, japonês, português, russo e mais 20+ idiomas. Para correspondentes estrangeiros entrevistando fontes no idioma local, isso significa que você pode transcrever o áudio da fonte diretamente sem um serviço de tradução separado. A detecção automática de idioma lida com gravações mistas.
Jornalistas freelancers que vivem de renda por atribuição não podem absorver custos imprevisíveis de transcrição por minuto. O StarWhisper Pro é $10/mês ou $80/ano fixo, ditado ilimitado, transcrição ilimitada. Uma matéria investigativa com 8 horas de entrevistas custaria $120 para transcrever via Rev. Com o StarWhisper, está incluído na sua assinatura mensal, independentemente do volume.
Este é um relato realista de como um repórter metropolitano de uma redação digital primeiro integra software de ditado jornalístico em um dia típico de história.
07:45, Notas da reunião matinal. O repórter dita suas notas matinais diretamente no Notion, que histórias eles estão acompanhando, ligações para fazer, registros públicos para solicitar. Falar a 140 ppm versus digitar a 65 ppm, isso leva 8 minutos em vez de 16. O widget flutuante é fixado na aba do Notion.
09:30, Primeira entrevista por telefone. O repórter grava a chamada com um aplicativo gravador. Ao desligar, eles arrastam o arquivo de áudio para o modo de transcrição de arquivo do StarWhisper. Enquanto a transcrição é gerada (10 minutos para uma chamada de 45 minutos no laptop apenas com CPU), eles preparam perguntas para a segunda entrevista.
11:00, Coletiva de imprensa na prefeitura. O repórter grava a conferência completa no telefone. Sem necessidade digitar notas freneticamente, eles sabem que terão uma transcrição. Eles se concentram totalmente em perguntas de acompanhamento e na identificação de ângulos noticiosos.
13:00, Escrevendo a história. Ambas as transcrições estão prontas. O repórter abre o modelo de artigo em seu CMS e dita o lide, depois o parágrafo principal, depois tece citações lendo-as em voz alta da transcrição no segundo monitor. Tempo total de ditado para uma história de 600 palavras: 25 minutos. Tempo total se digitado: 50+ minutos.
14:30, Começa a segunda história. O repórter tem uma hora antes do prazo para começar uma peça de acompanhamento. Como o ditado economizou 90 minutos de tempo de transcrição e digitação hoje, há capacidade para fazê-lo.
A segurança digital para jornalistas não é opcional, é uma obrigação profissional e ética. Veja como a arquitetura do StarWhisper lida com os cenários que mais importam.
Quando todo o processamento de áudio acontece na sua máquina local, não há registro do áudio no lado do servidor, nenhuma política de retenção de dados com a que se preocupar e nenhum terceiro que possa receber uma demanda legal pelos dados. As diretrizes de segurança digital do CPJ consistentemente recomendam minimizar a exposição de dados para material de fonte sensível. O processamento apenas local é a abordagem arquitetural correta.
Serviços de transcrição na nuvem recebem e armazenam seu áudio. Se um serviço receber um intimação ou solicitação de acesso governamental para os dados de um usuário, eles geralmente devem cumprir. Se esse áudio nunca saiu da sua máquina, a exposição simplesmente não existe. Para jornalistas investigativos lidando com material legalmente sensível, essa distinção é significativa.
Jornalistas operando sob GDPR (UE), DPA do Reino Unido ou outras estruturas de proteção de dados enfrentam escrutínio crescente sobre como lidam com dados de fontes e sujeitos. Como o StarWhisper é inteiramente local, não há transferência de dados para cumprir, nenhum relacionamento de processador para documentar e nenhum risco de violação de terceiros com o que se preocupar.
A configuração leva menos de 15 minutos. Aqui está a configuração recomendada para fluxos de trabalho jornalísticos especificamente:
A matemática da produtividade para software de ditado jornalística é direta, mas os números são significativos o suficiente para valer a pena detalhar.
Tempo de transcrição manual (média 50 min entrevista)
~3,5 h/semana digitando
Com transcrição StarWhisper
~45 min/semana de revisão
Ganho de velocidade de ditado no texto
~1,5 h/semana recuperadas
Tempo total semanal recuperado
~4-5 horas
Ao longo de um ano: 200+ horas de tempo de jornalismo recuperado. A $30/h tarifa freelance, isso são $6.000 em produtividade faturável. O StarWhisper Pro custa $120/ano.
"Mando 3-4 histórias por semana e gastava 8+ horas em transcrição. Agora isso caiu para menos de uma hora no total. Eu literalmente não acredito que fiz do jeito antigo por tanto tempo. O ângulo de proteção de fontes também é real, cubro corrupção do governo local e esse áudio fica no meu laptop, ponto final."
, Repórter metropolitano, veículo digital independente
"Como freelancer eu orçava $80-$120/mês em taxas da Rev para transcrição. Mudar para o StarWhisper Pro a $10/mês nem foi uma decisão difícil. A qualidade é comparável e frequentemente melhor em falantes de inglês com sotaque das minhas entrevistas internacionais."
, Jornalista freelancer, feitos internacionais
"Somos uma redação de duas pessoas cobrindo uma cidade de médio porte. Não podemos pagar ferramentas empresariais. O StarWhisper nos dá capacidades que custariam $500/mês há alguns anos. O ditado sozinho me ajuda a enviar matérias mais rápido do meus colegas do jornal diário."
, Cofundador, site de notícias local independente
Não. Após o download inicial e configuração do modelo, o StarWhisper opera inteiramente offline. Nenhuma conexão com a internet é necessária para ditado ao vivo ou transcrição de arquivo de áudio. Isso o torna confiável no campo e seguro para gravações sensíveis.
O modelo do Whisper lida bem com nomes próprios comuns imediatamente, nomes de cidades principais, políticos conhecidos, organizações estabelecidas. Nomes incomuns ou referências muito locais podem precisar de correção manual. A taxa de correção é tipicamente de 2-5 nomes próprios por hora de áudio em qualidade de áudio média.
Sim. O StarWhisper digita texto diretamente em qualquer aplicativo que tenha foco no seu desktop Windows, WordPress, Drupal, Google Docs, Word, Arc XP ou qualquer CMS personalizado com um campo de entrada de texto. Não há nada para integrar ou configurar; ele funciona universalmente.
Para a maioria das pessoas, sim, mas leva algum ajuste. A primeira semana de ditar textos frequentemente parece mais lenta porque você está desenvolvendo novos hábitos. A maioria dos jornalistas relata atingir paridade com a digitação em 5-7 dias, e superar sua velocidade de digitação em duas semanas de uso regular.
O plano grátis permite 500 palavras/dia de ditado, utilizável para necessidades leves. O Pro ($10/mês ou $80/ano) remove todos os limites de palavras e desbloqueia os modelos médio e large-v3 do Whisper, que fornecem precisão substancialmente melhor em áudios difíceis como entrevistas telefônicas ou gravações de coletivas de imprensa com ruído de fundo.
O Dragon requer treinamento de perfil de voz e custa $200-$600. Ele não faz transcrição de arquivos de áudio, apenas ditado ao vivo. O StarWhisper funciona imediatamente sem treinamento, transcreve áudio pré-gravado, opera offline e custa $10/mês. Para jornalistas especificamente, a capacidade de transcrição de arquivos de áudio do StarWhisper é a vantagem definitiva que o Dragon não pode igualar. Veja também nossa visão geral de software de transcrição profissional.
A combinação de ditado rápido de artigos e transcrição de entrevistas apenas local torna o StarWhisper a ferramenta mais praticamente útil para jornalistas trabalhadores desde o gravador de smartphones. Baixe grátis, rode em seu próximo arquivo de entrevista e gaste o tempo recuperado no trabalho que realmente importa.
Relacionados: Software de transcrição de entrevistas • Transcrição de gravador de voz jornalístico • Fala para texto offline Windows