Transcribe entrevistas de origen y ruedas de prensa totalmente sin conexión, tu audio nunca sale de tu PC. Dicta borradores de artículos directamente en tu CMS. Creado para reporteros que necesitan velocidad, precisión y protección de fuentes.
Gratis para siempre: 2,000 palabras/semana. Actualiza a Pro para uso ilimitado.
El flujo de trabajo de un periodista de campo tiene una ineficiencia estructural: la brecha entre grabar una entrevista y tener texto utilizable de ella. Una grabadora de voz es fácil de llevar y rápida de usar en el campo. Pero el audio en brato es casi inútil para escribir hasta que se convierte en texto buscable. Históricamente, las herramientas para salvar esa brecha han sido caras, lentas, dependientes de la nube, o las tres cosas a la vez.
La transcripción de voz para periodistas es donde la mayoría de los periodistas pierden más tiempo. Una entrevista de origen de 45 minutos grabada en un teléfono o grabadora digital tarda 2-3 horas en transcribirse manualmente, o cuesta $7-$12 enviarla a un servicio en la nube que luego almacena tu audio en sus servidores. Hazlo 200 veces al año y habrás gastado $1,400-$2,400 en tarifas de transcripción y habrás entregado cientos de grabaciones de fuentes sensibles a un tercero.
La complicación adicional es la conectividad. El reportaje real ocurre en lugares con mala o nula Wi-Fi: juzgados, ubicaciones rurales, escenas de noticias de última hora, países extranjeros con roaming de datos costoso. Las herramientas de transcripción en la nube requieren una conexión activa a internet para procesar el audio. Cuando estás en la escena de una historia con dos horas de audio grabado y un plazo a las 6pm, esperar a que se suba el archivo no es viable.
Los periodistas necesitan que su herramienta de transcripción maneje archivos de audio pregrabados de fuentes externas, no solo el habla en vivo de un micrófono. La calidad de audio de una grabadora de teléfono en un restaurante ruidoso, una grabadora digital en un estacionamiento o una grabación de videollamada es muy diferente de la dictación limpia de un estudio. La herramienta también necesita manejar sustantivos propios con precisión out of the box. Y no debe subir audio que contenga información confidencial de la fuente a un servidor remoto.
StarWhisper convierte el audio de tu grabadora de voz o teléfono directamente a texto completamente en tu máquina con Windows, sin necesidad de internet y sin que nunca se transmita audio externamente. El motor es OpenAI Whisper, entrenado con 680,000 horas de audio diverso del mundo real, incluido el tipo de grabaciones de campo imperfectas que producen los periodistas.
Transfiere el archivo de audio de tu grabadora o teléfono a tu portátil, luego arrástralo a StarWhisper. Acepta WAV, MP3, M4A, OGG, MP4, MOV. Extrae el audio y lo procesa localmente. Una entrevista de 45 minutos se transcribe en 5-12 minutos en un portátil típico, más rápido con una GPU. La transcripción se abre como un archivo de texto que puedes editar inmediatamente en tu aplicación de notas o CMS.
StarWhisper solo requiere internet durante la descarga inicial y la configuración del modelo. Después de eso, todo se ejecuta localmente. Puedes conectar tu grabadora en el juzgado, en una habitación de hotel en una ciudad extranjera o en la furgoneta de la sala de redacción y comenzar a transcribir inmediatamente. No se requiere conexión.
Los datos de entrenamiento de Whisper eran intencionalmente heterogéneos. Maneja entornos ruidosos, habla con acento y condiciones de grabación variadas mejor que muchos servicios en la nube. Se espera una precisión del 90-97% en el audio típico de grabadora de campo, notablemente mejor en grabaciones con acento o difíciles que los servicios competidores a puntos de precio más altos.
Whisper maneja español, francés, alemán, árabe, mandarín, japonés, portugués, ruso y 20+ más. Para corresponsales extranjeros que entrevistan fuentes en su idioma, esto significa transcribir el audio de origen directamente sin un servicio de traducción separado. La detección automática de idioma maneja grabaciones en varios idiomas. Consulta también: software de transcripción de entrevistas para un desglose completo del flujo de trabajo.
StarWhisper Pro cuesta $10/mes o $80/año plano. Transcripción ilimitada, sin tarifas por minuto, sin cargos de almacenamiento. Para freelancers que gestionan ingresos variables, la previsibilidad importa: 20 entrevistas en una semana ocupada o 2 en una semana lenta al mismo precio. Consulta nuestra página de software de dictado para periodistas para más contexto del flujo de trabajo.
Un día concreto en la vida de un reportero de noticias de última hora que cubre el ayuntamiento utilizando transcripción de voz para periodistas con StarWhisper.
10:00 AM - Reunión del consejo municipal. El reportero graba la sesión completa de 90 minutos en una Zoom H1. Sin ansiedad por tomar notas. Durante los descansos, dictan detalles de color en el modo en vivo de StarWhisper usando el micrófono de su portátil, directamente en un documento de Notion.
12:00 PM - Entrevista con la fuente. Después de la reunión, 20 minutos grabados con el presidente del consejo. Se aplican reglas básicas sensibles. La grabadora lo capta todo. Ningún servicio en la nube tocará este audio.
12:30 PM - Cafetería, sin Wi-Fi confiable. Ambos archivos de audio se transfieren desde la grabadora vía USB. StarWhisper procesa ambos sin conexión. Tiempo total de procesamiento: aproximadamente 18 minutos para ambos archivos combinados.
12:50 PM - Transcripciones listas. El reporter escanea ambas transcripciones, resalta las citas clave, identifica la entradilla. La limpieza toma 12 minutos corrigiendo algunos sustantivos propios que Whisper entendió ligeramente mal.
1:05 PM - Dictando la historia. El reporter dicta el artículo en el CMS de la sala de redacción a través del modo en vivo de StarWhisper. 600 palabras: 25 minutos para dictar, editar y enviar. Historia en cola a las 1:30pm. El plazo era a las 3pm. Sin StarWhisper, el audio de la reunión de 90 minutos por sí solo habría tomado más de 3 horas en transcribirse manualmente.
Las apuestas de privacidad para la transcripción de voz para periodistas no son abstractas. Así es como se ven los escenarios reales y cómo los maneja StarWhisper.
Cuando una fuente pide permanecer anónima, su voz es el dato más identificable de la historia. Subir ese audio a un servicio en la nube crea un rastro de papel y un punto de exposición legal. StarWhisper procesa el audio en tu máquina sin subida, sin llamada a la API, sin registros de servidor de terceros y sin datos que entregar si un servicio recibe una demanda legal.
Las fuentes que aceptaron hablar en segundo plano o en segundo plano profundo consintieron hablar contigo, no a que su voz fuera procesada por una empresa de IA comercial. La transcripción solo local respeta el espíritu de ese acuerdo de una manera que los servicios en la nube estructuralmente no pueden.
Cuando transmites audio a un servidor en la nube, el audio está potencialmente sujeto a las leyes de dondequiera que se encuentren esos servidores. El procesamiento local elimina esta complejidad legal transfronteriza. Consulta los recursos de seguridad digital de la CPJ para obtener orientación sobre reportajes internacionales.
La configuración toma unos 15 minutos. Aquí está la configuración optimizada para flujos de trabajo de periodismo de campo:
| Método | Entrevista de 60 min | 100 entrevistas/año | ¿Funciona sin conexión? | ¿Fuente privada? |
|---|---|---|---|---|
| Escritura manual | 3-4 horas | 300-400 horas | Sí | Sí |
| Rev AI ($0.25/min) | $15 + espera de subida | $1,500/año | No | No |
| Otter.ai Pro | ~$17/mo con límite | $204/año + límites | No | No |
| StarWhisper Pro | 5-12 min, sin conexión | $120/año plano | Sí | Sí |
Cambiar de la transcripción manual a StarWhisper recupera 250-350 horas por año para un periodista que realiza 100 entrevistas. StarWhisper Pro cuesta $120/año. Con cualquier valoración razonable del tiempo de un periodista, el retorno de inversión es inmediato y sustancial.
"Cubro la legislatura estatal. Las sesiones de la asamblea duran 4-6 horas. Antes solo tomaba notas y rezaba para haber captado bien las citas clave. Ahora grabo con mi Zoom H1 y StarWhisper transcribe la sesión esa misma noche. Estoy citando con precisión desde un archivo de texto en lugar de confiar en taquigrafía. Ha hecho genuinamente que mi reportaje sea más preciso."
Reportero del Capitolio, fuente legislativa estatal
"Estuve basado en América Latina durante dos años. Transcribir entrevistas en español con el modelo grande de StarWhisper - la precisión fue mejor que la de servicios por los que pagué tres veces más. El funcionamiento sin conexión fue esencial; el internet confiable en el campo no era algo en lo que pudiera contar."
Ex corresponsal en América Latina
"Cubrir la fuente judicial significa muchos testimonios sensibles y entrevistas con testigos. La transcripción en la nube nunca fue una opción. StarWhisper fue la única solución que encontré que es lo suficientemente precisa y lo suficientemente privada para ese tipo de trabajo."
Reportero de tribunales y justicia penal
StarWhisper acepta WAV, MP3, M4A, FLAC, OGG y formatos de video comunes, incluidos MP4 y MOV. La mayoría de las grabadoras de voz digitales (Zoom, Sony, Olympus) exportan WAV o MP3 de forma nativa, ambos compatibles sin conversión.
En entornos tranquilos con Voice Memos o una aplicación de grabadora dedicada a 44kHz, se espera una precisión del 94-98% con el modelo medio. El altavoz o entornos ruidosos bajan al 88-93%. El modelo large-v3 maneja el audio telefónico difícil significativamente mejor que el modelo base.
Sí. Puedes poner en cola múltiples archivos de audio para procesamiento secuencial. Pon en cola todos los archivos al final del día y deja que StarWhisper los procese durante la noche. Cada archivo produce una transcripción correspondiente.
No automáticamente. La diarización de hablantes no es una función integrada. La transcripción es texto continuo con marcas de tiempo. Para una entrevista de dos hablantes, la mayoría de los periodistas añaden etiquetas de hablante en 5-10 minutos basándose en el contexto. Aún mucho más rápido que la transcripción manual desde cero.
No. Debido a que StarWhisper procesa todo localmente, tu audio nunca llega a los servidores de StarWhisper y nunca está disponible para entrenamiento o cualquier otro propósito. El modelo Whisper se ejecuta completamente en tu máquina.
El plan gratuito (2,000 palabras/semana) es bueno para evaluación. Un periodista activo casi ciertamente necesitará Pro. Una sola entrevista de 30 minutos produce 3,500-4,500 palabras de transcripción, agotando de un solo golpe el límite gratuito semanal. El plan Pro a $10/mes es la opción práctica para uso profesional. La opción de $80/año es un valor aún mejor.
Los periodistas que evalúan herramientas de transcripción generalmente miran cuatro opciones: escritura manual, servicios en la nube como Rev u Otter, grabadoras de audio profesionales con transcripción integrada y herramientas de IA local como StarWhisper. Aquí tienes un desglose honesto de las compensaciones:
Los servicios de transcripción en la nube son convenientes y rápidos. Rev AI cuesta aproximadamente $0.25 por minuto para transcripción automatizada, lo que equivale a $15 por una entrevista de 60 minutos. Otter.ai Pro cobra $16.99/mes con límites en la duración del archivo y almacenamiento. Ambos requieren conectividad a internet para funcionar y suben tu audio a sus servidores. Para un periodista que cubre una fuente sensible, tribunales, aplicación de la ley, política, seguridad nacional, esta subida es un problema ético genuino. El patrón de voz de tu fuente, el ruido del entorno de fondo y todo el contenido hablado se sienta en un servidor de terceros bajo la política de retención de datos de esa empresa.
Algunas grabadoras de voz digitales modernas (Sony ICD-TX800, serie Zoom H) tienen aplicaciones complementarias con capacidad de transcripción. Estas generalmente requieren sincronizarse con una aplicación de teléfono que luego sube a servidores en la nube para su procesamiento. El costo del hardware es de $150-$400 y la capacidad de transcripción generalmente requiere una suscripción separada. La precisión en las aplicaciones integradas tiende a ser menor que la de los modelos de reconocimiento de voz dedicados. StarWhisper procesa grabaciones de cualquier dispositivo, Zoom, Sony, Olympus, Voice Memos del teléfono, sin requerir el ecosistema propietario del fabricante.
Dragon está diseñado principalmente para dictado en vivo en lugar de transcripción de archivos. Puede transcribir audio grabado de una grabadora de mano usando su modo "transcribir audio", pero requiere un entrenamiento extenso del perfil de voz. Dado que la transcripción de grabadora involucra audio de un micrófono diferente en un entorno diferente al utilizado para el entrenamiento, la precisión en el audio de grabadora de Dragon suele ser menor que su precisión de dictado en vivo. StarWhisper no tiene concepto de perfil de voz, procesa audio de cualquier fuente con el mismo modelo.
Específicamente para la transcripción de voz para periodistas, que implica procesar archivos de dispositivos externos, a menudo en entornos ruidosos, requiriendo capacidad sin conexión, a un costo razonable, la combinación del modelo Whisper, procesamiento local, precios planos y flujo de trabajo de importación de archivos de StarWhisper es la solución más completa disponible actualmente. Consulta también nuestra página sobre software de transcripción profesional para una comparación más amplia del panorama.
El cuello de botella entre tu grabadora y tu historia publicada es la transcripción. StarWhisper cierra esa brecha en minutos, no horas, totalmente sin conexión y sin exponer tus grabaciones de origen a nadie más. La transcripción de voz para periodistas debería ser así de simple. Descárgalo gratis y pasa tu próximo archivo de grabadora a través de él antes de decidir.
Relacionado: Software de dictado para periodistas | Software de transcripción de entrevistas | Voz a texto sin conexión