소스 인터뷰와 브리핑을 완전히 오프라인으로 전사하세요. 오디오는 PC 외부로 절대 나가지 않습니다. 기사 초안을 CMS에 직접 받아쓰기 하세요. 속도, 정확도, 소스 보호가 필요한 기자를 위해 제작되었습니다.
영구 무료: 하루 500단어. 무제한 사용은 Pro로 업그레이드하세요.
현장 언론인의 업무 흐름에는 구조적인 비효율이 존재합니다. 바로 인터뷰를 녹음하는 시점과 그것을 활용할 수 있는 텍스트로 변환하는 시점 사이의 간극입니다. 음성 녹음기는 휴대하기 쉽고 현장에서 빠르게 사용할 수 있습니다. 하지만 원본 오디오는 검색 가능한 텍스트로 변환되기 전까지는 기사 작성에 거의 쓸모가 없습니다. 이 간극을 메우는 도구들은 역사적으로 비싸거나, 느리거나, 클라우드에 의존하거나, 그 중 여러 가지 문제를 안고 있었습니다.
언론인용 음성 녹음기 전사는 대부분의 언론인이 가장 많은 시간을 잃는 부분입니다. 휴대폰이나 디지털 녹음기로 녹음한 45분짜리 소스 인터뷰를 수동으로 전사하는 데는 2~3시간이 걸리며, 클라우드 서비스에 보내려면 $7~$12가 듭니다. 그리고 그 서비스는 오디오를 자체 서버에 저장합니다. 1년에 200번 그렇게 한다면 전사 비용으로 $1,400~$2,400을 쓰고 수백 개의 민감한 소스 녹음을 제3자에게 넘긴 셈이 됩니다.
추가적인 복잡함은 연결성입니다. 실제 취재는 Wi-Fi가 없거나 끊기는 곳, 즉 법정, 외딴 지역, 속보 현장, 데이터 로밍이 비싼 외국 등에서 이루어집니다. 클라우드 전사 도구는 오디오를 처리하기 위해 활성화된 인터넷 연결이 필요합니다. 사건 현장에서 2시간 분량의 녹음기 오디오와 오후 6시 마감 시간을 안고 있는 상황에서 업로드를 기다리는 것은 불가능합니다.
언론인은 마이크를 통한 실시간 음성뿐만 아니라 외부 소스에서 가져온 사전 녹음된 오디오 파일도 처리할 수 있는 전사 도구가 필요로 합니다. 시끄러운 식당에서 휴대폰으로 녹음한 오디오, 주차장에서 디지털 녹음기로 녹음한 오디오, 화상 통화 녹음본의 오디오 품질은 깨끗한 스튜디오 받아쓰기와는 매우 다릅니다. 또한 이 도구는 초기 설정 없이도 고유명사를 정확하게 처리해야 합니다. 그리고 무엇보다 기밀 소스 정보가 포함된 오디오를 원격 서버로 업로드해서는 안 됩니다.
StarWhisper는 음성 녹음기나 휴대폰의 오디오를 인터넷 연결이나 외부 전송 없이 Windows 기기에서 완전하게 텍스트로 변환합니다. 엔진은 언론인이 제작하는 불완전한 현장 녹음을 포함하여 680,000시간의 다양한 실제 오디오로 학습된 OpenAI Whisper입니다.
녹음기나 휴대폰에서 노트북으로 오디오 파일을 전송한 뒤 StarWhisper로 끌어다 놓으세요. WAV, MP3, M4A, OGG, MP4, MOV를 지원합니다. 오디오를 추출하여 로컬에서 처리합니다. 일반적인 노트북에서는 45분짜리 인터뷰가 5~12분 만에 전사되며, GPU가 있으면 더 빠릅니다. 전사본은 메모 앱이나 CMS에서 즉시 편집할 수 있는 텍스트 파일로 열립니다.
StarWhisper는 초기 다운로드 및 모델 설정 중에만 인터넷이 필요합니다. 그 이후에는 모든 것이 로컬에서 실행됩니다. 법원, 외국 도시의 호텔 방, 취재 차량에서 녹음기를 연결하고 즉시 전사를 시작할 수 있습니다. 연결이 필요하지 않습니다.
Whisper의 학습 데이터는 의도적으로 다양했습니다. 시끄러운 환경, 억양이 있는 음성 및 다양한 녹음 조건을 많은 클라우드 서비스보다 더 잘 처리합니다. 일반적인 현장 녹음기 오디오에서 90~97%의 정확도를 기대할 수 있으며, 더 비싼 경쟁 서비스들보다 억양이 있거나 어려운 녹음에서 눈에 띄게 더 우수한 성능을 보입니다.
Whisper는 스페인어, 프랑스어, 독일어, 아랍어, 만다린, 일본어, 포르투갈어, 러시아어 등 20개 이상의 언어를 처리합니다. 해당 언어로 소스를 인터뷰하는 특파원에게 이는 별도의 번역 서비스 없이 소스 오디오를 직접 전사할 수 있음을 의미합니다. 자동 언어 감지는 혼합 언어 녹음을 처리합니다. 자세한 내용은 인터뷰 전사 소프트웨어를 참조하십시오.
StarWhisper Pro는 월 $10 또는 연 $80의 정액제입니다. 무제한 전사, 분당 요금 없음, 스토리지 요금 없음. 소득이 들쭉날쭉한 프리랜서에게 이러한 예측 가능성은 중요합니다. 바쁜 주에는 20개의 인터뷰를, 한가한 주에는 2개의 인터뷰를 같은 가격에 처리할 수 있습니다. 추가 워크플로우는 저희 언론인 받아쓰기 소프트웨어 페이지를 참조하세요.
StarWhisper와 함께 언론인용 음성 녹음기 전사를 사용하여 시의회를 취재하는 속보 기자의 구체적인 하루 일과입니다.
오전 10:00 - 시의회 회의. 기자는 Zoom H1을 사용하여 90분짜리 전체 회의를 녹음합니다. 메모 작성에 대한 걱정이 없습니다. 휴식 시간 동안 노트북 마이크를 사용하여 StarWhisper 라이브 모드를 통해 Notion 문서에 직접 현장의 생생한 디테일을 받아쓰기 합니다.
오후 12:00 - 소스 인터뷰. 회의 후, 의장과 20분간 온 더 레코드(공식 취재)로 진행합니다. 민감한 보도 원칙이 적용됩니다. 녹음기는 모든 것을 포착합니다. 어떤 클라우드 서비스도 이 오디오를 만지지 않을 것입니다.
오후 12:30 - 커피숍, 안정적인 Wi-Fi 없음. 두 오디오 파일 모두 USB를 통해 녹음기에서 전송되었습니다. StarWhisper는 두 파일 모두를 오프라인으로 처리합니다. 총 처리 시간: 두 파일을 합쳐 약 18분입니다.
오후 12:50 - 전사본 준비 완료. 기자는 두 전사본을 훑어보고, 주요 인용문을 강조 표시하고, 기사의 핵심(리드)을 파악합니다. Whisper가 약간 잘못 입력한 고유명사 몇 개를 수정하는 데 12분이 걸립니다.
오후 1:05 - 기사 받아쓰기. 기자는 StarWhisper 라이브 모드를 통해 뉴스룸 CMS로 기사를 받아쓰기 합니다. 600단어: 받아쓰기, 편집, 전송하는 데 25분이 걸립니다. 오후 1:30까지 기사가 대기열에 들어갑니다. 마감 시간은 오후 3시였습니다. StarWhisper가 없었다면 90분짜리 회의 오디오만 수동으로 전사하는 데 3시간 이상이 걸렸을 것입니다.
언론인용 음성 녹음기 전사에 있어 프라이버시의 중요성은 추상적인 것이 아닙니다. 실제 시나리오가 어떠하며 StarWhisper가 이를 어떻게 처리하는지 설명해 드립니다.
소스가 익명을 요구할 때, 그들의 목소리는 기사에서 가장 식별 가능한 데이터 조각입니다. 해당 오디오를 클라우드 서비스에 업로드하면 흔적과 법적 노출 지점이 생깁니다. StarWhisper는 업로드, API 호출, 타사 서버 로그 없이 기기에서 오디오를 처리하므로, 서비스가 법적 요구를 받더라도 넘겨줄 데이터가 없습니다.
백그라운드 또는 깊은 백그라운드로 말하기로 동의한 소스들은 상업적인 AI 회사가 자신의 음성을 처리하는 것에 동의한 것이 아니라 기자와 대화하기로 동의한 것입니다. 로컬 전용 전사는 클라우드 서비스가 구조적으로 할 수 없는 방식으로 그 계약의 취지를 존중합니다.
클라우드 서버로 오디오를 전송하면 해당 오디오는 서버가 위치한 곳의 법률을 받을 가능성이 있습니다. 로컬 처리는 이러한 국경 간 법적 복잡성을 제거합니다. 국제 보도 가이드라인은 CPJ 디지털 안전 리소스를 참조하십시오.
설정에는 약 15분이 소요됩니다. 다음은 현장 저널리즘 워크플로우에 최적화된 구성입니다:
| 방식 | 60분 인터뷰 | 연간 100건 인터뷰 | 오프라인 작동? | 소스 비공개? |
|---|---|---|---|---|
| 수동 타이핑 | 3-4시간 | 300-400시간 | 예 | 예 |
| Rev AI ($0.25/분) | $15 + 업로드 대기 | $1,500/년 | 아니오 | 아니오 |
| Otter.ai Pro | ~$17/월 제한 | $204/년 + 제한 | 아니오 | 아니오 |
| StarWhisper Pro | 5-12분, 오프라인 | $120/년 정액제 | 예 | 예 |
수동 전사에서 StarWhisper로 전환하면 100건의 인터뷰를 진행하는 기자는 매년 250~350시간을 되찾게 됩니다. StarWhisper Pro 비용은 연 $120입니다. 기자의 시간을 합리적으로 평가하든, 투자 대비 수익(ROI)은 즉각적이고 막대합니다.
"저는 주 의회를 취재합니다. 의회 회의는 4~6시간 동안 진행됩니다. 예전에는 그냥 메모를 하면서 핵심 인용문을 정확히 적었기를 기도했죠. 이제는 Zoom H1으로 녹음하고 그날 밤 StarWhisper로 회의를 전사합니다. 이제 속기에 의존하는 대신 텍스트 파일에서 정확하게 인용하고 있습니다. 제 보도가 진정으로 더 정확해졌습니다."
주 의회 출입 기자
"2년 동안 라틴아메리카에 주재했습니다. StarWhisper의 대형 모델로 스페인어 인터뷰를 전사했는데 - 정확도는 제가 3배나 더 많은 돈을 지불했던 서비스보다 더 좋았습니다. 오프라인 작동은 필수적이었습니다. 현장에서 안정적인 인터넷을 기대할 수 없었거든요."
전 라틴아메리카 특파원
"법원을 출입하려면 민감한 증언과 증인 인터뷰가 많이 따릅니다. 클라우드 전사는 결코 선택지가 아니었습니다. StarWhisper는 그런 작업에 충분히 정확하면서도 비공개를 유지할 수 있는 유일한 솔루션이었습니다."
법원 및 형사 사법 출입 기자
StarWhisper는 WAV, MP3, M4A, FLAC, OGG 및 MP4, MOV를 포함한 일반적인 비디오 형식을 지원합니다. 대부분의 디지털 음성 녹음기(Zoom, Sony, Olympus)는 WAV 또는 MP3를 기본적으로 내보내며, 둘 다 변환 없이 지원됩니다.
조용한 환경에서 44kHz의 음성 메모 또는 전용 녹음 앱을 사용한 경우 중형 모델로 94~98%의 정확도를 기대할 수 있습니다. 스피커폰이나 시끄러운 환경에서는 88~93%로 떨어집니다. large-v3 모델은 기본 모델보다 까다로운 휴대폰 오디오를 훨씬 더 잘 처리합니다.
네. 순차적으로 처리하도록 여러 오디오 파일을 대기열에 추가할 수 있습니다. 하루가 끝날 때 모든 파일을 대기열에 넣고 밤새 StarWhisper가 처리하도록 두세요. 각 파일은 해당하는 전사본을 생성합니다.
자동으로는 식별하지 않습니다. 화자 분할(Diarization)은 기본 제공 기능이 아닙니다. 전사본은 타임스탬프가 있는 연속 텍스트입니다. 두 사람이 하는 인터뷰의 경우, 대부분의 기자는 문맥을 바탕으로 5~10분 안에 화자 라벨을 추가합니다. 처음부터 수동으로 전사하는 것보다 여전히 훨씬 빠릅니다.
아니오. StarWhisper는 모든 것을 로컬로 처리하기 때문에 오디오가 StarWhisper의 서버에 도달하는 일이 없으며 학습이나 기타 목적으로 사용되지 않습니다. Whisper 모델은 전적으로 기기에서 실행됩니다.
무료 플랜(하루 500단어)은 평가용으로 좋습니다. 현업 기자에게는 Pro가 거의 확실히 필요할 것입니다. 단 30분짜리 인터뷰 하나만으로도 3,000~4,500단어의 전사본이 생성되어 일일 무료 한도를 초과합니다. 월 $10의 Pro 플랜이 전문적인 사용을 위한 실질적인 선택입니다. 연 $80 옵션은 가성비가 더 좋습니다.
전사 도구를 평가하는 언론인들은 일반적으로 수동 타이핑, Rev 또는 Otter와 같은 클라우드 서비스, 전사 기능이 내장된 전문 오디오 녹음기, StarWhisper와 같은 로컬 AI 도구 등 네 가지 옵션을 살펴봅니다. 다음은 트레이드오프에 대한 정직한 분석입니다:
클라우드 전사 서비스는 편리하고 빠릅니다. Rev AI는 자동 전사에 분당 약 $0.25를 청구하며, 이는 60분 인터뷰의 경우 $15입니다. Otter.ai Pro는 파일 길이 및 저장 용량에 제한이 있으며 월 $16.99를 청구합니다. 둘 다 작동하려면 인터넷 연결이 필요하며 오디오를 서버에 업로드해야 합니다. 민감한 분야, 법원, 법 집행 기관, 정치, 국가 안보를 취재하는 기자에게 이 업로드는 진정한 윤리적 문제입니다. 소스의 음성 패턴, 배경 환경 소음 및 모든 음성 콘텐츠가 해당 회사의 데이터 보존 정책에 따라 타사 서버에 보관됩니다.
일부 최신 디지털 음성 녹음기(Sony ICD-TX800, Zoom H 시리즈)에는 전사 기능이 있는 컴패니언 앱이 있습니다. 이들은 일반적으로 처리를 위해 클라우드 서버에 업로드하는 스마트폰 앱과의 동기화가 필요합니다. 하드웨어 비용은 $150~$400이며 전사 기능에는 대개 별도의 구독이 필요합니다. 내장 앱의 정확도는 전용 음성 인식 모델보다 낮은 경향이 있습니다. StarWhisper는 제조사의 독점 생태계 없이 Zoom, Sony, Olympus, 휴대폰 음성 메모 등 모든 기기의 녹음을 처리합니다.
Dragon은 주로 파일 전사보다는 실시간 받아쓰기를 위해 설계되었습니다. "오디오 전사" 모드를 사용하여 휴대용 녹음기에서 녹음된 오디오를 전사할 수 있지만, 광범위한 음성 프로필 훈련이 필요합니다. 녹음기 전사에는 훈련에 사용된 환경과 다른 마이크, 다른 환경의 오디오가 포함되기 때문에 Dragon의 녹음기 오디오 정확도는 일반적으로 실시간 받아쓰기 정확도보다 낮습니다. StarWhisper는 음성 프로필 개념이 없으며, 모든 소스의 오디오를 동일한 모델로 처리합니다.
특히 외부 기기의 파일 처리, 종종 시끄러운 환경, 오프라인 기능, 합리적인 비용이 필요한 언론인용 음성 녹음기 전사의 경우, Whisper 모델, 로컬 처리, 정액제 가격 및 파일 가져오기 워크플로우의 조합을 갖춘 StarWhisper가 현재 사용 가능한 가장 완벽한 솔루션입니다. 더 광범위한 시각의 비교는 전문 전사 소프트웨어 페이지를 참조하십시오.
녹음기와 발행되는 기사 사이의 병목 현상은 전사입니다. StarWhisper는 이 격차를 시간 단위가 아닌 몇 분 만에 좁혀주며, 완전히 오프라인으로 작동해 소스 녹음을 다른 누구에게도 노출시키지 않습니다. 언론인용 음성 녹음기 전사는 이렇게 단순해야 합니다. 무료로 다운로드하고 결정하기 전에 다음 녹음 파일을 한번 실행해 보세요.
관련 항목: 언론인 받아쓰기 소프트웨어 | 인터뷰 전사 소프트웨어 | 오프라인 음성을 텍스트로 변환