100%オフライン処理。患者データが外部サーバーに送信されることはありません。
患者とのやり取りは、あなたのコンピューターから離れることはありません。PHI(保護対象健康情報)を自分のマシン内に留めながら、患者との対応記録、臨床メモ、医療記録を効率的に文書化するためのオフライン処理。
100%オフライン処理。患者データが外部サーバーに送信されることはありません。
無料でそのまま利用可能。週2,000単語まで。Pro版は月額$10で無制限。
患者メモはあなたのマシンから離れません。
WhisperはPC上でローカルに動作します。患者データ(PHI)はクラウドに送信されず、私たちがデータを閲覧しないためベンダーBAAも不要です。
医療音声認識ソフトウェアが必要とされているのは、文書化が医療界の深刻な問題の一つとなっているからです。2023年の『Annals of Internal Medicine』の研究によると、医師が患者と対面している1時間あたり、電子カルte(EHR)関連のタスクに約2時間を費やしています。プライマリケア医は1日15〜20件の患者対応を文書化します。救急医はシフト中20分ごとに1件のカルテを作成します。総合内科医は、複数の入院を同時に管理しながら複雑な症例の文書を作成します。
人的コストは無視できません。医師のバーンアウト調査では、行政業務の要求や報酬の不満、職場文化よりも、「文書化の負担」がキャリア満足度低下の最大の要因であることが一貫して示されています。長い一日の終わりに臨床メモをタイピングする時間を、医療研究者は「パジャマタイム(pajama time)」と呼び、子供を寝かせた後に自宅でカルテを完成させるために医師が費やす時間を指しています。
医療音声認識ソフトウェアは長年にわたって解決策として提案されてきました。しかし、市場の主導的ソリューションには独自の摩擦があります。Dragon Medical Oneはユーザーあたり年額500ドル以上かかり、一部の構成ではクラウド接続が必要で、音声プロファイルのトレーニングも要求されます。病院のエンタープライズシステムは診療所を長期契約で縛ります。クラウドベースのアンビエントAIツールは、コンプライアンス担当者が慎重に評価する必要があるPHIセキュリティの問題を提起します。
StarWhisperは、医療音声認識ソフトウェアを別の角度からアプローチします。OpenAIのWhisper音声認識モデルに基づいて構築されており、Windows PC上で完全に動作します。音声データがデバイスから外に出ることはありません。患者データが外部サーバーに到達することはありません。コストは無制限利用で月額10ドル、またはコミット前に評価可能な週2,000単語までは無料です。
HIPAAのプライバシーおよびセキュリティ規則では、対象となる実体に代わって保護対象健康情報(PHI)を処理するベンダーはすべて、ビジネスアソシエイト契約(BAA)に署名する必要があります。これは任意の形式的なものではなく、違反に対して民事および刑事罰がある法的要件です。患者の音声または書き起こしを受け取るクラウドベースの音声認識サービスは、定義上、ビジネスアソシエイトとなります。
BAAの署名、法務担当者によるレビュー、コンプライアンスチャンネルを通じた承認には、多くの医療機関で数週間かかります。独立した診療所にとっては、ベンダー契約を管理する専任のコンプライアンス部門がないため、プロセスはさらに複雑になることがよくあります。
オフラインの医療音声認識ソフトウェアは、この問題を完全に回避します。医師のデバイスからPHIが離れない場合、ベンダー関係はBAAの要件を引き起こしません。患者の声、診断、薬物リストのいずれも外部サーバーに触れることはありません。これこそが、契約上の書類手続きで管理するのではなく、HIPAA準拠を真に単純化するプライバシーアーキテクチャです。
医療音声認識ソフトウェアは、臨床医がソフトウェアに適応するのではなく、多忙な臨床医の実際のワークフローに適合する必要があります。StarWhisperが医療文書作成の特定のニーズにどのように対応するかを紹介します。
StarWhisperのフローティングウィジェットは他のすべてのウィンドウの上に表示されます。Epic、Cerner、Athenahealth、Practice Fusion、AdvancedMD、またはWebベースのあらゆる電子カルte(EMR)のフィールドをクリックして、プッシュツートークを有効にします。話すとテキストがインラインで表示されます。カスタムのEHR統合は不要で、フィールドがキーボード入力を受け付ける限り、StarWhisperで音声入力できます。SOAPメモ、評価フィールド、HPIセクション、退院サマリー、コンサルテーションメモのいずれでも同様に機能します。
多くの医師は、患者の対応中または直後にハンディレコーダーを使用して音声認識を行い、後で書き起こすことを好みます。StarWhisper Proは音声ファイルを直接処理します。MP3またはWAVの録音をロードして、EHRに貼り付け可能な完全なテキスト書き起こしを取得できます。医療タイピスト不要、クラウドアップロード不要、音声認識サービスの結果待ちも不要です。音声データはずっとPC内に留まります。
Whisperの学習コーパスには医学文献、臨床メモ、医療音声が含まれています。標準的な解剖学用語、処置名、一般的な薬剤名、臨床記述子は、ユーザーが音声プロファイルをトレーニングすることなく正確に書き起こされます。高度に専門的な用語(まれなゲノム名、特定の試薬名)は確認時に修正が必要な場合がありますが、基準精度は臨床言語については汎用の音声認識を大幅に上回ります。
長いカンファレンスレポートや退院サマリーを音声認識する医師には、追いつく書き起こしが必要です。ライブ音声認識の場合、CPU上でリアルタイムで動作する「small」モデルが実用的なデフォルトとして推奨されます。長い録音された音声のバッチ書き起こしの場合、StarWhisperはNVIDIA CUDA GPUアクセラレーションをサポートしており、これにより大規模なWhisperモデルの実用性が高まります。CPUで4分かかる10分の録音は、GPUでは1分以内で完了します。
病院システムに雇用されている医師は、エンタープライズ音声認識ツールが提供されている場合があります。一方、開業医、小規模グループ診療、ロカム医師は通常提供されていません。ユーザーあたり月額10ドルで、StarWhisperはどのような診療所でも裁量支出の範囲内で導入可能であり、購入承認、ベンダー交渉、IT展開は不要です。無料から始めて、専門用語に対する精度を評価してからアップグレードしてください。
1日18人の患者を診る総合内科医が、医療音声認識ソフトウェアとしてStarWhisperをどのように使用しているかを見てみましょう。
患者の間、リアルタイム音声認識
各診察の後、医師はEpicで患者のカルテを開き、HPIフィールドをクリックして、キーボードショートカットでStarWhisperを起動します。対応の詳細が新しい状態で記憶されている間に、現病の既往と身体所見をカルテに直接音声入力します。通常90秒の音声認識で、詳細かつ構造化された段落が作成されます。タイピングや構造化フィールドのクリックは不要です。
複雑な症例、音声ファイル書き起こし
詳細な文書化が必要な複雑な入院症例の場合、医師は静かな時間に携帯電話またはハンディレコーダーで長い音声認識を行い、その後StarWhisper Proに音声ファイルをロードして完全な書き起こしを行います。結果として得られたテキスト(完全な入院H&P、評価、計画を含む)は、精度を確認して編集し、EHRに貼り付けます。タイピスト不要、24時間待機不要、患者データのクラウドアップロード不要。
一日の終わり、カルテの完了
患者の間に完成しなかったメモは、音声認識(叙述部分用)と標準的なEHRインターフェース(構造化データ用)の組み合わせで完成されます。医師は、音声認識を導入する前よりも60〜90分早く診療所を退出できます。「パジャマタイム」のカルテ作成は週3回からたまにまで減少します。
1年間を通じて、これは文書化から約400〜600時間を取り戻すことに相当し、その時間を継続教育、家族、あるいは要求の多い臨床業務に必要な身体的回復に充てることができます。
医療音声認識ソフトウェアのHIPAA準拠は、1つのシンプルな問いに帰着します。患者の声はどこへ行くのか? もし音声が処理のためにネットワーク外のベンダーサーバーへ送信される場合、そのベンダーはビジネスアソシエイトとなります。BAAの要件、漏洩通知義務、ベンダーのセキュリティ態勢がすべてあなたの懸念事項となります。
StarWhisperのオフラインアーキテクチャにより、「患者の声はどこへ行くのか?」という問いに対する答えは「どこへも行かない」になります。音声はWindowsマシン上でローカルに動作するWhisperモデルによって処理されます。モデルは推論全体をRAMとローカルGPU(利用可能な場合)内で実行します。書き起こし中にデバイスからパケットが外に出ることはありません。結果のテキストは、あなたがタイピングしたかのようにEHRに貼り付けられます。
私たちは「HIPAA認定」ではなく、「HIPAA対応(HIPAA-suitable)」という言葉を意図的に使用しています。HIPAA認証は正式なプログラムではなく、ソフトウェアをHIPAA準拠として認定する政府機関は存在しません。重要なのは実際のデータ処理アーキテクチャと、ツールに関する診療所のポリシーです。
オフラインの医療音声認識ソフトウェアの場合、重要な技術的制御は以下の通りです:(1) いかなるネットワークでもPHIを送信しない、(2) 患者の音声をベンダーシステムに保存しない、(3) 患者コンテンツに関するデータ保持や分析を行わない。StarWhisperは設計によりこれら3つすべてを満たしています。診療所のワークステーションのセキュリティ、物理的なアクセス制御、デバイス暗号化に関するポリシーがコンプライアンス全体像を完成させます。
HHS Office for Civil Rights HIPAA Security Guidanceは、電子化保護対象健康情報(ePHI)の技術的保護措置要件に関する権威ある情報を提供しています。複雑なコンプライアンスの問題に取り組む専門診療所については、メンタルヘルス特有のプライバシーに関する考慮事項をカバーした、当社のセラピスト向け音声認識ソフトウェアのページもご確認ください。
| 平均メモ作成時間(タイピング) | 8分 |
| 平均メモ作成時間(音声認識) | 2.5分 |
| メモあたりの節約時間 | 5.5分 |
| 1日のメモ数 | 18 |
| 1日の節約時間 | 約99分 / 日 |
| StarWhisper Proのコスト | $10 / 月 |
1日あたりほぼ100分。これが文書作成から回収され、臨床ケアまたは個人的な時間に充てることができます。230日の臨床年では、これは380時間に相当します。医師の時間を控えめな時間単価で評価しても、月額10ドルの投資対効果(ROI)は医学界でも最も非対称なものの一つです。
より少ないがより複雑な患者を診る専門医にとって、メモあたりの時間節約はさらに大きくなります。タイピングに20分かかる詳細な循環器系カンファレンスメモは、音声認識と確認で5〜7分で済みます。構造化されたレポート要件がある放射線医、病理医、麻酔科医は、リアルタイム音声認識とテンプレート構造の組み合わせから恩恵を受けます。
このROIを、月額40〜60ドルのDragon Medical One、または医師あたり月額100〜200ドルのエンタープライズアンビエントAIツールと比較してください。音声AIツールのコストメリットを評価する診療所については、当社のプロフェッショナル向け音声認識ソフトウェア比較もご覧ください。
「以前は診療時間後にメモを完成させるのに45分を費やしていました。今では患者の間に完了させられます。循環器系用語の精度に驚きました。『トロポニン』『駆出率』、薬剤名も最初から正しく処理されます」
、循環器内科医、開業医
「ネットワーク要求を行わないと説明したとき、IT部門はすぐに満足しました。その会話は通常、数か月かかります。私たちは午後だけで稼働させることができました」
、総合内科病院勤務医、地域病院
「開業医としてコストを正当化できなかったため、Dragon Medicalから切り替えました。StarWhisperは価格の20%で機能の80%を提供します。外来診療の家庭医療には、私が必要とするすべてをカバーしています」
、家庭医療医師、開業医
StarWhisperはすべての音声をデバイス上でローカルに処理し、患者データを外部サーバーに送信しないため、通常のBAAトリガーは適用されません。PHIを受け取る第三者ベンダーは存在しません。オフラインのEHRローカルバックアップにBAAが必要ないのと同じ原則です。確定的な機関の判断については、診療所のコンプライアンス顧問にご相談ください。
ほとんどの外来およびオフィスベースの文書作成タスクについては、はい。Dragon MedicalのStarWhisperに対する利点には、EHR固有の音声コマンド(「新しい段落」「評価へ移動」)や、専門用語最適化の長い実績が含まれます。StarWhisperの利点:コストは80〜90%低額、デフォルトでオフラインのアーキテクチャ、音声プロファイルのトレーニング不要、Microsoft Storeで入手可能。テキストフィールドへの単純な音声入力については、StarWhisperは競争力があります。
はい。StarWhisperはWindowsのアクセシビリティAPIを使用して、フォーカスされた任意のテキストフィールドのカーソル位置にテキストを貼り付けます。Epic Haiku、Epic Web、Cerner PowerChart、Athenahealth、Meditech、AdvancedMDはすべて、このメカニズムを通じて音声入力されたテキストを受け付けます。これはキーボードからタイピングするのと同じ原則です。EHRは、入力されたテキストと音声入力されたテキストを区別できないため、EHR側の統合や設定は不要です。
Whisperは医学および科学コンテンツを含む多様なデータセットでトレーニングされています。臨床テストでは、一般的な解剖学用語、標準的な薬剤名、一般的な臨床言語を正確に処理します。高度に専門的な用語、特定のゲノムマーカー、似た発音の代替案があるまれな薬剤名は、確認時に注意が必要です。大規模なWhisperモデル(Proで利用可能)は、smallやbaseモデルよりも、高密度の医療用語で測定可能に優れたパフォーマンスを発揮します。
音声ファイルと書き起こしは、指定した場所のPCにローカルに保存されます。StarWhisperは音声やテキストをアップロード、同期、保持しません。削除は簡単で、他のローカルドキュメントと同じようにファイルを管理してください。PHIの文書保持ポリシーがある診療所の場合、既存のEHR文書ポリシーに従って書き起こしファイルを処理してください。
はい。臨床対応を文書化するすべてのWindowsユーザーがStarWhisperを使用できます。NPやPAは通常、医師と同じペースで、同じEHR環境で文書を作成し、同じ文書化の負担に直面しています。ユーザーあたり月額10ドルの価格設定により、診療所の臨床スタッフ全体への展開が実用的です。
無料プランでは、週2,000単語までのリアルタイム音声認識が永続的に利用可能で、時間制限はありません。これは、Proにアップグレードして無制限利用と音声ファイル書き起こしを利用する前に、専門分野の語彙とワークフローに対する精度を徹底的に評価するのに十分です。
無料プラン:週2,000単語。臨床語彙に対する精度を評価するのに十分です。月額$10のPro版:無制限の音声認識、音声ファイル書き起こし、最高精度のWhisperモデルにアクセス可能。アカウント不要、クラウド登録不要、BAAの頭痛もありません。
ボイス音声認識に切り替えた医師は、通常1日60〜90分を取り戻します。新しいツールの習得にかかる投資は数時間ですが、リターンは取り戻された夜の時間という数年単位で計られます。
Microsoft Storeでも利用可能です。Windows 10およびWindows 11対応。
関連: Windows版Dragon代替ソフト | オフライン音声テキスト変換 | プロフェッショナル向け書き起こしソフトウェア