患者とのやり取りはコンピューターから出ることはありません。電子カルテ(EMR)に直接、臨床記録、病歴、退院時サマリーを音声入力します。StarWhisperはPC上で完全に動作し、PHI(保護された健康情報)を自分のマシン内に留めるオフラインワークフロー向けに設計されています。
永久無料。週2,000単語まで。Pro版は月額$10で無制限。
患者の記録はあなたのマシンから出ていきません。
WhisperはあなたのPC上でローカルに動作します。PHIがクラウドに送信されることはなく、データを一切見ないためベンダーとのBAA(ビジネスアソシエイト契約)も不要です。
プロフェッショナル医療音声認識は単なる生産性向上の便利なツールではなく、持続可能な診療にとって臨床上の必須要素です。EHR(電子カルテ)の導入に伴い、臨床医の事務的な記録負担は着実に増加しています。臨床データの流れを合理化するはずだったものが、事実上もう一つのフルタイム業務になってしまいました。米国医師会の調査によると、記録の負担が医師の不満と早期退職の主要な要因となり続けています。
具体的な課題は非対称性です。臨床的な思考は速いですが、テキスト入力は遅いです。複雑な患者を評価する医師は、病歴、身体所見、検査データ、画像、臨床的背景を総合して評価しますが、それには数秒しかかかりません。しかし、その総合結果を構造化された文書に変換するには数分かかります。1日15〜20人の患者に対して、このギャップが積み重なると、患者時間、家族の時間、休息を奪う1日90分以上のタイピング時間となります。
プロフェッショナル医療音声認識ソフトウェアは、医師が思考の速度で記録できるようにすることで、このギャップを埋めます。最良の実装は、ワークフローに溶け込み、医師が自然に話し、テキストが正確に現れ、追加の努力を必要とせずに臨床記録が臨床的思考の質を反映するものです。
StarWhisperは、プライバシーファーストのアーキテクチャからプロフェッショナル医療音声認識にアプローチします。すべての音声認識は、Windows PCに直接インストールされたOpenAIのWhisperモデルを通じてローカルで実行されます。患者の音声データが外部サーバーに到達することはありません。これにより、HIPAAの分析はシンプルになります。PHI(保護された健康情報)は臨床医のデバイスから出ることがないため、サブスクリプションサービスの4倍から6倍のコストがかかるようなサービスと同等の精度を実現します。
Windowsの標準音声認識やGoogle Dictateなどの基本的な音声タイピングツールは、一般的な言語を適切に処理しますが、プロフェッショナル医療音声認識にはそれ以上のものが求められます。臨床記録には、叙述、構造化された臨床用語、薬剤名、投与単位、解剖学的参照、ICDコード化された診断言語などが急速に変化して含まれます。消費者の音声やWebコンテンツで訓練された一般的な音声認識エンジンは、この語彙の密度に対してはパフォーマンスが低下します。
Whisperのトレーニングコーパスには学術論文、医学文献、多様な臨床音声が含まれており、これにより医療語彙に対するベースラインのパフォーマンスが大幅に向上しています。ベッドサイドや診療内でのリアルタイム音声認識には、Smallモデルが実用的なデフォルトであり、ほとんどの臨床医が日常的に使用することを推奨しています。ProモードのMediumおよびLargeモデルは、診察後の長時間録音(10分以上)のファイル変換など、追加のコンテキストが役立つ場合に予約されています。短い臨床フレーズでは、Largeモデルは過度に修正を行い、エラーを導入する可能性があるため、Smallモデルが適しています。
StarWhisperのフローティングウィジェットは、あらゆるアプリケーションの上で動作します。Epic、Cerner、Athenahealth、eClinicalWorks、NextGen、またはWebベース・デスクトップ問わず、EMRシステム内の任意のテキストフィールドをクリックしてください。プッシュトゥトークを有効にします。ノートを話します。テキストは、入力されたかのようにカーソル位置に表示されます。EHRベンダーとの統合契約、IT導入プロジェクト、設定は一切不要です。キーボード入力を受け入れる任意のフィールドで、StarWhisperの音声認識が利用可能です。
多くの臨床医は、患者との診察中または直後に音声入力し、コンピューターでリアルタイムに変換するのではなく、後で録音を書き起こすことを好みます。StarWhisper Proは音声ファイル入力を受け付けます。ハンドヘルドレコーダー、電話、デジタルデバイスで録音されたWAVまたはMP3を読み込み、オフラインで完全なテキスト書き起こしを取得します。書き起こしスタッフ不要、24時間待機不要、患者音声をベンダーサーバーにアップロードする必要もありません。書き起こしは録音後数分以内にレビューでき、EHRに貼り付け可能です。
StarWhisper Proは、MediumおよびLargeのWhisperモデルをアンロックします。日常のライブ音声認識にはSmallモデルが実用的なデフォルトであり、短いクリップではLargeモデルが過度に修正やハルシネーションを起こす可能性があるため、ほとんどの臨床医にはこれを推奨しています。MediumおよびLargeモデルは、長時間録音(10分以上の連続音声)のバッチ変換に最も役立ちます。追加のコンテキストが役立つからです。GPU搭載マシンでは、Largeモデルはこれらのファイルでほぼリアルタイムの速度で実行されます。CPUのみのハードウェアでは遅くなりますが、夜間の診察後ファイル変換には依然として実用的です。
臨床環境でのプロフェッショナル医療音声認識は、PHI(保護された健康情報)の継続的な取り扱いを意味します。すべての患者ノートには定義上PHIが含まれます。StarWhisperのオフライン処理により、音声認識中にPHIが臨床医のデバイスから出ることはありません。ビジネスアソシエイト契約(BAA)は不要です。ベンダーのセキュリティ調査も不要です。第三者によるデータ保持もありません。オーディオは処理され、テキストが生成され、データはマシンから移動しません。クラウドへの往復がないため、第三者によるデータ処理の懸念もありません。
1日に多くの音声認識を処理する診療所では、NVIDIA CUDAアクセラレーションが役立ちます。互換性のあるGPUにより、Large Whisperモデルはリアルタイムの8倍から12倍の速度でオーディオを書き起こし、10分の音声認識は1分以内に完了します。複数の詳細な入院記録を入力する病院医にとって、これは重要です。StarWhisperは利用可能なGPUハードウェアを自動的に検出し、設定なしで使用します。
12人の入院患者を管理する病院内科医が、プロフェッショナル医療音声認識を日常のワークフローにどのように統合するかを考えてみましょう。
朝の回診、日次経過記録
各患者の診察後、病院内科医はベッドサイドのワークステーションで構造化された日次経過記録を入力します。夜間の主観的所見、客観的なバイタルと検査値、現在の評価、更新された計画。Epicの記録フィールドへのリアルタイム音声入力は、患者ごとに90〜120秒かかります。12人の患者に対して、朝の記録は回診が終わる前に、つまり午後7時ではなく、終わる前に完了します。
新規入院、詳細な病歴と身体所見(H&P)を録音
詳細な病歴と身体所見の記録を必要とする複雑な新規入院の場合、医師は診察直後、廊下に立っている間に電話で構造化された音声入力を録音します。録音をワークステーションに転送し、StarWhisper Proで読み込んで書き起こします。15分のH&P音声入力が2分以内に完全なテキストノートを生成します。レビューし、特殊な薬剤名のエラーを修正し、Epicに貼り付けます。複雑な入院記録の合計時間:10分以内。
退院時の記録
退院時サマリーは構造化されたフォーマットで入力されます。システム別の病院経過、実施された手技、アクティブな問題リスト、退院時薬剤、フォローアップ計画。包括的な退院時サマリーの入力には4〜6分の話言葉が必要です。同等の文書をタイピングするには20〜30分かかります。年に数百件の退院時サマリーを含むキャリアでは、この時間差は非常に重要です。
結果として、帰宅後に2〜3時間を記録に費やしていた病院内科医は、臨床診察中および直後に記録を完了するようになります。勤務時間はベッドサイドでは長くなりますが、長くなる必要のない場所(帰宅後)では短くなります。
クラウドベースのプロフェッショナル医療音声認識サービスが急増しています。患者診察中に音声を聞き、すべてを書き起こし、構造化された臨床データを抽出するアンビエントAIツールは印象的な技術ですが、臨床現場が慎重に評価する必要のある重要なプライバシーとコンプライアンスの考慮事項ももたらします。
患者の音声や書き起こしが処理のためにベンダーのサーバーに送信されると、HIPAAのビジネスアソシエイト契約(BAA)の要件がトリガーされます。BAAは、ベンダーがPHIをどのように保護するか、違反が発生した場合にどうするか、データをどのくらい保持するか、および独自のサブプロセッサがデータを使用して何をするかを規定します。ベンダーのBAAとセキュリティ態勢の評価は簡単ではなく、法的レビューと正式なベンダーセキュリティ評価が必要になることがよくあります。
オフラインアプローチはこれを完全に排除します。StarWhisperはマシン上でオーディオを処理します。ベンダーによって保持されるものは何もありません。侵害の可能性のあるクラウドインフラはありません。BAAに関する会話は決して発生しません。なぜなら、BAAを必要とする関係が存在しないからです。
EU、英国、カナダで診療を行う臨床医にとって、GDPRおよび同等の規制により、クラウドベースの医療音声認識にはさらなる複雑さが加わります。別の国のベンダーによって処理される患者データは、越境転送ルールとデータの所在地要件をトリガーします。ローカル処理はこれらの懸念を解消します。患者データはデバイスを離れないため、国境を越えることはありません。
HHS HIPAA for Professionals pageでは、PHIの取り扱い要件に関する最新のガイダンスが提供されています。標準的なHIPAAを超えて追加の守秘義務を負うメンタルヘルスの専門家については、HIPAA、州のメンタルヘルス守秘法、音声認識の交差点をカバーするセラピスト向けプロ音声認識ページを参照してください。
| 日次経過記録、タイピング | 平均7分 |
| 日次経過記録、音声入力 | 平均2分 |
| 1ノートあたりの節約時間 | 5分 |
| 日次記録節約(12人) | 60分 / 日 |
| 入院H&P節約(1日2〜3件) | 30-45分 / 日 |
| 合計日次回復時間 | 90-105分 / 日 |
記録から1日あたり90分が回収されます。医師の時給を控えめに$150とすると、これはシフトあたり$225の回収時間となり、月額$10のProサブスクリプションコストに対して効果を発揮します。時間価値だけで約67対1の投資対収益(ROI)であり、各シフト終了時にカルテが数時間遅れることによるバーンアウトの軽減も考慮されていません。
月額約$40〜$60のDragon Medical One、または臨床医あたり月額$100以上のエンタープライズアンビエントAIソリューションと直接比較してください。完全にオフラインで動作し、月額$10のプロフェッショナル医療音声認識は、プロフェッショナルグレードの精度とワークフロー統合を、すべての個人臨床医が利用できる価格で提供するという独自の市場ポジションを占めています。
「複数の病院で異なるEHRシステムを使うローカムワークをしています。一方ではEpic、もう一方ではCernerです。StarWhisperはEHRに関係なくまったく同じように動作します。フィールドをクリックして話すだけです。数週間ごとに新しい環境に適応しなければならないとき、そのシンプルさは価値があります。」
、ローカム病院内科医
「コンプライアンス担当者は、私が仕組みを見せた当日に承認しました。音声が文字通りマシンから出ないこと、そしてベンダーが関与していないことを実証できるとき、HIPAAの分析は単純になります。評価したすべてのクラウド音声認識ベンダーでは、数ヶ月の法的レビューが必要でした。」
、多専門科グループ診療所の医療ディレクター
「腎臓内科医として、複雑な薬物レジメンや透析パラメータを頻繁に入力します。Largeモデルはこれらを正確に処理します。確認するまれな薬剤名の誤りは数個だけで、レビューで捕捉します。全体的な時間短縮効果は、ノートあたり30秒のレビュー時間をはるかに上回ります。」
、アカデミックメディカルセンターの腎臓内科医
無料版は週2,000単語のリアルタイム音声認識を許可しており、評価には役立ちますが、終日臨床記録には不十分です。Proは単語制限を完全に排除し、音声ファイル変換(診察後録音ワークフローに重要)を追加し、長音声ファイルのバッチ変換用にMediumおよびLarge Whisperモデルをアンロックします。日常のライブ音声認識にはSmallモデルが推奨実用的デフォルトですが、Largeモデルは短い臨床フレーズよりも10分以上のファイル変換でその価値を発揮します。
StarWhisperはフォーカスされたフィールドにテキストを入力します。EHRネイティブの音声ナビゲーションコマンド(Dragon Medicalの「評価へ移動」や「新規ノート作成」など)はサポートしていません。音声ナビゲーションコマンドに大きく依存する診療所では、Dragon Medicalがその点で優位性を持っています。しかし、ほとんどの音声入力ユースケース、つまりノートテキストの作成では、StarWhisperは同等です。
各Windowsユーザーアカウントには独自のStarWhisper設定とサブスクリプションステータスがあります。複数の臨床医が個別のWindowsアカウントでログインする共有ワークステーションでは、それぞれが独自のStarWhisper設定を持ちます。Whisperはユーザーごとの音声プロファイルトレーニングを必要としないため、別の医師が同じマシンを使用しても設定の遅延はありません。
静かなオフィスでの音声入力には、標準的なUSBまたは内蔵ラップトップマイクで十分です。騒がしい臨床環境(オープンナースステーション、ED)では、モデルに到達する前に背景ノイズを低減する近接型ヘッドセットマイクが精度を大幅に向上させます。音声ファイル変換では、デジタルレコーダーはどれも適切な品質を生成し、静かな部屋での電話録音でも十分に機能します。
技術的には可能です。StarWhisperはあらゆる音声ファイルを書き起こします。しかし、診察中に患者を録音することは、州法および臨床倫理基準の下で別の同意要件を提起します。アンビエント診察録音を使用するほとんどの診療所は、明示的な患者同意ワークフローを持つ専用のアンビエントAIプラットフォームを通じて行います。StarWhisperは医師主導の音声入力向けに設計されており、アンビエント診察録音向けではありません。
現在、StarWhisperはユーザーあたり月額$10です。5人以上の臨床医を導入したい診療所については、グループ料金についてサポートにお問い合わせください。グループのサイズに関係なく、1シートあたりのコストはエンタープライズ音声認識の代替品よりも大幅に低くなります。
最小要件:Windows 10または11、8GB RAM、最近のプロセッサ。Smallモデルはライブ臨床音声認識の実用的なデフォルトであり、過去5年以内に構築されたPCで快適に動作します。Largeモデルでの長時間録音のバッチ変換には16GB RAMを推奨し、NVIDIA GPUを強く推奨します。過去3年に臨床環境で導入されたほとんどのワークステーションは、ハードウェアアップグレードなしで要件を満たしています。
100%オフライン。PHIを自分のマシン上に保持するオフラインワークフロー向けに設計されています。ライブ臨床音声認証にはSmallモデル、バッチファイル変換にはMediumおよびLargeが利用可能。月額$10で無制限の音声入力。エンタープライズの代替品のほんの一部。
週2,000単語で無料開始。専門分野の語彙で精度を評価してください。準備ができたらアップグレード。ダウンロードにアカウントは不要です。
Microsoft Storeでもご利用いただけます。Windows 10およびWindows 11対応。