AI 驱动的离线语音转录软件。隐私优先,GPU 加速,专业精度。
寻找可靠的 Windows 版离线语音听写软件 时,您面临一个根本性的选择:云端处理还是直接在自己的电脑上处理?许多用户习惯性地选择知名云服务,为此不仅付费,还泄露了数据。StarWhisper 走了一条不同的路:整个语音识别过程在您的 Windows PC 上本地运行,不会有任何音频片段离开设备。
这听起来像是一个技术细节,但对于德国、奥地利和瑞士的自由职业者、律所、医生诊所和企业来说,这具有重要意义。GDPR 要求数据最小化和目的限制。即使供应商通过了 ISO 认证,将客户谈话录音、患者病史或机密商务会议的音频数据上传到云端,仍处于法律灰色地带。
StarWhisper 完全解决了这个问题。作为 Windows 版离线语音听写软件,它在一次性设置后不需要互联网连接。OpenAI Whisper 的 AI 模型直接在您的硬件上运行,无论您是在慕尼黑的家庭办公室、去法兰克福的火车上,还是在没有外联的政府机构内。
对高性能 Windows 版离线语音听写软件 的需求来自各个角落。所有人的共同点:希望控制自己的数据,并在不依赖第三方服务器的情况下获得可靠性能。
客户访谈、合同笔记、起诉状,律所每天都会产生高度敏感的语音录音。根据德国刑法典第 203 条,职业保密义务禁止未经授权的披露。如果通过云服务处理音频,即使供应商承诺保密,您也会失去控制权。使用 StarWhisper,您可以直接口述到律所软件中,转录在本地运行,没有任何数据离开办公网络。阅读更多关于法律口述解决方案的信息。
在德国,患者数据受联邦数据保护法和欧盟 GDPR 约束。诊所和医院需要语音识别,不会向外部传输健康数据。StarWhisper 在本地诊所计算机上处理所有音频录音,通过 Windows 剪贴板与常见的医疗管理系统兼容。结果是:更快的文档记录,更多时间用于患者。查看更多关于医疗口述解决方案的详细信息。
采访、调研谈话、新闻发布会记录,记者每天都会录制数小时的音频。使用 Windows 版离线语音听写软件,即使在旅途中也可以转录这些录音:在区域列车上、在偏远的新闻发布会现场,或者在移动网络昂贵的国外。StarWhisper 在安装后不会下载任何外部资源。
口述代码与写信不同。技术术语、变量名、框架名称、云服务通常难以识别。OpenAI Whisper 在广泛的技术文本上受过训练,能正确识别许多术语。对于语音编程,推荐使用 Whisper 中型或大型模型。
StarWhisper 基于 OpenAI Whisper,这是一个在 680,000 小时多语言音频数据上训练过的神经网络。该研究小组在开放许可下发布了该模型,StarWhisper 将其打包到一个用户友好的 Windows 界面中,无需任何技术先验知识。
在底层,StarWhisper 使用 whisper.cpp,这是 Whisper 模型的高度优化的 C++ 实现。该库专为桌面硬件设计,利用 AVX/AVX2 处理器扩展以及可选的 NVIDIA CUDA。结果:转录速度通常超过实时速度,即使没有专用 GPU。
StarWhisper 在安装程序中直接捆绑了三个 Whisper 模型。使用 Pro 计划,您可以解锁更大的模型:
| 模型 | 内存需求 | 准确率 | 推荐用途 |
|---|---|---|---|
| Tiny | ~1 GB | 良好 | 快速笔记,头脑风暴 |
| Base | ~1,5 GB | 非常好 | 日常使用,电子邮件 |
| Small | ~2,5 GB | 优秀 | 报告,会议记录(标准) |
| Medium (Pro) | ~5 GB | 非常高 | 专业听写,医学,法律 |
| Large-v3 (Pro) | ~10 GB | 最高 | 最高要求,口音 |
GPU 加速在大型模型上尤为显著:一张 NVIDIA RTX 3060 可以将 30 分钟录音的处理时间从几分钟缩短到 60 秒以内。
市场上有许多听写解决方案,但几乎没有一个能将真正的离线处理与当前的 AI 准确率结合起来。让我们来看看主要的区别。
Dragon Professional Individual 多年来一直是桌面听写软件的市场领导者。该软件在本地处理音频,但根据版本不同,一次性费用为数百欧元,需要大量的口音训练,且不提供集成的云备用选项。StarWhisper 免费起步,无需说话人配置文件训练,并得益于 Whisper 技术,无需数小时的配置即可达到相当的准确率。如果您想深入研究该主题,可以在 维基百科 上找到关于语音识别的精彩概述。
现在免费试用: 下载 StarWhisper 并立即开始口述,无需账户,无需信用卡。前往免费下载
安装 Windows 版离线语音听写软件只需不到五分钟。StarWhisper 在安装程序中直接捆绑了 Whisper 基础模型,因此无需额外下载即可立即进行首次测试。
下载安装程序,运行,完成。Windows 10/11,8 GB 内存。
预装 Tiny/Base。Pro 解锁 Medium 和 Large-v3。
打开浮动小部件,激活麦克风,说话,文本随处出现。
浮动小部件可以浮动在任何应用程序上方,Word、Outlook、记事本、您的浏览器。您可以在电子邮件、表单和文本文档中听写,而无需切换窗口。这是相对于只能在自有文本编辑器中工作的听写软件的一个决定性优势。
是的,完全离线。Whisper AI 模型在安装时存储在本地,之后无需网络连接即可运行。仅在首次下载和(如需要)软件更新时需要互联网连接。基本功能的账户内使用完全可以离线。
对于发音清晰且麦克风良好的情况,OpenAI Whisper 在德语中的词错率 (WER) 低于 5%。方言和重口音会略微增加错误率,此时 Medium 或 Large 模型会有所帮助。在曼海姆大学的独立基准测试中,Whisper 在德语上的表现优于许多商业替代品。
符合。由于所有音频数据完全在本地处理,因此不会产生需要传输或存储的个人数据。不存在第三方进行的 GDPR 定义下的“处理”(Art. 4 No. 2)。对于拥有数据保护官 (DPO) 的公司:纯本地处理通常不需要数据保护影响评估 (DPIA)。
专业版每月费用为 10 美元(约合 9 欧元)或每年 80 美元(约合 73 欧元)。您将获得无限转录、访问大型 Whisper 模型 (Medium, Large-v3) 以及优先支持。免费计划包含每天 500 字和小型模型,非常适合在决定之前进行试用。
可以。除了实时听写外,StarWhisper 还支持存储的音频文件 (MP3, WAV, M4A, FLAC 等) 的转录。您只需将文件拖入程序窗口,即可在几秒到几分钟内(取决于长度和模型大小)获得转录稿。
StarWhisper 支持超过 29 种语言,包括德语、英语、法语、西班牙语、日语、中文等。语音识别可以自动检测语言,也可以手动设置为特定语言。对于德语区 (DACH) 用户,当然特别关注其卓越的德语性能。
StarWhisper 是免费的。无需账户,无需信用卡,云端无数据。立即下载,今天听写您的第一页内容,完全离线,完全私密。
免费下载Windows 10/11 • 无需账户 • 符合 GDPR • 免费赠送 500 字/天
更多信息:Windows 语音识别软件 • 语音识别软件与隐私