OpenVoiceFlow 0.5.6 开源软件 – macOS开源本地语音输入工具

介绍

OpenVoiceFlow 是一款面向 macOS 的开源按键说话语音听写工具,只需按住指定按键开始讲话,松开后即可把转录文本输入当前光标所在位置,适用于邮件、聊天、文档、提示词、代码评审等多种场景。软件使用 Whisper 在 Mac 本机完成音频转录,语音不会上传到服务器,生成文字后录音随即丢弃,默认关闭 AI 润色,因此无需联网也能进行基础听写。用户可通过实时悬浮窗和波形确认收音状态,利用个人词典校正姓名、团队名称与专业术语,并为 Slack、邮件等不同应用配置匹配场景的表达风格。它还提供语音触发文本扩展、个人信息访谈、听写历史和多尺寸转录模型,可按设备性能选择准确率与速度。需要整理语句时,可接入 OpenRouter、OpenAI、Anthropic 或 Groq,也能使用 Ollama 在本机完成润色;无论选择何种文字处理后端,音频转录始终留在设备上。OpenVoiceFlow 无需注册账户,不含遥测,设置与历史保存在本地 Application Support,密钥存入 macOS 钥匙串,支持 macOS 14 及更新系统,并兼容 Apple Silicon 与 Intel Mac。

截图

功能

OpenVoiceFlow 是一款将本地 Whisper 转录、按键说话操作和可选文本润色结合在一起的 macOS 语音输入应用,可在任意支持光标输入的应用中快速完成听写,同时让用户自行控制隐私、模型与处理后端。

  • 按住即说: 按住设定的 Fn 或地球键开始录音,讲话结束后松开按键,转录结果会直接写入当前应用的光标位置,无需在独立窗口复制粘贴。
  • 本地转录: 所有音频均由 Mac 上运行的 Whisper 模型处理,录音不会离开设备,文本生成后音频立即丢弃,断网或飞行模式下仍可使用。
  • 实时悬浮窗: 录音期间显示简洁的 HUD 与动态语音波形,让用户能够直观看到应用是否正在监听以及麦克风输入状态。
  • 多级模型选择: 提供从轻量到大型的 Whisper 模型,可根据 Apple Silicon 或 Intel Mac 的性能,在转录速度、资源占用和识别准确率之间灵活取舍。
  • 个人词典: 可录入姓名、品牌、团队名称、缩写和行业术语,减少专有词汇被错误拼写的问题,让长期听写结果更贴合个人工作内容。
  • 个人信息访谈: 通过 Know Me 配置了解用户姓名、团队与常用表达,为后续转录和文字整理提供更准确的背景信息。
  • 分应用风格: 能够针对不同应用设置表达方式,例如在 Slack 中保持自然简洁,在邮件中采用正式完整的语气,降低听写后的手工修改量。
  • 语音文本扩展: 支持通过预设口令触发常用文本片段,将语音短语扩展为签名、模板、固定回复或重复使用的长段内容。
  • 可选智能润色: 默认直接粘贴原始本地转录,也可使用自有密钥连接 OpenRouter、OpenAI、Anthropic 或 Groq,对标点、语法和表达进行整理。
  • 离线文字整理: 支持连接 Ollama 和本地语言模型,在不调用云端接口的情况下完成转录文本清理,构建全程离线的语音输入流程。
  • 隐私数据管理: 设置与历史记录保存在 Mac 的 Application Support 目录,API 密钥由 macOS 钥匙串保护,不要求账户登录,也不采集遥测数据。
  • 开源跨架构支持: 采用 MIT 许可证开放源代码,支持 macOS 14 及更新版本,同时兼容 Apple Silicon 与 Intel 处理器设备。

下载链接

THE END
喜欢就支持一下吧
点赞10 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容