更新日志
2.0.0
AI Hear 2.0 是对 1.x 的完整重写。 1.x 的核心是实时字幕悬浮窗;2.0 保留这一体验,并扩展为 本地优先的转录工作台。实时会话、音视频文件和听写都可以保存、搜索、修订、回听、翻译和总结。
2.0 全新功能
本地媒体库。 实时字幕、听写和文件转录统一保存在 Mac 上。支持全文搜索、按来源与日期浏览、 录音重命名,以及批量导出或删除。
音视频文件转录。 拖入常见音频或视频格式即可离线转录。实时字幕和文件转录分别保存自己的模型、 源语言与提示词,会议使用的小模型不会覆盖文件转录的高精度配置。
听写。 通过全局快捷键在任意位置开始听写,并可在输出前自动润色或翻译。直接下载版在获得 辅助功能权限后可以自动粘贴;Mac App Store 版会把结果复制到剪贴板,由你粘贴到目标 App。
本地 AI 与连续追问。 对任意录音生成总结、要点、待办、会议纪要或润色结果,并在同一条持久化 对话中继续追问。内置本地模型无需 API Key,也不上传转录文本;还可以连接你自己选择的 OpenAI 兼容服务商。
相对 1.x 的升级
实时字幕。 置顶悬浮字幕窗现在支持边说边出的临时字幕、按句定稿、双语显示,以及分场景的语言 和提示词设置;模型会提前预热,让第一条字幕更快出现。
麦克风与系统声音同时采集。 1.x 一次只能选择一个来源。2.0 可以同时混合麦克风与系统声音, 分别调节增益,并可把系统音限定到某个 App、窗口或显示器。
更多本地语音引擎。 除 Whisper 外,2.0 新增 SenseVoice、Qwen3-ASR 与 Parakeet 模型,并在支持 的 macOS 版本上提供低延迟流式方案。首次运行向导会推荐、下载并测试合适的模型,让你在第一次正式 使用前确认它可以工作。
翻译。 1.x 中非官方的 Microsoft、Bing、Google 接口已替换为 Apple 端侧翻译(系统支持时)、 内置本地模型,或用户自行配置的 OpenAI 兼容服务商。目标语言扩展到 60 多种,支持搜索、自定义语言, 也可以选择同语言“润色”。
修订与精听。 可以修改原文或译文、拆分与合并句子、调整时间、撤销改动,并随时恢复模型原始输出。 播放支持逐句跳转、单句循环、A–B 循环、变速、文稿内查找,以及 TXT/VTT/SRT 导出。
更原生的 Mac 体验。 2.0 新增首次运行向导、深浅色主题、系统强调色、原生菜单与对话框、本地存储 管理;界面支持英文、简体中文、繁體中文、日本語和한국어。
默认保护隐私。 音频、录音、转录与语音识别都留在你的 Mac 上。只有当你主动选择并使用云端 AI 服务商时,相关文本才会离开设备。应用无需账号、没有使用统计;可选的崩溃上报默认关闭,也不会包含 音频、转录内容或 API Key。详见隐私政策。
系统要求与兼容性
AI Hear 2.0 需要搭载 Apple 芯片、运行 macOS 13 Ventura 或更高版本的 Mac。Intel Mac 与 Windows 用户请继续使用 AI Hear 1.x。
以下 1.x 专用功能尚未在 2.0 提供:自定义字幕字体颜色、Windows GPU 选择、局域网/SSE 字幕服务, 以及 SOCKS 代理。如果其中一项是你的刚需,请告诉我们。