Voice, Speech, Audio Dictation
免费 · App 内购买
非常好的软件,希望可以增加简体中文的语言支持
语言能不能增加中文,虽然不影响使用,但是看着好别扭
有了单词级别的时间戳,还可以合并成句子,体验又上升了一个级别,太爱了!!!
每次录完一大段话 都要单独增加标点符号 很难用
■ 改进 • 下载前优化了 Mac 机型要求检查。 • 当 Mac 无法运行某些本地模型时,设置中的本地模型会隐藏空类别。 • 优化本地模型列表,并新增 Qwen 提供商图标。 ■ 问题修复 • 修复了在 macOS 15 上打开实时字幕语言菜单时发生崩溃的问题。 • 根据用户反馈,遗憾地移除了 M1 系列 Mac 对 Qwen3-ASR 的支持。
■ 新增 • Qwen3-ASR:新增支持30种语言的本地转录,包括实时会议和实时字幕。需要 Pro,以及运行 macOS 26 或更高版本的 Apple Silicon Mac。 • Whisper C++:新增语音活动检测,可跳过静音部分;新增设置项,可控制上一段文本是否影响下一段转录。 ■ 改进 • Whisper C++:更新转录引擎并简化高级设置,包括更清晰的低置信度片段重试选项。 • 音频导入:提升对不同 WAV 文件格式的兼容性。 • 录音:降低录音界面和波形的处理开销。 • 侧边栏:优化间距和对齐方式。 ■ 问题修复 • 修复发布版本中 MacWhisper 操作未显示在快捷指令和 Siri 中的问题。 • 修复从部分应用拖入文件时导入可能卡住的问题,包括批量处理和播客工作流。 • 修复转录编辑器错误接受文件拖放的问题。 • 修复笔记标题包含斜杠或冒号时 Obsidian 导出失败的问题。 • 修复隐藏的转录模型出现在模型搜索结果中的问题。 • 修复设置中路线图视图尺寸显示不正确的问题。
■ 改进 • 录音:波形渲染更流畅,处理开销更低。 ■ 问题修复 • 修复:从语音备忘录等应用拖动录音时可能卡住的问题,包括批量模式和播客模式。 • 修复:将文件拖放到转录编辑器后,显示的转录内容可能被文件内容替换的问题。 • 修复:笔记标题包含斜杠、冒号或其他不支持的字符时,Obsidian 导出可能失败的问题。 • 修复:macOS 27 上与布局相关的崩溃问题。 • 修复:设置中的路线图布局和管理导出格式按钮样式问题。
■ 新增 • 分享:现在可通过 macOS 分享菜单,将音频从其他 App 直接发送至 Whisper Transcription,包括语音备忘录。 • AI 模型:新增 GPT-5.6 Sol、Terra 和 Luna、GPT-6 Astra,以及 Claude Fable 5.1。 ■ 改进 • 文件夹:可展开和折叠单个文件夹,应用会记住您下次启动时的布局。 • 文件夹:可使用方向键展开和折叠文件夹;拖动文件时,将鼠标悬停在文件夹上即可打开。 • 翻译:全面改进应用内翻译。 ■ 问题修复 • 修复:重新转录失败时可能替换原始转录内容的问题。现在会保留原始内容,直到重新转录成功完成。 • 修复:永久删除语音备忘录和听写内容后,关联的音频文件可能仍会残留的问题。 • 修复:已删除的转录内容仍可能出现在听写历史记录中,或影响侧边栏计数的问题。 • 修复:从上下文菜单重命名文件夹时,可能无法开始编辑的问题。 • 修复:打开共享文件并重新打开主窗口时,操作可能不稳定的问题。
■ 新功能 • 支持 Apple Intelligence:向 Siri AI 询问有关转录内容的问题,并使用自然语言搜索转录文本 • 快捷指令:在 macOS 27 上,可选择模型、语言和说话人识别方式转录音频或视频,并选择是否将结果保存到资料库 • Spotlight 和 Siri:在 macOS 27 上通过 Spotlight 和 Siri 查找并打开转录内容,支持搜索转录文本,以及引用当前屏幕上显示的转录内容 • 快捷指令导出:在 macOS 27 上获取转录文本,并在不同操作之间传递转录内容,以便保存、分享、预览和格式化导出 • 文件夹:将资料库整理到文件夹中,通过拖放或右键菜单移动项目,并在侧边栏查看项目数量 • 拖放:将转录内容拖入 Finder 以导出 .whisper 存档,或拖入文本目标位置以插入转录文本 • 实时会议(Pro):录音时实时查看会议转录,并识别说话人。在高级设置 → 录音设置中启用实时会议转录,并选择兼容的模型,例如 Parakeet 或 WhisperKit • 实时会议控制(Pro):重命名和合并说话人、突出显示当前说话人、将转录窗口置于顶层,以及从菜单栏打开或结束会议 • AI 集成(Pro):从摘要标签页将 AI 摘要发送到已连接的集成,并选择自动化操作要发送的内容 • 改进词典导入 • 媒体时间码:自动检测受支持 MOV 和 MP4 文件中嵌入的起始时间码,在文件信息中显示起始时间戳,并在编辑器中应用时间偏移 ■ 改进 • 辅助功能:改进了新手引导、历史记录、转录详情、听写设置和设置中的 VoiceOver 标签与导航 • 历史记录搜索:可按原始文件名查找转录内容,并使用引号搜索精确短语,同时在预览中突出显示匹配内容 • 文件导入:可同时导入媒体、转录内容和模型;当个别文件无法导入时,提供更清晰的提示 • 转录队列:查看单个轨道的错误,从部分完成的导入中打开可用转录内容,并在保留未完成任务的同时清除已完成的任务组 • 设置搜索:构建设置搜索索引时减少重复处理,让筛选响应更迅速 • Notion 摘要(Pro):将摘要发送到 Notion 时保留标题和列表,并改进对长篇中文、日文和韩文文本的处理 • 集成反馈(Pro):发送内容时提供更清晰的成功和失败提示,并统一转录内容与摘要的发送菜单 • 资料库保护:在迁移前自动创建轮换数据库备份 • 侧边栏:优化文件夹和分区布局,隐藏数量为零的计数,并通过右键菜单将项目移入文件夹或从文件夹中移除 ■ 问题修复 • 修复:取消转录和卸载模型可能影响后续任务,或导致队列卡住 • 修复:说话人识别过程中转录可能一直卡住,且不会显示可用的转录内容 • 修复:WhisperKit 模型加载不稳定的问题 • 修复:缺少源音频时现在会提前报错,不再将其传递给转录引擎 • 修复:取消保存任务时,部分数据库更改可能丢失的问题 • 修复:在未启用说话人识别的情况下复制或导出转录内容时,段落换行可能丢失的问题 • 修复:历史记录搜索可能错误处理引号或显示过时结果的问题;搜索失败时现在可选择重试 • 修复:即使许可证有效,实时字幕仍可能无法加载 Pro 模型的问题 • 修复:重新转录恢复过程可能导致替换会话被隐藏的问题 • 修复:编辑 AI 提示词标题后更改不一定会保存的问题 • 修复:ElevenLabs 服务器错误可能被错误显示为网络错误的问题
■ 改进 • 在设置中下载的模型现在会在下载完成后立即准备就绪,使用新模型进行首次转录时不再需要额外等待准备 • 转录失败提醒和通知现在会显示发生故障的引擎名称 • 模型列表的获取频率大幅降低,减少启动时的网络流量,并加快网络状况较差时的冷启动速度 ■ 问题修复 • MacWhisper 现在会在 macOS 拒绝访问登录钥匙串时通知你 • 删除 AI 服务时,现在也会从钥匙串中移除其已存储的 API 密钥 • 修复了音频转换仍在读取文件时取消操作导致的崩溃问题 • 自定义 AI 服务现在可以正常处理服务提供商返回的非流式响应,被拒绝的请求也会显示更清晰的错误信息 • 使用已停止服务聊天模型的 Groq 服务现在会自动迁移到当前模型,不再因每次请求都显示“所选 AI 服务不可用”而失败 • 不稳定的网络可能会导致模型列表错误且不显示任何提示,MacWhisper 现在会回退到最近一次成功获取的列表 • 取消 URL 下载时,不再影响同一字段中随后开始的新下载进度显示 • 浮动播放栏不再遮挡编辑器中转录文本的末尾
■ 新增 • 云端转录:新增 Cohere Transcribe 和 Speechmatics,支持模型、语言和地区选项。 • Deepgram 隐私设置:新增退出 Deepgram 模型改进计划的选项,该选项默认启用。 ■ 改进 • AI 模型:更新 Google Gemini 和 xAI Grok 模型,并自动迁移已停用的模型选择。 • 导出选项:为批量导出、监控文件夹预设、自定义预设和导出侧边栏新增说话人姓名、时间戳和毫秒显示控制。 • 云端转录:改进各服务商的稳定性、语言处理和错误提示。 • 服务商设置:为 Cohere、Speechmatics、Corti、Cartesia、Avalon 和 Volcengine 新增专属图标。 • 队列:失败项目现在会显示更清晰的错误信息,不再显示误导性的处理进度。 ■ 问题修复 • 已修复:YouTube 下载不再因 HTTP 403 错误失败,也不会生成空文件。 • 已修复:监控文件夹现在会忽略不支持的文件类型。 • 已修复:转录导出不再显示不支持的时间戳、不再丢失行内容,也不会在按词分组的输出中添加多余空格。 • 已修复:按词分组导出时,说话人姓名现在每个发言轮次只显示一次。 • 已修复:OpenAI、Deepgram 和 Gladia 的结果中不再出现空的转录片段。 • 已修复:ElevenLabs 现在会为他加禄语使用正确的语言代码。 • 已修复:导出的 HTML 转录现在会使用正确的文字颜色。
■ 改进 • Gemini 模型现在显示友好的名称,而非原始 API 标识符 • 模型列表不再在每次网络变化时从 Hugging Face 重新下载 • 已更新设置中的 Pro 标签页 ■ 修复 • 已下载的 WhisperKit 模型首次加载现无需网络连接也能正常使用
■ 新增 • 转写编辑器:可在“将所选内容分配给”菜单中直接创建并指定新说话人 • ElevenLabs:企业账号可选择美国、欧盟、印度或新加坡的数据驻留端点 ■ 改进 • 助手转写:支持更多语言 • URL 转写:更可靠的 YouTube 与直链媒体下载,优化流选择,并提供更清晰的错误提示 • 搜索:现在可搜索 AI 生成的标题与简短摘要 • 转写编辑器:小型转写加载更快,切换转写时减少后台工作 • 历史记录:滚动更顺畅,按天分组更快 • 模型加载:提升本地模型稳定性 • 授权:输入免费版许可证时提供更清晰的指引 ■ 修复 • 已修复:即使找到了匹配项,首页搜索仍可能显示“无结果” • 已修复:历史界面偶尔会渲染空列表 • 已修复:切换转写可能会把内容、搜索或播放更新发送到错误的编辑器 • 已修复:“无可用文本”在历史行中的对齐不正确
■ 新功能 • 新增 OpenAI gpt-transcribe 云端转录选项,支持实时流式输出与区域中文 • 重新设计模型选择器:显示您最近使用的 3 个模型 • 新增设置侧边栏图标,并调整设置分类结构 • 支持自定义 Obsidian 属性 • 支持 Claude Opus 5,用于 AI 功能 ■ 改进 • 打开转录内容速度更快 • 补全缺失的德语与荷兰语翻译 • 现在将说话人分离模型归入模型选择器中的“说话人识别”部分 ■ 修复 • 修复 Apple Speech 模型重新启动后会消失的问题 • 翻译长转录内容时,更好地支持 DeepL 的限流策略 • 修复免费用户在特定情况下无法正常导出的 bug • 修复在 macOS 26.0 上开始转录时可能发生的崩溃问题
■ 改进 • 修复部分专业用户无法使用摘要功能的问题 • 导出转录内容时,现在可选择导出为 Markdown • 优化设置中“信息”页面设计,并新增自动更新开关 • 模型无法下载时,错误提示更清晰
■ 改进 • 实时转写现在按顺序流式输出,并在你说话时自动分组为可读段落 • 转写检查器现已默认打开,并会记住你是否将其保持打开 • 在完成说话人识别之前,说话人和时间戳栏始终保持隐藏,避免转写内容跳动 • 适用时 macOS 现在可原生转换 Ogg 文件;对于超长文件,将返回错误而不是崩溃 • 已更新用于 AI 功能的可用 Anthropic 模型 ■ 修复 • 修复使用不同语言或模型重新转写录音时看似无反应的问题——新的转写内容、语言与模型现在会立刻显示 • 修复主屏幕有时会在录音刚转写完成后仍显示“暂无可用转写” • 修复录音显示已删除转写的内容——现将正确标记为未转写,且搜索不再匹配已删除的转写 • 修复历史中的相对日期标题(如“今天”)在午夜后显示错误 • 修复 macOS 14 无法导入 Ogg 文件 • 修复文本导出时在每一行重复显示说话人姓名 • 修复“转换/解码”进度图标被裁剪的问题 • 修复在 AZERTY 及其他非 QWERTY 键盘布局下,“全选”(Cmd+A)无法正常工作
■ 新增 • 在菜单栏添加麦克风选择器,可轻松快速切换首选麦克风或打开麦克风设置 ■ 改进 • 通过在准备音频时先加载模型,转录现在启动更快 • 音频准备过程中取消转录的响应更灵敏 • 同一说话人较长内容会自动分成更易阅读的段落 • 复制包含多位说话人的内容时会一并包含他们的姓名 • 改进“设置”打开性能与搜索高亮效果 • 导出的诊断日志现在包含 macOS 崩溃报告,帮助我们调查问题 • 改进转录加载状态与进度标签 • 说明“语音活动检测”设置仅适用于 WhisperKit 模型 • 改善转录历史中删除按钮的位置 ■ 修复 • 修复将已复制的转录内容粘贴到 Microsoft Word 时可能缺少空格的问题 • 修复导入的 .whisper 文件在原始媒体扩展名缺失时可能出现无法播放音频的问题 • 修复媒体导出有时使用了错误的文件扩展名 • 修复在应用或系统其他位置更改麦克风设置后,设置未能及时更新的问题
■ 新功能 • 新的编辑器视图!你现在可以(终于可以)直接在主编辑器视图中编辑转录内容。性能大幅提升,更轻松地添加新段落,快速重新指定说话人,收藏你想要的转录任意片段……还有更多!当前用于翻译的旧转录视图暂时仍保留。欢迎告诉我们你的想法,以及可改进之处:请发送邮件至 support@macwhisper.com! • 新增 Gladia 作为云端转录提供商。你可以使用自己的 API 密钥。 ■ 改进 • 重新设计设置中的 AI 服务页面,使其更清晰、观感更佳 • 更新多数热门 AI 提供商的最新 AI 模型 • 本地化改进 • 在全屏翻译模式下显示“复制”按钮 • 为 Deepgram 新增“过滤填充词”开关 • 新增选择 Deepgram 区域的选项。可在 US 和 EU 之间切换(感谢 Daniel) • 扩展 Nova 3 支持的 Deepgram 语言 • 当同时打开多个转录时,播放效果得到优化 • 使用云端转录提供商时,将文件发送至服务后,不再将其加载到内存中 ■ 修复 • 首次启动时阻止出现“文档”权限提示 • 菜单栏图标在你更改位置后将记住其位置(感谢 Raphael) • 新增对应用在空闲时可能占用大量 CPU 的问题的潜在修复。如仍遇到该情况,请告诉我们 • 优化音频与视频拖动条之间的同步 • 修复一种边缘情况下,尝试录制会议时 macOS 可能返回“正在进行 FaceTime 通话”错误的问题(感谢 Andree) 此版本为最后一个支持 macOS 14 的版本。后续更新将需要 macOS 15 或更高版本。你仍可无限期继续使用此版本。如需帮助,也可以联系 support@macwhisper.com。
■ 改进 • 现在可更轻松地从转录界面右上角启用新的编辑器显示模式。欢迎试用,并告诉我们你认为还可以改进的地方:support@macwhisper.com • 已在深色模式下优化编辑器显示模式的配色 • 已在编辑器模式中增加内边距
■ 新功能 • 编辑器显示模式(测试版)-一种全新的转录显示模式,支持像文本文档一样自由编辑你的转录内容。该功能仍处于测试阶段,欢迎你的反馈!现在你可以在“高级设置”中开启来体验。 • 系统级快捷键:开始新的语音录制 ■ 改进 • 重新设计语音备忘录录制界面 • 新增返回按钮:从打开的转录返回“主页” • 播客可选择之前使用过的说话人,便于快速重新指定你以前用过的主持人 • 可直接在侧栏中编辑转录标题 • 为 ElevenLabs 转录新增“去逐字(no verbatim)”选项:会清理转录中的口头填充词 • 现在支持仅音频的 MP4 文件 • 当 YouTube 下载失败时,错误提示更清晰 • 所有进行中的翻译现在会显示在侧栏中 • 当模型缓存损坏时,MacWhisper 将建议切换模型或关闭“快速加载” • 设置开始时间偏移后,导出中将保留逐词时间戳 ■ 修复 • 修复录音计时器显示可能会暂停的问题 • 修复说话人姓名颜色未在 HTML 和 PDF 导出中显示的问题 • 从 Parakeet 支持语言中移除日语(实际上并不支持) • 修复语音备忘录转录后返回逻辑错误,导致未按预期返回录制界面的问题 • 修复切换侧栏时的界面错位问题
■ 改进 • 播放音频时滚动“转录”页面,性能大幅提升 • 当笔记本合上盖子(翻盖模式)且麦克风不可用时,警告更清晰 • 其他性能改进 ■ 修复 • 修复使用交错音频的麦克风录音时发生崩溃(例如 Blue Yeti) • 修复合上笔记本盖子后录音卡住且无法停止的问题。使用默认 ScreenCaptureKit 后端时,合上盖子后录音将干净结束,并可继续转录。使用 CoreAudio 后端时,重新打开笔记本后将恢复录音(合上盖子时无法录制音频) • 正确处理“停止录制”按钮的多次点击 • 恢复主屏幕快捷方式中的“实时字幕”按钮 • 修复批量导出中出现重复格式的问题
■ 已修复 • 修复在语音备忘录录制后,快速关闭丢弃对话框时可能导致的崩溃 • 优化:若说话人识别出现卡顿,将允许转写继续完成,而非无限等待 • 修复自定义导出格式设置中“添加格式”按钮异常 • 修复转写的上次打开日期在打开后未必会正确更新的问题
■ 改进 • 历史记录界面右键导出现在将使用您最近一次使用的导出选项,而非默认格式。 ■ 修复 • 修复 macOS 14(Sonoma)上扬声器识别可能卡住的问题。 • 修复 AI 提示回复与摘要预览中 Markdown 并不总是正确渲染的问题。
■ 新增 • 从转录侧边栏发送到集成 - 集成按钮现在也会出现在转录侧边栏中 • 自定义导出全面升级 - 自动导出现已支持自定义导出格式;PDF 支持作为自定义导出格式使用;导出设置拆分为“导出格式”和“批量导出”两个部分;将文件拖到“主页”即可开始新的批量导出 ■ 改进 • 视频播放器中的字幕字体大小设置 • Pro 用户自动清理 - 需要时转录清理将自动运行 • Obsidian 集成页脚说明 - 现明确需要 Obsidian 插件 • 自定义 Webhook 标头 - 为自定义 Webhook 集成指定自定义 HTTP 标头(包含安全值) ■ 修复 • 修复了一个罕见问题:从旧版本升级后,应用可能无法启动 • 现在双击单词将从该单词开始播放;此前会回退到该片段的开头 • 跳转到片段后,播放速度快捷键可正常使用 • 打开 .whisper 文件时不再触发自动导出;仅在新完成的转录后触发 • AI 服务中的 Apple Foundation Model 现不可删除 • 首次启动时不再在 macOS Tahoe 显示“文稿”文件夹权限提示 • 现在 HTML 和 PDF 导出能正确处理转录中的特殊字符 • CSV 导出不再在带引号的单元格内插入原始换行 - Excel 与分割解析器不再卡住 • 分组按人员时,TXT 和 Markdown 渲染说话人及时间戳保持一致 • “仅收藏片段”筛选现已适用于所有导出格式 • 当没有收藏片段时,“导出”界面不再卡在转圈等待状态
■ 改进 • 优化队列视图工具栏设计 • 改善设置 AI 服务时的错误处理 • 现在可通过右键点击侧边栏来重命名正在进行的会议和录音 • 英特尔 Mac 用户不再看到仅适用于 M 系列的模型类别
■ 新增 • 支持在使用 LM Studio AI 服务时通过 API 密钥进行连接 ■ 改进 • 性能与稳定性优化 • 优化系统音频录制权限流程 • 调整新用户的默认模型加载与卸载行为:默认情况下首次启动不会自动加载模型,仅在开始转写时才会加载。闲置 20 分钟后将自动卸载模型,以减少未使用时的内存占用。你可以在「设置 > 高级」中调整这些选项。 ■ 修复 • 修复当权限未正确授予或被撤销时,会议无法录制的问题
■ 改进 • 会议转录队列中现已使用正确的会议名称显示 • 优化应用内文本视图的字号与排版间距 • 改进了从主界面快捷方式进入“开始会议”的流程 ■ 修复 • 不再显示与屏幕录制权限相关的错误横幅 • 使用空格键切换播放时,即使同时按住 Command 也不会误触发
■ 改进 • 使用 Apple 的 Foundation Model AI 服务时,提示错误更友好 • 同时选择多个片段时,新增“删除”按钮 • 改进 AI 聊天输出的渲染效果 • 如果队列中只有失败或已取消的转录内容,关闭应用时将不再弹出提醒 • 在主屏幕选择项目时新增视觉选中状态 ■ 修复 • 修复设置中返回按钮可能消失的问题 • 修复有时摘要会生成为非预期语言的问题 • 修复调整“要检测的说话人数量”时可能产生重复说话人的问题 • 修复可用云服务提供商无法在设置中显示的问题 • 修复本地化问题:当 Mac 设置为法语时,部分用户可能会看到应用显示为德语。若要调整应用显示语言,请在 Mac 系统设置中进入“通用”,然后在底部更改“语言” • 修复在部分界面中点击背景无法取消选择项目的问题 • 修复某些情况下临时文件未能正确清理的问题
■ 改进 • 改进回声消除,可在设置 > 高级中启用 • 现场字幕现在可添加为主屏快捷方式 • 改进会议和应用音频录制的权限流程 • 支持最新的OpenAI模型 • 选择多个历史记录时,可像导出单个文件一样导出 • 改进多选历史记录项的设计和用户体验 • 小幅调整阴影设计 ■ 修复 • 修复在某些Chrome实例中录音时无音频的问题 • 修复删除最后一个自定义导出格式时的崩溃 • Obsidian集成文件夹名称现在可以包含空格 • 切换页面时搜索状态正确重置 • 转录会议和应用音频录制时,自动导出不再导出单个转录,而是等待最终转录完成 • 监视文件夹功能正确观察多个层级的文件
开发者“Good Snooze”已表明该 App 的隐私规范可能包括下述数据处理方式。此信息未经 Apple 验证。更多相关信息,请参阅 开发者隐私政策 。
为帮助你进一步理解开发者的回应,请参阅 隐私定义和示例 。
隐私规范可能因你使用的功能或你的年龄等因素而异。 进一步了解
开发者可能会收集以下不会与你的身份关联的数据,并用于以下目的:
开发者“Good Snooze”已表明该 App 的隐私规范可能包括下述数据处理方式。更多相关信息,请参阅 开发者隐私政策 。
开发者可能会收集以下数据,但数据不会关联你的身份:
开发者“Good Snooze”表明此 App 支持以下辅助功能,以协助更快、更轻松地完成 App 中的常见任务。 进一步了解
开发者表明此 App 支持以下辅助功能。 进一步了解
“家人共享”启用后,部分 App 内购买项目和订阅可与家人共享群组共享。 进一步了解
挑选出色工具,高效管理项目、财务等各项事务。
精选佳作,为你开启崭新一年。
Straight Back, Neck & Shoulder
工具
软件开发工具
真人级别准确度,专业录音转换文字助手,音频视频文件转文字
实时语音转写
录音转文字,自动生成AI笔记
AI会议纪要、视频字幕、离线实时转录
录音转换文字, 音频转文字, 会议记录语音转文字
录音。 转写。 同步。
隐私和离线优先的语音转文字工具。
快速安全的计算机访问