Whisper Transcription for Mac 是一款可以将音频文件快速转录为文字的工具,无论您是录制会议、讲座或其他重要音频,都能快速准确地将音频文件转录为文字。Whisper Transcription 专业版使用Tiny、Medium和Large模型,以实现行业领先的转录质量,还可以批量转录多个文件、录制系统音频、转录播客等。有需要的朋友可以下载体验一下哦。

软件特征
– 轻松录制和转录音频文件
– 只需拖放音频文件即可获得转录
– 所有转录均在设备上完成,数据不会离开您的机器
– 导出.srt和.vtt字幕
– 在几秒钟内获得准确的文字转录(约15倍实时速度)
– 支持Metal和GPU处理,实现超快性能
– 搜索整个转录并高亮显示单词
– 音频播放及与转录同步
– 支持多种语言(最快的模型仅支持英语)
– 复制整个转录或单独的段落
– 阅读模式
– 编辑和删除转录段落
– 选择转录语言(或使用自动检测)
– 支持的格式:mp3、wav、m4a、mp4、mov、ogg、opus
– 支持Tiny(仅限英语)、Small、Base、Medium、Large-V2、Large-V3模型
– 批量转录多个文件,并同时导出为多种格式(如srt,vtt等)
– 导出到Word、PDF或HTML网站
– 转录系统音频(如Zoom会议及其他音频)
– 通过添加每个演讲者的音频文件来转录播客,生成的转录将按演讲者分开。

版本14.7.1更新内容
− 新增
• 云端转录:新增 Cohere Transcribe 和 Speechmatics,支持模型、语言和地区选项。
• Deepgram 隐私设置:新增退出 Deepgram 模型改进计划的选项,该选项默认启用。
− 改进
• AI 模型:更新 Google Gemini 和 xAI Grok 模型,并自动迁移已停用的模型选择。
• 导出选项:为批量导出、监控文件夹预设、自定义预设和导出侧边栏新增说话人姓名、时间戳和毫秒显示控制。
• 云端转录:改进各服务商的稳定性、语言处理和错误提示。
• 服务商设置:为 Cohere、Speechmatics、Corti、Cartesia、Avalon 和 Volcengine 新增专属图标。
• 队列:失败项目现在会显示更清晰的错误信息,不再显示误导性的处理进度。
− 问题修复
• 已修复:YouTube 下载不再因 HTTP 403 错误失败,也不会生成空文件。
• 已修复:监控文件夹现在会忽略不支持的文件类型。
• 已修复:转录导出不再显示不支持的时间戳、不再丢失行内容,也不会在按词分组的输出中添加多余空格。
• 已修复:按词分组导出时,说话人姓名现在每个发言轮次只显示一次。
• 已修复:OpenAI、Deepgram 和 Gladia 的结果中不再出现空的转录片段。
• 已修复:ElevenLabs 现在会为他加禄语使用正确的语言代码。
• 已修复:导出的 HTML 转录现在会使用正确的文字颜色。
系统要求:macOS 15.0 或更高版本,兼容 Intel 或 Apple Silicon 处理器
软件首页:https://apps.apple.com/cn/app/whisper-transcription/id1668083311?platform=mac

评论0