Buzz 离线转录:3 步完成语音转文字,文件不出本地

Buzz 离线转录:3 步完成语音转文字,文件不出本地 Buzz 离线转录3 步完成语音转文字文件不出本地【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz会议录音结束不必把音频上传云端排队处理打开 Buzz导入那个 MP3几分钟后带时间戳的转录稿和译文就出现在屏幕上全程没有离开这台电脑。Buzz 是一款基于 OpenAI Whisper开源语音识别模型的离线转录与翻译工具在你自己的电脑上完成语音转文字和翻译。项目速览定位桌面端离线音频转录、翻译与字幕导出工具平台Windows、macOSIntel 与 Apple Silicon、LinuxFlatpak / Snap技术栈Python 3.12 PyQt6跨平台图形界面框架多种 Whisper 后端支持语言约 99 种导出格式TXT、SRT、VTT许可证MIT可自由使用与修改核心体验 导入文件任务即建把 MP3、MP4 拖进主界面或点“导入媒体文件”Buzz 会自动提取音频轨道并生成一条独立任务。在任务行里选定任务类型、语言和模型大小点“运行”开始处理多文件可一次添加、排队执行。 按时间戳打开查看器逐段校对任务完成后双击任务行进入转录查看器。点任一片段音频从该时刻播放拖动片段边界让文字与语音重新对齐搜索框输入关键词可直接跳转片段还能拆分、合并或删除。️ 边说边转的实时录音切到“实时录音”选好麦克风和语言按录音键即可。文字随着讲话流式出现延迟默认 20 秒可调避免同步错位。做演示或讲座时还能打开单独的展示窗口把字幕投到第二块屏幕上。能力拆解按硬件挑后端Buzz 内置多种 Whisper 实现在“偏好设置”里切换差异主要在速度、精度和资源占用后端适用场景whisperPyTorch 原版最稳定Nvidia GPU 有 CUDA 加速whisper.cpp轻量Vulkan通用显卡的 GPU 加速可跑集成显卡faster-whisper偏重转录速度Hugging Face 模型按模型 ID 使用社区发布的各类模型每个后端内还能从 tiny 到 large 选模型尺寸越小跑得越快越大越准代价是内存占用更高。字幕级的后处理转录完才是开始。Buzz 把结果当字幕轨来管按字符数、时间间隔拆分或按标点智能分段每段的起止时间可手动微调让节奏与语音贴合。最终导出 SRT、VTT 可直接进剪辑软件。长音频可先做语音分离把人声从背景噪音中抽离再转录还能用说话人识别给片段标记不同的讲话者。批量与自动化“监听文件夹”指定一个目录后新放进来的音频自动排队转录。命令行接口用文本指令运行程序的方式同样可用一条buzz add可以传多个文件、指定后端、语言和导出格式--hide-gui隐藏窗口便于塞进脚本完整参数见 cli.md。动手指南3 步装好macOS 下载 .dmg 安装Windows 下载安装包出现安全提示选“更多信息”再“仍要运行”Linux 用 Flatpakflatpak install flathub io.github.chidiwilliams.Buzz开发者通道需 ffmpeg 与 Python 3.12pip install buzz-captions python -m buzz4 步跑通第一次转录导入媒体文件Ctrl/CmdO。在任务行选择任务transcribe 转录 / translate 翻译、语言和模型大小。点“运行”等进度条走完。双击任务行查看结果按需导出 SRT 或 TXT。适用人群与边界谁适合学生课堂录音、外语播客转成可检索的文字还能把原文直接译成能读懂的目标语言辅助学习。内容创作者给视频批量出 SRT 字幕或用监听文件夹把一整批播客音频排队处理。小团队处理不便上传外部服务的内部会议录音本地运行意味着数据不出内网。不适用的场景Buzz 的精度上限就是 Whisper 本身环境嘈杂、多人抢话、口音较重时准确率都会下降只能换更大的模型多等一会儿。几小时的长音频对内存和磁盘要求不低首次下载模型文件也占空间。没有 Web 版结果只能在处理机器上查看Windows 安装包未签名首次安装会弹警告属正常现象。进阶与生态插件机制按目录组织一个包含plugin.py的目录声明元数据与生命周期钩子即可接入转录前后处理官方已带 AI 摘要、自动字幕调整等插件示例都在 plugins/。转录核心逻辑在 buzz/transcriber/想改代码可直接克隆仓库git clone https://gitcode.com/GitHub_Trending/buz/buzzBuzz 能覆盖本机“音频变文字”的大部分场景。手上有待转录的文件时装好用它跑一遍最小的文件试试即可源码按上面的命令克隆下来就能读。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考