Buzz 语音转文字上手指南:离线转录从安装到导出的 4 步流程
Buzz 语音转文字上手指南离线转录从安装到导出的 4 步流程【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz会议录音堆着没整理课程笔记只能手敲敏感音频又不敢上传云端Buzz 离线转录把 Whisper 装进桌面离线语音识别全程在本地完成音频不出设备也不依赖网络。Buzz 是个什么工具Buzz 是一款免费开源的语音转文字桌面工具核心引擎是 OpenAI 的 Whisper。你导入文件、选一个模型它就能把音频转成文字还能直接翻译成其他语言也支持 YouTube 链接和麦克风实时录制。支持常见音视频格式结果可导出 TXT、SRT、VTT多后端可选Whisper.cpp、Faster Whisper、Hugging Face硬件加速Nvidia 走 CUDA核显可用 VulkanMac 支持 Apple Silicon文件夹监控自动转录另提供命令行接口CLI内置插件体系AI 摘要、字幕时长调整等从零跑起来Buzz 安装步骤三个平台各一句话Windows从官方发布渠道下载安装包程序未签名弹窗时选“更多信息 → 仍要运行”macOS下载 .dmg 拖入Applications 即可Intel 与 Apple Silicon 均支持Linux用 Flatpakflatpak install flathub io.github.chidiwilliams.Buzz或 Snap 安装首次转录的最短路径共 4 步点工具栏的“”选择一个音频文件加入任务在任务行里选模型如 Whisper.cpp 的 Base和语言运行任务等状态变为 Completed双击该任务在查看器里选择格式导出Buzz 离线转录模型怎么选Whisper 的模型从 Tiny 到 Large体积越大越占内存、越花时间但准确率更高。模型体积约速度准确率适合人群Tiny75 MB最快基础快速听稿、低配设备Base142 MB快良好日常默认选择Small466 MB中等优秀对准确率有要求Medium1.5 GB较慢很好长音频、较严谨用途Large3.1 GB最慢最佳存档级、最高精度需求大多数人的默认选择Base。普通机器上速度留得住日常听写和会议记录够用机器不错、又更看重准确率直接上 Small。模型首次使用时自动下载可在设置的“Models”页统一管理。三个真实用法会议记录带时间戳的纪要模型Small语言明确指定会议所用语言不用自动检测多人发言时开启说话人识别转写结果按人分开导出SRT 或带时间戳的 TXT方便回查定位视频加字幕直接把 MP4 拖进 Buzz无需先转码模型Small字幕返工成本高宁可一次转准参数开启逐词时间戳导出 SRT 后可直接导入剪辑软件批量处理文件夹监控 CLI在偏好里启用 Folder Watch指定目录并设好默认模型新放进的音频自动转录要更彻底的自动化用 CLI 写脚本调用命令细节见 docs/docs/cli.md更快更准的调法GPUNvidia选支持 CUDA 的后端装好 CUDA 12 与最新驱动核显设备可走 Whisper.cpp 的 Vulkan 加速CPU线程数设为物理核心数左右最多约 1.5 倍大文件别同时开太多任务预处理录音有噪音时先降噪、把音量标准化再送进转录准确率通常有明显改善出错先查这里转录很慢 → 模型偏大或未启用加速 → 换小一档模型或开启 CUDA/VulkanWindows 安装被拦截 → 应用未签名 → 在安全提示里点“更多信息 → 仍要运行”识别错漏多 → 没指定语言或自动检测判错 → 手动选语言专业术语多的加初始提示视频播放异常 → 缺 ffmpegpip 安装常见→ 单独安装 ffmpeg 后重试下一步建议下载最新版本选一段会议录音走完“添加 → 运行 → 导出”一遍进阶配置与插件用法可看仓库内 docs/docs/installation.md 和 buzz/plugins/ 目录。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考