恒美微站
首页
关于我们
建站服务
主题模板
案例展示
资讯中心
联系我们
Buzz:基于 OpenAI Whisper 的离线音频转录完整指南,免费本地语音转文字
首页
资讯中心
/
Buzz:基于 OpenAI Whisper 的离线音频转录完整指南,免费本地语音转文字
Buzz:基于 OpenAI Whisper 的离线音频转录完整指南,免费本地语音转文字
发布时间:2026/9/6 15:47:55
Buzz基于 OpenAI Whisper 的离线音频转录完整指南免费本地语音转文字【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款基于 OpenAI Whisper 的免费开源桌面工具在本地完成离线音频转录与多语言翻译无需上传任何音频、不依赖云端服务。适合做会议记录、视频字幕和敏感内容整理的用户。 项目速览项目说明定位本地离线音频转录与翻译的桌面工具技术底座Python 3.12 PyQt6Whisper / Whisper.cpp / Faster Whisper / Hugging Face 多后端许可证MIT适用人群会议记录者、字幕创作者、语言学习者、需要自动化脚本的开发者⚙️ 核心能力拆解基础层从文件到文字文件转录导入音频或视频文件自动抽取音轨并转写手头有录音、视频素材的用户多语言识别支持近百种语言转写也可自动检测语言语言不确定或混杂的内容格式导出结果可导出为 TXT、SRT、VTT直接进剪辑软件视频字幕制作场景进阶层实时处理与翻译实时录音从麦克风边录边转可弹出演示窗口方便活动现场查看会议、讲座、访谈现场语音翻译将转写结果译成目标语言也兼容 OpenAI API 类服务做增强翻译跨语言内容整理语音分离对嘈杂录音先做说话人分离再转写提升准确率多人对话、环境噪音大的素材特色层后期加工与自动化说话人识别区分同一录音中的不同发言人采访与多人会议纪要段落调整微调每个片段的起止时间戳让文字与音频对齐字幕校对环节监视文件夹目录里新增文件自动建任务并转录批量流水线处理命令行接口buzz add一条命令指定模型、语言和输出格式可写进脚本自动化与 CI 场景 上手路径普通用户图形界面Windows / macOS 用户下载对应安装包Windows 包未签名安装时出现安全警告选更多信息→仍要运行即可Linux 用户直接flatpak install flathub io.github.chidiwilliams.Buzz首次使用三步走导入媒体文件Ctrl/CmdO→ 选择任务、语言和模型 → 点击运行开发者PyPI 安装前提是已装好 ffmpeg 且使用 Python 3.12pip install buzz-captions python -m buzz进阶用户CLI 脚本化命令行可直接指定后端、模型与输出格式一条命令完成转写buzz add -m whispercpp -s medium -l zh --srt meeting.mp3 典型工作流场景一给视频生成字幕第一步导入视频文件Buzz 自动抽取音轨无需手动转换格式第二步任务选转写语言指定为中文模型按机器性能选 small 或 medium点击运行第三步打开转录查看器核对时间戳直接导出 SRT 或 VTT产出物一个可直接导入剪辑软件的字幕文件安静环境下准确率足够省去大部分人工校对。场景二会议实时记录第一步主界面切换到实时录音模式选好麦克风第二步开始录音底部面板实时出字默认 20 秒延迟保证文字与语音同步第三步结束后保存必要时做说话人识别把发言人标注清楚产出物带时间戳的会议文字记录可再翻译成其他语言归档。 调优与避坑现象离线转录速度慢→ 原因模型对当前机器过大或后端没吃到 GPU → 解法换 tiny/base 小模型或改用 Whisper.cpp 后端并启用 GPU 加速Nvidia 走 CUDA通用显卡走 Vulkan现象专有名词、术语识别错→ 原因模型缺少领域上下文 → 解法高级设置里填初始提示initial prompt已知音频语言时手动指定而不是自动检测现象Windows 安装报安全警告→ 原因安装包未做代码签名 → 解法选更多信息→仍要运行属正常现象不必担心现象PyPI 版本 GPU 不生效→ 原因默认装的是 CPU 版 torch → 解法Windows 上按 README 说明改装 CUDA 版 torch 及对应 cu12 运行库技术底座与扩展点整体是 Python 3.12 PyQt6 的桌面应用转录历史与设置存于本地 SQLite 数据库。多后端抽象在 buzz/transcriber/ 目录下每个后端Whisper、Whisper.cpp、Faster Whisper、Hugging Face各占一个文件想接新后端从这里入手最清晰。插件机制位于 buzz/plugins/已内置 AI 摘要、DOCX 导出、自动调整字幕时长等插件命令行参数全貌可查 docs/docs/cli.md。结语想跑批量任务或深入后端先看 docs/docs/ 里的使用文档和 CLI 说明遇到问题或有改进想法直接去项目 Issues 提交维护者更新频率很高。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考