恒美微站 Logo 恒美微站
  • 首页
  • 关于我们
  • 建站服务
  • 主题模板
  • 案例展示
  • 资讯中心
  • 联系我们

Buzz 离线语音转文字:本地免费跑通 Whisper 转录的完整指南

  • 首页
  • 资讯中心
  • /
  • Buzz 离线语音转文字:本地免费跑通 Whisper 转录的完整指南

相关资讯

Wand-Enhancer 完整指南:4 步免费解锁 WeMod Wand Pro 与手机远程面板 2026/10/11 4:42:01
Python控制Arduino与树莓派:串口、Firmata与GPIO实战指南 2026/10/11 4:42:01
shell语句企业场景 2026/10/11 4:37:01

最新资讯

Web Components核心API与跨框架实践:原生组件化全指南
Java接入大模型的正确姿势:框架停更不可怕,工程化才是关键
GPT-6模型家族选型实战:成本控制与长任务工作流管理
基于SSM+Vue的外来人员信息管理系统设计与实现
阶梯碳交易下含P2G-CCS耦合和燃气掺氢的虚拟电厂优化调度实现
在 Halcon 中,**形态学处理是 Blob 分析的“前置净化”步骤**,而 Blob 分析本身则是在净化后的区域上做“连通域分解与特征筛选”

今日推荐

Debian新手入门:从部署到日常操作的完整指南
MongoDB复制集扩缩容实战:从rs.add到选主事故复盘
条形码目标检测数据集实战:从YOLOv8训练到部署

本周热门

UE动画修改实战:从资产编辑到重定向与蒙太奇驱动
统计随机数生成器攻击下的KLJN安全密钥交换协议Matlab仿真
政务API安全治理:资产测绘、低代码编排与行标对标实践

本月精选

我发现了一个新思路:用 Remotion + Claude Code 像写代码一样自动化生成短视频
Windows下 Codex 中 Chrome 和 Computer Use 插件不可用问题排查及解决参考方式:TaoToken 统一 Key 配置与验证
2026 大模型集体涨价:用 Python 做企业 Token 成本测算与选型避坑(附配置)

Buzz 离线语音转文字:本地免费跑通 Whisper 转录的完整指南

发布时间:2026/10/12 7:00:44
Buzz 离线语音转文字:本地免费跑通 Whisper 转录的完整指南 Buzz 离线语音转文字本地免费跑通 Whisper 转录的完整指南【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz一段两小时的会议录音躺在硬盘里你需要一份能直接读的文稿。Buzz 是一个离线语音转文字工具全部在你自己电脑上运行基于 OpenAI 的 Whisper 模型音频全程不出机器也不按量收费。适合谁用Buzz 面向想把语音变成文字、又不想把文件传到云端的人。导入文件、选模型、点运行文本就在本机生成免费开源。适用的 3 类场景做字幕的播客、视频创作者需要批量产出 SRT 文件整理访谈、讲座录音的研究员需要带时间戳的文稿活动组织者需要现场把发言实时变成字幕不适合的 2 类场景要一次转几百小时音频——本地硬件扛不住请分批处理录音含几十种语言混杂的频道切换——单语言任务表现更好安装与首次运行Windows从官方发布页下载安装包双击运行。程序未签名弹窗警告时选更多信息→仍要运行。macOS下载 .dmg 拖入应用程序。注意只支持 Apple Silicon 机型Intel 机型最后可用版本是 1.4.5。Linux一条命令装 Flatpak 版本flatpak install flathub io.github.chidiwilliams.Buzz首次运行前要下载一次模型打开偏好设置Ctrl/Cmd ,→模型选好后端和尺寸后点击下载文件会自动缓存到本机之后断网也能用。跑通第一个任务最小闭环 4 步导入按 Ctrl/Cmd O或点工具栏选一个音频或视频文件。看到任务出现在列表里即成功。配置任务选 transcribe语言手动选中文别用自动检测模型选 Whisper.cpp 的 base 或 small。运行点 Run。中等配置的笔记本用 base 模型约 10–15 秒转完 1 分钟音频转 2 小时录音约 20–30 分钟。看结果状态变成 Completed 后双击该行打开转录查看器可播放音频、搜索文字、导出 TXT/SRT/VTT。 参数怎么选模型大小对比Whisper 标准模型模型大小速度精度tiny约 75 MB最快适合试跑一般base约 142 MB快可用small约 466 MB中等较好medium约 1.5 GB慢高large约 2.9 GB最慢最高取舍建议日常速记用 base 或 small重要资料再上 large。太慢时先换后端而不是换模型——Whisper.cpp 纯 CPU 和集显都能跑Faster Whisper 需要至少 6GB 显存的 Nvidia 显卡速度比原版 Whisper 快一个量级。三个关键参数语言手动指定。自动检测在口音重或嘈杂的音频上容易判错语种。初始提示在 Advanced 按钮里填入人名、术语能明显减少专有名词的误识别。词级时间戳默认关闭只有后面要精细调字幕时才打开。放进你的场景后期制作给节目做 SRT 字幕要解决什么两小时节目音频变出能直接导入剪辑软件的字幕。用到哪些功能导入 MP3 → 语言选中文、勾选词级时间戳 → 转录完成后用 Resize 按标点拆分长句、合并过短的条目 → 导出 SRT。最后得到什么时间码对齐的 SRT 文件拖进时间线即可上屏。研究整理多人访谈分说话人要解决什么两小时双人访谈变成分角色标记的文字稿。用到哪些功能转录前打开提取语音降噪在转录查看器里逐段标注说话人导出 TXT。最后得到什么带时间戳的访谈稿边听边核对随时修改。现场活动实时字幕要解决什么培训现场把发言人内容即时投到屏幕上。用到哪些功能新建录音转录任务并选好麦克风 → 打开演示窗口投屏 → 偏好里开启实时文本导出TXT 文件可接 OBS。最后得到什么一块能投大屏的字幕画面外加一份同步给 OBS 的 TXT。常见坑转录不准先查哪按顺序查语言是否手动指定自动检测会误判→ 录音是否嘈杂开语音分离→ 模型是否偏小升一级。专名错得离谱就把词写进初始提示。完全断网的机器能用吗可以。先在有网电脑上下好模型通过偏好设置 → 模型 → 显示文件位置找到模型目录Linux 为 ~/.cache/Buzz/models整个拷到离线机的相同路径。仓库里的 scripts/download-models.py 支持批量预缓存。转录太慢或电脑卡换 Whisper.cpp 后端或把模型降一档有 6GB 以上显存的 Nvidia 卡可以试 Faster Whisper。实时转录务必用小模型否则跟不上语速。录音没声音报 PaErrorCode 错误结论多半是麦克风权限问题。检查系统隐私设置是否允许 Buzz 访问麦克风杀毒软件也可能拦截。Buzz 启动就崩溃多数是模型下载不完整到偏好设置 → 模型删掉后重新下载另注意 CPU 需要支持 AVX2太老的机器跑不起来。 使用前自查模型已下载完成能通过显示文件位置打开模型文件夹语言是手动选的没有留在自动检测导出格式选对文稿用 TXT字幕用 SRT 或 VTT实时场景已确认麦克风权限正常演示窗口能打开机器较老时先确认 CPU 支持 AVX2再排查软件问题更多细节可查 官方文档 和 常见问题。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

关于恒美微站

恒美微站专注于为个体商户、工作室提供极简自助建站服务,让每个人都能轻松拥有专业网站。

快速链接

  • 关于我们
  • 建站服务
  • 主题模板
  • 案例展示
  • 资讯中心

服务项目

  • 可视化建站
  • 拖拽编辑
  • 主题定制
  • SEO 优化
  • 网站托管

联系方式

  • 📍 地址:北京市朝阳区建国路 88 号
  • 📞 电话:400-888-8888
  • ✉️ 邮箱:info@hmyw.cn
  • 🕐 时间:周一至周日 9:00-18:00

© 2024 恒美微站 hmyw.cn 版权所有 | 京 ICP 备 12345678 号