恒美微站 Logo 恒美微站
  • 首页
  • 关于我们
  • 建站服务
  • 主题模板
  • 案例展示
  • 资讯中心
  • 联系我们

Buzz 离线音频转文字,录音不上传

  • 首页
  • 资讯中心
  • /
  • Buzz 离线音频转文字,录音不上传

相关资讯

TCP/IP客户端服务端源码实战:三次握手、状态机与跨平台调试 2026/10/7 1:59:02
高刚性矿物增强改性尼龙原料,替代金属件降本方案支持来样检测 2026/10/7 1:59:02
C# WinForm用户角色权限管理系统:从数据库设计到按钮级控制 2026/10/7 1:59:02

最新资讯

让编码 Agent 自己造推理引擎:刷分陷阱与约束设计
【零基础学AI】第 3 章——大语言模型为什么能回答问题
Python if语句高级用法全解析
一篇文章,了解自定义类型:结构体
多模型编排的三层:框架、模型路由与提供商路由
本地生活平台搭建:跨业态用户标识怎么贯通

今日推荐

SSD不认盘怎么修?金士顿SV300板级排查与短接ROM进工厂模式
Unity 3D RPG开发:C#状态机与物理更新时机实战指南
AIoT开发工程师岗位全景:从嵌入式Linux到边缘计算与端侧AI部署

本周热门

MR25H40CDF + PIC18F65K40:工业记录仪高可靠存储实战
基于STM32的数控恒压恒流电源设计:从硬件到PID调参全解析
LT9211 MIPI重定时器原理与双路扇出实战指南

本月精选

我发现了一个新思路:用 Remotion + Claude Code 像写代码一样自动化生成短视频
Windows下 Codex 中 Chrome 和 Computer Use 插件不可用问题排查及解决参考方式:TaoToken 统一 Key 配置与验证
2026 大模型集体涨价:用 Python 做企业 Token 成本测算与选型避坑(附配置)

Buzz 离线音频转文字,录音不上传

发布时间:2026/10/7 1:59:02
Buzz 离线音频转文字,录音不上传 Buzz 离线音频转文字录音不上传【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款基于 OpenAI Whisper 的离线音频转录桌面应用。把 MP3、WAV、MP4 等录音或视频文件丢给它就在你自己的电脑上转成文字稿全程不经过云端服务器——录音里的原话、客户名字都留在本地。安装 Buzz三种方式任选其一先让 Buzz 跑起来三条路都能走通Windows 和 macOS从官方发布页下载安装包双击装完即用Linux一条 Flatpak 命令装完见下方代码块Python 用户备好 Python 3.12 和 ffmpeg用 pip 安装 buzz-captions再执行python -m buzz启动。flatpak install flathub io.github.chidiwilliams.Buzz启动后如果还没下载过转录模型打开偏好的 Models 页面看中哪个尺寸点 Download 即可。模型存在本地之后转写不用重复下载。一条录音出文字稿导入、排队、选模型点工具栏的 号选择本地音频文件。Buzz 也接受视频页面地址会先把音视频下载下来再转录。主界面是一张任务表文件名、所用模型、任务类型、状态各占一列。一次选几十个文件也可以Buzz 按顺序逐个处理完成后状态列变成 Completed。等结果的时候模型尺寸值得掂量一下模型尺寸特点适用内容Tiny / Base速度最快试跑、发音清晰简单的内容Small / Medium速度与准确度平衡日常会议、课程录音Large 系列准确度最高重要访谈、专业术语多的内容引擎侧内置 Whisper、Whisper.cpp、Faster Whisper 等后端Whisper.cpp 偏速度Faster Whisper 在 NVIDIA GPU 上更有优势。哪台电脑上谁更快拿同一段音频各跑一次最直观。各引擎的调用逻辑集中在 buzz/transcriber/ 目录想细看可以从这里入手。文字稿变字幕校对、翻译、导出 SRT任务完成后双击那一行打开时间轴视图每行有开始时间、结束时间和对应文字底部播放器拖到哪文字就跳到哪。在这个界面里做三件事逐行改错别字——Whisper 对人名、产品名容易写错人工过一遍最稳点顶部工具条把整份稿子翻译成另一种语言用导出菜单存成 SRT、VTT 或 TXT其中 SRT/VTT 可以直接挂到视频上。字幕太长或太碎的话点 Resize 重排。弹窗里三个参数单行最大字符数默认 42、按句末标点强制断行默认正则已覆盖中英文常见标点、两条字幕间隔不足 0.2 秒就合并成一条。调完确认时间轴立即按新规则重排。边说边出字麦克风实时转写点工具栏的麦克风按钮Buzz 开始监听麦克风边说边出字。会议记录、讲座笔记、现场采访这类正在发生的内容省掉先录完再转的等待。演讲场合还能调出演示窗口把实时字幕直接投到大屏上。批量转写命令行与监听文件夹手里有一整批文件时可以跳过界面直接跑命令行。常用选项-m选引擎、-s选模型尺寸、-l选语言、--srt/--vtt/--txt选导出格式、-d指定输出目录、--hide-gui隐藏主窗口。python -m buzz add -m whispercpp -s medium -l en --srt -d ./out ./interview.mp3不想敲命令就开启监听文件夹功能新文件一放进指定目录自动进队列转写。插件系统里还有 AI 摘要等扩展按需启用即可。建议的第一步先用 Small 模型把一个短音频从头跑到尾把导入、结果界面、导出流程走熟再换 Large 处理正式内容。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

关于恒美微站

恒美微站专注于为个体商户、工作室提供极简自助建站服务,让每个人都能轻松拥有专业网站。

快速链接

  • 关于我们
  • 建站服务
  • 主题模板
  • 案例展示
  • 资讯中心

服务项目

  • 可视化建站
  • 拖拽编辑
  • 主题定制
  • SEO 优化
  • 网站托管

联系方式

  • 📍 地址:北京市朝阳区建国路 88 号
  • 📞 电话:400-888-8888
  • ✉️ 邮箱:info@hmyw.cn
  • 🕐 时间:周一至周日 9:00-18:00

© 2024 恒美微站 hmyw.cn 版权所有 | 京 ICP 备 12345678 号