
Buzz 离线转录指南3 步跑通第一条字幕录音不出电脑【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzzBuzz 是一款本地音频转录与离线字幕生成工具。它基于 OpenAI 的 Whisper 语音识别模型全程在你自己的电脑上运行——音频不上传转录历史不存云端。文件转录、麦克风实时录音、SRT/VTT 字幕导出都能做。如果你一直在找怎么在本地把音频转成文字、再变成字幕可以从这里开始。先跑起来从安装到第一次转录约 5 分钟安装方式有三种挑一个顺手的Windows 和 macOS下载官方安装包直接装。Windows 版未签名安装时系统会弹安全警告选更多信息→仍要运行即可。LinuxFlatpak 或 Snap 一条命令搞定。开发者从 PyPI 直接装要求 Python 3.12 环境并先装好 ffmpegpip install buzz-captions python -m buzz程序起来后直接做第一次转录就 3 步导入点菜单栏 File 里的 Import Media File或者按 Cmd/CtrlO工具栏图标也一样选一个音频或视频文件——MP3、WAV、FLAC 都行视频文件会自动提取音轨。想转在线视频直接贴链接。配置列表上方的配置行设三样东西——任务Transcribe 转录 / Translate to English 翻译成英文、语言、模型。两个容易踩的坑语言知道是什么就手动选自动检测只凭开头几秒猜偶尔会猜错模型方面机器配置一般就选 tiny 或 small 保速度有富余算力再上 medium 或 large。运行点 Run等状态变成 Completed双击那一行转录编辑器就开了。✅ 模型和后端参数在 偏好设置对话框 里第一次没选对随时能改不用重装。完整走一遍流程导入 → 转录 → 编辑 → 导出导入音频和视频主界面的任务列表是操作中心。所有导入的文件都进这里每行显示状态等待中 / 转录中 / 已完成、进度和导出格式。支持一次排多个文件并行处理——把一期播客的几段音频一次性扔进去然后去干别的。适合手头攒了一批文件要批量处理的人不用守着也不用挨个重复操作。核对与编辑转录文本打开转录视图每行文字左侧都带开始、结束时间戳。内置播放器跟着播听到的内容对到对应的文字上不用从头盲听找错别处。发现错就改一句话太长拆成两段该合成一句的合并起来。每次改动都落到本地数据库说白了就是硬盘上的一个小文件断网也能翻历史任务见 buzz/db/不存在忘了点保存这种事。SRT 字幕分段怎么调Resize原始转录经常是一行太长直接当字幕没法看。点Resize按钮就是干这个的转录时勾了 Word-Level Timings 的话可以设单条字幕最大长度、按标点换段原音频还在磁盘上的话还会分析静音位置让分段更准没开词级时间的转录也能按最大长度重新合并字幕嫌一闪而过可以把每段结束时间整体延长几秒不会顶掉下一条。适合视频创作者从机器转录的草稿到能直接进剪辑软件的字幕就是这一步的距离。导出 SRT、VTT 或纯文本转录视图里选导出格式即可TXT、SRT、VTT 三选一做过翻译的话翻译文本也能单独导出。SRT 和 VTT 是剪辑软件和发布平台通用的字幕格式导出来不用二次转换。实时录音边说边出字不只能处理现成文件。选好任务、语言、模型和麦克风点 Record麦克风里的话就实时变文字。几个实用点实时转录对算力要求高转不过来就换 Whisper.cpp 后端支持 GPU 加速并用小模型延迟明显更稳有个专门的演示窗口把实时转录以大字显示出来——线下活动、演讲现场当实时字幕用实时文字要进 OBS 这类直播软件的话在偏好里打开live recording transcription export文字会边生成边写进文本文件。多人对话声音搅在一起听不清时还可以开说话人识别先把不同人的声音分离再转录转录稿里标出谁在说话。会议纪要场景下这一项很救命。谁在用它为什么值得学生和研究者卡在这三小时的讲座录音谁也没精力听第二遍。Buzz 把它变成带时间戳的文本搜个关键词就能跳回对应分钟外语课程还能直接转成母语——Whisper 自带的翻译成英文免费接上 OpenAI 兼容 API本地跑的小模型也行就能翻成其他语言覆盖近 100 种识别语言。视频和播客创作者卡在字幕制作最耗时的一步初稿。Buzz 给出带时间戳的初稿Resize 管分段SRT 管导出人只需要做逐句校对。处理敏感信息的团队卡在合规录音内容不能走第三方服务。Buzz 的回答是全程离线——录音、模型、结果都在你自己的磁盘上转录核心模块 的每一步都不碰外网。动手之前先做这一件事别急着研究全部功能。挑一段上周的会议录音或最长的一集播客丢进 Buzz语言手动选准跑完打开转录对着时间戳逐句把文字读一遍。你会直观看到它错在哪、怎么改、最后能导出多少行字幕——下次再录的时候你就知道该把模型换成哪一档了。【免费下载链接】buzzBuzz transcribes and translates audio offline on your personal computer. Powered by OpenAIs Whisper.项目地址: https://gitcode.com/GitHub_Trending/buz/buzz创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考