Vibe 语音转文字完整上手:从 0 到 1 装好并转完第一个文件
Vibe 语音转文字完整上手从 0 到 1 装好并转完第一个文件【免费下载链接】vibeTranscribe on your own!项目地址: https://gitcode.com/GitHub_Trending/vib/vibeVibe 是一个在你自己设备上跑语音转文字的工具把音频或视频丢进去转录由 Whisper 等本地模型完成文件和文字都不离开机器。这条路线带你从下载安装走到批量转录、字幕时间戳和服务器部署装完就能上手。确认系统版本下载对应平台的安装包 先看一眼环境底线Windows 8 及以上、macOS 13.3 及以上、Linux 建议 Ubuntu 22.04 及以上Linux 暂不支持音频文件监听。硬件没有特殊要求资源占用可以在主窗口的高级设置里自己调。打开官方发布页面按平台选文件macOS Apple silicon 选aarch64.dmgIntel 选x64.dmgWindows 选.exeLinux 选.debArch 用户可用 debtap。安装macOS 双击 dmg 把 Vibe 拖进应用程序Windows 直接跑安装向导Linux 用下面的命令装上 .deb 包。用 dpkg 安装 Linux 的 .deb 安装包sudo dpkg -i vibe_*.deb启动。macOS 首次打开会被安全机制拦截右键应用选打开放行一次即可正常进入。Linux 用户先设置渲染变量再启动否则可能黑屏在终端设置 Linux 渲染变量避免窗口空白export WEBKIT_DISABLE_COMPOSITING_MODE1从源码构建自己的版本可选想跟最新代码的话先按 构建文档 装好 pnpm、Cargo 和 chore再依次克隆仓库、准备 sidecar 并执行生产构建git clone https://gitcode.com/GitHub_Trending/vib/vibe cd vibe chore setup cd desktop pnpm install pnpm exec tauri build构建产物在desktop/src-tauri/target/release目录里直接运行即可。首次启动下完模型拖个文件拿到第一条转录 首次启动会提示下载默认语言模型让它下完——这是后面一切转录的基础。进入主界面你会看到顶部三个入口File / Record / From link、中间的大拖放区、底部的语言下拉默认 Auto Detect和 More Options。把一个 wav、mp3 或视频文件拖进中间区域文件会出现在列表里。语言保持 Auto Detect 或手动指定点 Transcribe。进度条走完你会看到逐句刷出的转录文本历史转录留在左侧 RECENTS 列表可导出为 TXT、SRT、VTT、HTML、PDF、JSON、DOCX 等格式。配置批量转录一次丢进整个文件夹用界面上的文件夹图标一次选择多个文件会直接进入批量面板。在面板顶部统一设置 Language 和 Format待处理文件列在下方。点右侧播放按钮队列逐个跑完每个文件各出一份转录结果。开启实时预览与稳定时间戳做出字幕级输出 转录进行时界面会实时滚动已识别的文本你可以边跑边核对内容不用干等最终结果。要生成字幕级的时间戳打开 More Options启用 Stable timestamps。若提示缺少 VAD 模型按提示下载默认是ggml-silero-v6.2.0.bin。跑一遍。注意这个模式质量优先速度约为普通转录的 1/4适合字幕制作和影视对齐日常转录不必常开。另外转录完成后可接 Claude API 或本地 Ollama 自动总结URL 转录、麦克风、系统音频等入口都在主界面和 More Options 里细节看 安装文档。集中排错修好 msvc140.dll、闪退和 Linux 黑屏Windows 报msvc140.dll not found安装微软 Visual C 运行库vc_redist.x64.exe装完重启应用。macOS 首次启动被系统拦截右键应用 → 打开放行一次。Linux 窗口空白确认是否已设置WEBKIT_DISABLE_COMPOSITING_MODE1。崩溃且没有报错按 调试文档 带日志从终端启动能看到具体死在哪一步。进阶三招离线装模型、macOS 提速、服务器无人值守 离线使用设置打开应用取消初始模型下载。进设置的 Customize 区域手动指定你准备好的模型文件。所有模型都支持手动安装对照 安装文档 放好即可。macOS 提速 2-3 倍到 whisper.cpp 官方模型仓库下载与你模型对应的.mlcmodelc.zip例如ggml-medium-encoder.bin配ggml-medium-encoder.mlmodelc.zip。从 Vibe 设置打开模型目录把.mlmodelc文件拖进去与.bin并排放。转录一次文件首次会花较长时间编译模型之后每次都快 2-3 倍。Linux 服务器 命令行跑批装上虚拟显示后Vibe 可以在无桌面环境里用 CLI 跑安装虚拟显示并跑一条命令行转录sudo apt-get install xvfb -y Xvfb :1 -screen 0 1024x768x24 export DISPLAY:1 vibe --model ggml-medium.bin --file single.wav到这里你手里有一套完全在本地运行的语音转文字工作流日常拖文件批量丢文件夹长内容开稳定时间戳服务器上用 CLI 排队处理。更多参数与模型说明以仓库最新文档为准。【免费下载链接】vibeTranscribe on your own!项目地址: https://gitcode.com/GitHub_Trending/vib/vibe创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考