应用介绍
这是一个基于 fast-whisper 开源模型的 离线本地语音识别工具。 可从音频或视频中识别人类语音,并转换为文本。 支持输出格式: 📄 JSON 🎞️ SRT 字幕 ✏️ 纯文本 该项目已适配 懒猫网盘 🐱💾,可直接在网盘中选择文件进行语音转文字。 📁模型存放路径: 懒猫网盘/stt/model 如果模型无法自动下载,可进入项目点击右上角的 “下载模型” ⬇️,并按教程将模型放入对应文件夹。默认推荐使用 base 模型 ⭐。
应用截图



移动端截图



应用信息
这是一个基于 fast-whisper 开源模型的 离线本地语音识别工具。 可从音频或视频中识别人类语音,并转换为文本。 支持输出格式: 📄 JSON 🎞️ SRT 字幕 ✏️ 纯文本 该项目已适配 懒猫网盘 🐱💾,可直接在网盘中选择文件进行语音转文字。 📁模型存放路径: 懒猫网盘/stt/model 如果模型无法自动下载,可进入项目点击右上角的 “下载模型” ⬇️,并按教程将模型放入对应文件夹。默认推荐使用 base 模型 ⭐。





