Speech recognition to text

Speech recognition to text

本地语音/视频转写/识别服务,支持 SRT/JSON/纯文本输出。

4,562GitHub
应用介绍

这是一个基于 fast-whisper 开源模型的 离线本地语音识别工具。 可从音频或视频中识别人类语音,并转换为文本。 支持输出格式: 📄 JSON 🎞️ SRT 字幕 ✏️ 纯文本 该项目已适配 懒猫网盘 🐱💾,可直接在网盘中选择文件进行语音转文字。 📁模型存放路径: 懒猫网盘/stt/model 如果模型无法自动下载,可进入项目点击右上角的 “下载模型” ⬇️,并按教程将模型放入对应文件夹。默认推荐使用 base 模型 ⭐。

应用截图
Screenshot 1
Screenshot 2
Screenshot 3
移动端截图
Mobile Screenshot 1
Mobile Screenshot 2
Mobile Screenshot 3
应用信息
版本
0.1.0
安装包大小
20.54 KB
镜像大小
2.88 GB
更新时间
2025年11月18日
源代码
jianchang512
平台支持
PC移动端