应用介绍
基于 FunASR 开源工具集,支持多个语音识别模型: - sensevoice-small:(默认)速度最快的语音识别,支持多语言混合、情绪识别,准确度适中 - paraformer-large:高精度中文语音识别,内置 VAD + 标点 + 时间戳,对其他语言支持一般,速度适中 - fun-asr-nano:支持识别中文方言、唱歌等,远场高噪声识别优化,速度最慢,准确度适中,有时会有幻觉误识别 具体模型特点请参考官方说明:https://help.aliyun.com/zh/model-studio/recording-file-recognition 算力舱提供了: - 在线使用界面 - 兼容 OpenAI 的接口,可直接在各种客户端中调用语音识别服务! - 兼容阿里云语音识别 RESTful API 接口 具体使用方法查看应用首页和说明文档。 注:算力舱内置的 whisper 模型,精度和对多语言的支持要比这些模型高一些,就是速度没有前两个快。 一句话总结:识别语音,这一个 API 服务就够了,兼顾速度和准确度!
应用截图




移动端截图




应用信息