
SenseVoice 是阿里巴巴通义语音团队发布的音频理解项目,可将语音转换为文本并识别音频中的语种、情感和声音事件。它是具体模型项目,与站内已收录的 FunASR 通用框架区别收录。
主要功能
官方开放的 SenseVoiceSmall 支持中文普通话、粤语、英语、日语和韩语识别,以及笑声、哭声、音乐、掌声等事件标签。提供 Python/FunASR 调用、WebUI 和服务部署示例;情感标签属于模型推断结果。
适用人群
需要多语言音频转写、字幕素材整理或集成语音识别的开发者与研究人员。
语言、地区与使用条件
团队所属地区:中国。项目说明提供中、英、日文;模型支持的五种语音语言与文档语言不同。需要下载模型和配置本地运行环境,可按官方说明使用 CPU 或 GPU;Docker 预构建容器当前为私有,需自行构建。长音频切分、说话人区分等应按对应部署方案配置。
费用与限制
源码可免费获取,采用 MIT 许可证;官方模型权重另适用 FunASR 模型开源协议 v1.1,不能将源码许可直接等同于权重许可。官方许可问答 #334 仍等待许可方或核心维护者最终确认,商业项目应核对模型卡与协议。自托管没有统一云端免费额度,计算硬件、托管和第三方服务费用由使用者承担。
官方来源
信息核对日期:2026 年 10 月 10 日。根据官方公开资料整理;未安装客户端、注册第三方账户或购买服务。
数据统计
数据评估
关于SenseVoice特别声明
本站AI工具导航官网-全网最全AI合集网站提供的SenseVoice都来源于网络,不保证外部链接的准确性和完整性,同时,对于该外部链接的指向,不由AI工具导航官网-全网最全AI合集网站实际控制,在2026年10月10日 上午10:14收录时,该网页上的内容,都属于合规合法,后期网页的内容如出现违规,可以直接联系网站管理员进行删除,AI工具导航官网-全网最全AI合集网站不承担任何责任。
相关导航

科大讯飞推出的智能语音转写与翻译平台

Voicemaker
在线文本转语音(Text-to-Speech, TTS)工具

MemoAI
基于 AI 技术的转录工具,专注于将音频和视频文件转换为文本

海绵音乐
海绵音乐(Haimian Music)是一款专注 AI 音乐创作与分发的智能平台

Beatoven.ai
将文本转化为根据你内容的情绪量身定制的、独特的免版税音乐

Uberduck
专注于数字音频创作领域的创新 AI 工具,其语音克隆技术尤为突出

新PaddleOCR(飞桨 OCR)
百度飞桨开源 OCR 与文档解析工具,识别图片和 PDF 中的文字、表格与版面,输出结构化数据。

Typecast
功能强大且灵活的语音合成平台












