源码公开原创五感与器官工具 / 插件Self-host / Edge
SPEECH · EMOTION · AUDIO EVENTS
SenseVoice
SPEECH UNDERSTANDING MODEL · @QWENAUDIO
让伴侣听见文字之外的语言、情绪和环境声音。
SenseVoice 把转写、语言、情绪与音频事件放进同一个听觉模型,让伴侣获得比纯文字更丰富的声音上下文。
PROJECT INTRO
项目介绍
SenseVoiceSmall 面向中文、粤语、英语、日语和韩语,联合提供语音识别、语种识别、情绪识别和音频事件检测。
它适合把通话或语音消息转成同时含文字、情绪和环境标签的上下文,再交给伴侣判断回应方式。
- 适合:希望让 AI 同时理解语音内容、情绪和声音事件的人。
- 平台:Python 自托管,可接入 FunASR 等推理环境。
- 使用方式:下载模型权重,按 README 运行推理或接入现有语音服务。
- 许可:源码与模型按仓库 LICENSE 和模型条款使用。
◌
游客留言 · 审核后公开
COMMENTS & FEEDBACK
评论与反馈
用过这个项目的人,可以回来告诉后来者:在哪个平台跑通、安装有没有踩坑、实际体验如何。当前版本为游客模式,留言不需要注册账号。
提交成功
留言正在等待审核,通过后会公开显示在这里。
SOURCE & CREDIT
Atlas 负责介绍与导航,使用仍回到原作者。
我们不镜像项目文件,也不截走作者流量。安装、下载、版本更新与最新说明,以原作者提供的项目页面为准。
正在读取公开留言…