开源原创五感与器官工具 / 插件Self-host / Cross-platform
STREAMING · DIARIZATION · SPEECH PIPELINE
FunASR
SPEECH RECOGNITION TOOLKIT · @MODELSCOPE
把实时转写、断句、说话人区分和语音服务组合成完整听觉工具箱。
FunASR 不只听写文字,也提供实时流、断句、标点和说话人管线,适合作为中文陪伴场景的完整听觉基础设施。
PROJECT INTRO
项目介绍
FunASR 提供语音识别训练与推理、流式 ASR、语音活动检测、标点恢复和说话人分离,并可封装为 OpenAI 兼容或 MCP 服务。
伴侣系统可以用它处理实时麦克风、语音消息和多人环境中的转写,再把带时间与说话人信息的文本交给对话模型。
- 适合:需要中文友好、可自托管完整语音识别管线的项目。
- 平台:Python,自托管 CPU/GPU 环境。
- 使用方式:按任务选择模型,组合 ASR、VAD、标点和说话人模块。
- 许可:工具包代码为 MIT;预训练权重许可按各模型卡分别确认。
◌
游客留言 · 审核后公开
COMMENTS & FEEDBACK
评论与反馈
用过这个项目的人,可以回来告诉后来者:在哪个平台跑通、安装有没有踩坑、实际体验如何。当前版本为游客模式,留言不需要注册账号。
提交成功
留言正在等待审核,通过后会公开显示在这里。
SOURCE & CREDIT
Atlas 负责介绍与导航,使用仍回到原作者。
我们不镜像项目文件,也不截走作者流量。安装、下载、版本更新与最新说明,以原作者提供的项目页面为准。
正在读取公开留言…