开源原创五感与器官工具 / 插件Cross-platform
HEARING · TRANSCRIPTION · LANGUAGE
Whisper
SPEECH RECOGNITION MODEL · @OPENAI
把人类说出的声音转成文字,让伴侣真正听见多种语言。
Whisper 用统一的多任务模型处理多语言语音识别、翻译和语言判断,是许多本地伴侣听觉系统的基础耳朵。
PROJECT INTRO
项目介绍
Whisper 是通用语音识别模型,可处理多语言转写、语音翻译、语言识别与语音活动检测。模型按 tiny、base、small、medium、large 和 turbo 等尺寸提供速度与精度选择。
项目提供命令行和 Python 调用方式,需要安装 ffmpeg。对伴侣系统而言,它通常承担把麦克风或语音消息转换成文字上下文的基础听觉层。
- 适合:需要本地或自托管语音转写、语言识别与翻译的伴侣系统。
- 平台:Python 运行环境,可使用 CPU 或 GPU。
- 使用方式:安装 openai-whisper 与 ffmpeg,选择模型后转写音频文件或接入实时管线。
- 许可:代码与模型权重均为 MIT。
◌
游客留言 · 审核后公开
COMMENTS & FEEDBACK
评论与反馈
用过这个项目的人,可以回来告诉后来者:在哪个平台跑通、安装有没有踩坑、实际体验如何。当前版本为游客模式,留言不需要注册账号。
提交成功
留言正在等待审核,通过后会公开显示在这里。
SOURCE & CREDIT
Atlas 负责介绍与导航,使用仍回到原作者。
我们不镜像项目文件,也不截走作者流量。安装、下载、版本更新与最新说明,以原作者提供的项目页面为准。
正在读取公开留言…