OpenAI 开源语音识别模型,99% 准确率支持 100+ 语言
Whisper 是 OpenAI 开源的通用语音识别模型,支持 100+ 语言,在英语准确率上接近人类水平。它有多种大小的模型(tiny 到 large),可以在本地或云端部署。跟 Google Speech-to-Text 比,Whisper 对非英语语言的支持更好;跟 Deepgram 比,Whisper 是开源免费的。是所有语音识别应用的基础模型。
访问官网→
AssemblyAI中文是AI语音识别领域的优质工具,AssemblyAI中文版。访问AssemblyAI中文官网获取详细信息。
中国AI语音识别平台,提供智能语音交互、语音合成和自然语言处理技术。
Mozilla出品AI语音识别引擎,开源离线语音转文字解决方案。
SenseVoice:AI语音识别领域...
AI 语音识别和理解 API,支持语音转文字、内容审核、说话人识别和情感分析。开发者友好,提供实时流式接口和预训练模型。
AssemblyAI语音转文字API