ToolNavs 发现实用AI工具
提交工具 登录

AI 语音识别

围绕 Qwen3-ASR、Whisper 等模型把会议、采访和视频里的说话声转成文字,解决转写、字幕与实时听写需求。

AI 语音识别(ASR)让模型直接把说话声转成文字,覆盖会议记录、采访转写、视频字幕和实时听写等场景。以 Qwen3-ASR、Fun-ASR、Whisper 为代表的方案已能在嘈杂环境、多方言和 30 多种语言下保持低错字率,但专有名词、同音词和重度口音仍要靠自定义词表与人工校对兜底。