应用介绍
Whisper 识别很准,但只能等整段音频录完再处理,开会、直播时没法边说边出字幕。Whisper-Flow 是一个框架,接收连续的音频流并即时产出增量转写结果,把 Whisper 变成实时转写工具。
它以 Python 包的形式发布,可以通过 pip 安装,集成到自己的语音应用或服务里。
流式处理:按音频块持续输入。
增量输出:边说边出文字。
Whisper 精度:沿用 OpenAI Whisper 模型。
易于集成:pip 安装的 Python 包。
它以 Python 包的形式发布,可以通过 pip 安装,集成到自己的语音应用或服务里。
软件功能
流式处理:按音频块持续输入。
增量输出:边说边出文字。
Whisper 精度:沿用 OpenAI Whisper 模型。
易于集成:pip 安装的 Python 包。
应用截图
标签:语音转写

