noScribe

noScribe

录音AI转录工具

Loading…

应用介绍

#本地转录 #访谈转写 #说话人识别 #Whisper #faster-whisper #pyannote #质性研究

noScribe 是一款非常适合深度访谈、质性研究、口述史和会议录音场景的本地 AI 转录工具,GitHub 上大约有 2K Stars。它最大的特点不是单纯把声音转成文字,而是可以在转录的同时做说话人区分,把“谁说了哪句话”一起整理出来,对于需要分析访谈内容的人来说非常省时间。

整套流程都可以在本机完成。noScribe 把 OpenAI Whisper、faster-whisper 和 pyannote 组合到一起,音频无需上传到第三方服务器,就能完成语音识别和说话人分离。对于涉及受访者隐私、研究伦理、内部会议或敏感资料的录音,这种本地处理方式尤其重要。

软件功能


本地语音转录:录音文件直接在自己的电脑上处理,不需要把访谈内容上传到在线转录平台,敏感资料可以尽量留在本机

自动区分说话人:借助 pyannote,可以在识别语音的同时进行说话人分离,让不同受访者或采访者的内容分别标出来,省掉后期手动判断“这一句是谁说的”的麻烦。

Whisper 转录:语音识别部分结合 OpenAI Whisper 和 faster-whisper,在保持较强多语言识别能力的同时,也兼顾本地运行效率。

时间戳与停顿标记:输出结果可以带时间信息,而且连说话过程中的停顿也能进行标注。对于研究访谈中的语气、迟疑和对话节奏分析,这类细节比普通字幕转写更有价值。

多语言支持:基于 Whisper 的识别能力,可以处理多种语言录音,适合跨语言采访、国际研究以及不同语言环境下的音频资料。

批量转录:支持一次处理一批录音,不必每个文件单独操作。面对几十份甚至更多访谈材料时,能减少大量重复工作。

多种导出格式:转录完成后可以输出 HTML、VTT 和纯文本 等格式,既方便阅读和校对,也方便后续导入其他质性研究、字幕或文本分析工具。

noScribeEdit 校对编辑器:项目还配套提供独立的 noScribeEdit,可以一边听原始音频,一边修改自动转录结果,更贴近真实的访谈整理工作流。

针对研究场景设计:作者 Kai Dröge 具有社会学和计算机相关背景,因此软件不少细节都明显围绕研究人员整理、校对和分析访谈资料的实际需求展开。

支持多个桌面系统:当前 0.7 版本提供 Windows、Apple Silicon Mac 和 Linux 构建。Intel Mac 用户需要注意,其版本目前停留在 0.6。

安装包体积较大:由于需要打包本地 AI 模型,安装文件可能达到数 GB。如果准备长期使用,最好提前预留足够磁盘空间。

自动转录仍需人工校对:项目本身也明确提醒,AI 转录并不是百分之百准确,可能出现文字识别错误、说话人分错、文本重复以及模型幻觉等情况。正式研究材料、论文引用或者需要公开发布的访谈稿,仍然应该人工听录音校对后再使用。

应用截图

相关推荐