AudioNotes

AudioNotes

音视频转写 AI笔记工具

Loading…

应用介绍

#本地转写 #AI笔记 #语音识别 #音视频转文字 #Markdown笔记

AudioNotes 是一款主打本地运行、隐私优先的音视频转写与 AI 笔记工具,在 GitHub 上已经获得约 2.2K Stars。平时听两小时播客、网课,或者整理公司会议录音,不需要再一边暂停一边手动做笔记,直接把音频或视频丢进去,就能自动生成文字稿并整理成 Markdown 笔记。

它比较香的一点就是整套流程都可以跑在自己电脑上。语音识别使用 FunASR,语言模型通过 Ollama 调用,默认组合为 FunAudioLLM/Fun-ASR-Nano-2512 + qwen3.5:2b。音视频、转写文本、笔记以及对话历史默认都保存在本机,网页服务也只监听本地地址,拿来处理会议、私人录音这类敏感内容会更安心。

软件功能


音视频自动转写:上传录音、播客、课程视频等内容后,可以自动生成完整文字稿,不用反复暂停、回放和手记。

AI 自动整理笔记:转写完成后还能继续通过本地大模型提炼内容,自动整理成 Markdown 笔记,长时间的播客和课程尤其省事。

针对内容直接提问:不只是做完转写就结束,还可以围绕已经导入的内容继续和 AI 对话,需要回顾重点、寻找某段信息时更加方便,而且对话历史也会保存

浏览器直接录音:除了上传现成的音频、视频文件,也支持通过浏览器录制内容,录完即可继续进行转写和整理。

领域热词:碰到公司内部名词、行业术语、人名等内容,可以通过领域热词改善专业词汇容易识别错误的问题,对会议和专业课程比较实用。

全本地 AI:语音识别基于 FunASR,大语言模型通过 Ollama 运行,默认使用 FunAudioLLM/Fun-ASR-Nano-2512 + qwen3.5:2b,无需把自己的录音交给在线转写服务处理。

隐私数据留在本机:音视频、文字稿、Markdown 笔记以及聊天历史默认全部保存在本机,同时 Web 服务只监听本地地址。对于公司会议、工作资料和私人录音这类内容,这一点相当重要。

Docker / Python 部署:项目提供 Docker 和 Python 3.12 源码两种部署方式,默认服务端口为 15433。Docker 版本初始账号和密码均为 admin,部署完成后建议第一时间修改。

首次运行说明:虽然日常处理可以全本地完成,不过首次安装仍然需要联网下载相关镜像与模型,其中语音模型大约 2.15GB,提前留好磁盘空间会更省心。

应用截图