Ollama-OCR

Ollama-OCR

用本地视觉模型识别图片与PDF文字

AI官网

应用介绍

传统 OCR 对复杂排版、手写和表格束手无策,云端识别又要上传文件。Ollama-OCR 是一个通过 Ollama 调用视觉语言模型提取图片和 PDF 文字的 OCR 工具,全部本地运行。

它支持 LLaVA、Llama 3.2 Vision 等多种模型,可输出 Markdown、JSON 或纯文本,提供 Python 包和 Streamlit 网页应用。

软件功能



视觉模型:多种可选。

图片与 PDF:批量识别。

多种输出:Markdown、JSON。

本地运行:隐私安全。
标签:OCROllama