Umi-OCR:免费开源的离线文字识别工具

Umi-OCR:免费开源的离线文字识别工具

前往下载

Umi-OCR:免费开源的离线文字识别工具信息

  • 系统要求:多平台(详见内容页)发布时间:2026-09-18 22:21:53

Umi-OCR:免费开源的离线文字识别工具使用指南

微信扫描体验

Umi-OCR:免费开源的离线文字识别工具简介

Umi-OCR 是一款免费开源的离线文字识别(OCR)工具,解压即用、全程不联网,图片不会上传到任何服务器。它自带高效率的离线 OCR 引擎并内置多种语言识别库,支持截图识别、批量图片识别、PDF 识别、二维码识别与公式识别,还可以通过命令行或 HTTP 接口被其他程序调用,适合需要批量提取图片文字的日常办公场景。

Umi-OCR 截图识别界面

适用平台

支持 Windows 7 x64 及以上与 Linux x64。本次提供 Windows 的 Paddle 引擎自解压版(7z.exe)与免安装 zip 版,以及 Linux 的 Paddle 版 tar.xz 包。

安装与使用

Windows:双击 Umi-OCR_Paddle_v2.1.5.7z.exe,选择目录解压完成后双击其中的 Umi-OCR.exe 启动;也可以直接解压 Umi-OCR-2.1.5.zip 后运行。Linux:解压 Umi-OCR_Linux_Paddle_2.1.5.tar.xz,在解压出的目录中运行 Umi-OCR 即可。

「截图 OCR」页适合临时取字:点击截图按钮或按快捷键框选屏幕区域,识别结果会显示在右侧,可以直接编辑并一键复制。需要处理大量文件时切到「批量 OCR」页,把整个文件夹的图片或 PDF 拖进任务列表,设置好输出格式(txt、jsonl、csv 等)与保存目录后点击开始,软件会依次识别并写出结果文件。「全局设置」里可以切换识别语言库、调整识别精度和界面语言;如果要把识别能力接入自己的程序,可以在设置中开启 HTTP 服务,然后用接口提交图片获取文本。

Umi-OCR 批量识别

Umi-OCR 全局设置

主要功能

  • 截图 OCR:框选屏幕区域即时识别,支持复制、编辑与历史记录
  • 批量 OCR:整目录图片与 PDF 批量识别,结果可导出为 txt、jsonl、csv 等格式
  • 完全离线运行,无需联网,图片不上传,隐私安全
  • 内置多语言识别库,中英日韩等语言可自由切换
  • 支持二维码识别、公式识别与竖排文字
  • 提供命令行与 HTTP 接口,方便被其他程序调用
  • 解压即用,无需安装与配置环境

看了Umi-OCR:免费开源的离线文字识别工具的人还看了