Umi-OCR离线OCR解压即用免费图片转文字【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR截图里的文字鼠标怎么拖都选不中。Umi-OCR 是一款免费开源、解压即用的离线 OCR 工具图片转文字、扫码都发生在你自己的电脑上不联网、图片不出设备Windows 7 x64 和 Linux x64 两个平台都能跑。三分钟完成首次识别解压、启动发行包有.7z压缩包和.7z.exe自解压包两种任选其一。Windows 上解压到任意目录避开中文路径双击主程序Umi-OCR.exe即可Linux 下直接运行umi-ocr.sh。离线 OCR 引擎和多国语言识别库已内置不用装任何依赖断网也能干活。进入截图OCR页后按快捷键框选一块区域第一次识别结果就会落到剪贴板里。从解压到拿到文字通常不超过 3 分钟。先做的三件事截图取词、批量转存、缩进保留截图里的文字直接拷走在截图OCR页按快捷键框选文字就进了剪贴板随贴随用。右侧记录栏可逐条编辑也能划选多条一起复制剪贴板里如果存的是图片粘贴进来同样能识别。一个文件夹的扫描件一次转完几百张扫描图就全部导入批量OCR页bmp、png、tiff、webp、jpg 都认得数量没有上限。结果可存成 txt、md、csv(Excel)、jsonl勾上完成后自动关机挂着一夜就能跑完。代码截图识别后缩进不乱想把代码截图贴进编辑器却被普通识别打乱了缩进把排版解析方案换成单栏-保留缩进行首缩进、行内空格原样保留横排竖排都适用。遇到双栏排版导致顺序错乱则改用多栏-按自然段换行。用脚本或其他程序调用命令行与本地HTTP主程序本身就是命令行入口。想把自己识别接进自动化脚本直接传命令行参数想从别的程序里调用走 HTTP 接口即可两个进程间的通信只发生在系统本地环回不经过物理网卡。最常用的三条指令umi-ocr --path D:/images umi-ocr --screenshot --clip umi-ocr --qrcode_create 文本 D:/code.jpeg多路径识别、输出到文件、追加写入等参数见命令行手册接口细节见HTTP接口手册。出问题了按这 6 步自查屏幕闪烁、界面错位 → 到全局设置 → 界面和外观换一个渲染器或关掉硬件加速。大图、长图只识别出一部分 → 批量OCR页设置中把限制图像边长的数值调高一些。水印、页眉混进文字 → 进忽略区域编辑器按住右键画矩形完全落在框内的文本块才会被跳过框尽量画大。界面语言不对 → 到全局设置 → 语言切换显示语言简中、繁中、英文、日文都有。识别漏字 → 核对当前引擎的语言包是否覆盖目标语种或在全局设置里直接换一套 OCR 引擎。命令行没反应 → 查一下全局设置里 HTTP 服务开关是否打开默认是开的且通信只走本地环回。能力边界哪些事拿手哪些事别指望拿手图片、截图、扫描件转成可复制文字全程不联网。PDF 扫描件转双层可搜索 PDF版式还在文字可选中。条形码、二维码可扫可生成共 19 种码制支持一图多码。批量任务跑完可自动关机挂机过夜没问题。别指望没有 macOS 版只有 Windows 7 x64 和 Linux x64 两个平台。输出是纯文字不会还原 Word 排版。严重模糊、畸变的照片准确率不做保证。获取与反馈仓库git clone https://gitcode.com/GitHub_Trending/um/Umi-OCR更新日志CHANGE_LOG.mdBug 和建议在仓库提交 Issue界面翻译经 Weblate 平台协作。【免费下载链接】Umi-OCROCR software, free and offline. 开源、免费的离线OCR软件。支持截屏/批量导入图片PDF文档识别排除水印/页眉页脚扫描/生成二维码。内置多国语言库。项目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
