
Umi-OCR免費開源的離線OCR軟件截圖、批量圖片與PDF一鍵文字識別【免費下載鏈接】Umi-OCROCR software, free and offline. 開源、免費的離線OCR軟件。支持截屏/批量導入圖片PDF文檔識別排除水印/頁眉頁腳掃描/生成二維碼。內置多國語言庫。項目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR處理掃描件、整理截圖文字時把圖片上傳到在線識別服務總讓人不放心。Umi-OCR 是一款開源、免費的離線OCR軟件識別全部在本機完成斷網也能用圖片不用離開你的電腦。它同時覆蓋截圖識別、批量圖片轉文字、PDF文檔識別三種最常見需求解壓即用不用裝任何東西。一分鐘認識它Umi-OCR 是一款面向普通用戶的桌面OCR工具界面用標簽頁組織首次啟動會按系統語言自動切換界面。它內置 PaddleOCR 和 RapidOCR 兩種離線引擎PaddleOCR 精度更高RapidOCR 速度更快可在全局設置中隨時切換識別語言包也內置在軟件里中文、英文、日文等開箱即用。項目說明開源協議MIT支持平臺Windows 7 x64、Linux x64費用完全免費無會員、無次數限制網絡依賴無需聯網識別全程離線安裝方式無需安裝解壓后直接運行主程序輸出格式txt、jsonl、md、csvExcel 可打開一鍵截圖提取文字操作路徑打開截圖OCR標簽頁按下快捷鍵喚起截圖框選屏幕任意區域識別結果會立刻顯示在右側記錄欄可以直接劃選復制。除了快捷鍵也支持在別處復制圖片后粘貼進來識別。實際效果識別出的文本不是散亂的字塊頁面內置了文本后處理的排版解析方案可以自動按自然段換行也能適配多欄排版識別代碼截圖時選擇單欄-保留縮進方案行首縮進和空格都會保留下來。小提醒如果發現某些字沒識別出來多半是圖片被默認壓縮過——頁面設置里可以調高限制圖像邊長的數值用一點速度換精度。批量圖片識別與轉文字操作路徑在批量OCR標簽頁導入一個文件夾或幾十張圖片支持 jpg、png、bmp、tif、webp 等常見格式沒有數量上限。結果可保存為 txt、jsonl、md 或 csvcsv 用 Excel 打開即可。實際效果每張圖片的識別結果獨立保存任務完成后可以自動關機或待機適合夜間掛機跑完一批資料。頁面右欄還有忽略區域編輯器按住右鍵在圖上畫矩形框內的文字會被跳過專門對付水印、LOGO 這類干擾。小提醒忽略區域按文本塊生效——落在框內的整塊文字才被忽略單字不會被單獨摳掉所以框要畫得稍微大一些把水印可能出現的整個區域包進去。PDF掃描件識別成可編輯文檔操作路徑在文檔識別標簽頁導入文件支持 pdf、xps、epub、mobi 等格式。兩種用途各取所需要純文本就直接提取要歸檔就生成雙層可搜索PDF——原來的掃描圖像保留上面疊加一層識別出來的文字之后可以像普通 PDF 一樣全文搜索、復制。實際效果同樣支持忽略區域可以把每頁固定出現的頁眉頁腳框掉避免它們混進正文。配合完成后自動休眠一個晚上處理完幾大本掃描件不成問題。上手三步從項目倉庫下載對應平臺的發行包或直接git clone https://gitcode.com/GitHub_Trending/um/Umi-OCR后按文檔構建。把壓縮包解壓到任意目錄雙擊Umi-OCR.exeLinux 下運行umi-ocr.sh啟動無需安裝。在截圖OCR頁按快捷鍵框選一塊屏幕文字完成第一次識別。進階用法命令行與HTTP接口想把 Umi-OCR 接進自動化流程主程序本身就是一條命令行入口。比如截圖后直接把結果寫進文件umi-ocr --screenshot --output result.txt也可以傳文件夾路徑批量識別其中的全部圖片。所有指令都依賴本地 HTTP 服務默認開啟命令行輸入可用umi-ocr --help查看全部。程序集成方面Umi-OCR 默認在本地 1224 端口提供 HTTP 接口圖片OCR、PDF識別、二維碼識別/生成都有對應端點調用前可先訪問參數查詢接口拿到全部可調參數詳見 HTTP接口手冊。引擎本身走插件機制官方插件庫還提供 PaddleOCR、RapidOCR 之外的備選引擎在全局設置中即可切換不用改代碼。避坑與常見問題識別精度不如預期怎么辦默認會把長邊超過 960 像素的圖片壓縮再識別速度優先。精度不夠時到頁面設置的文字識別里調高限制圖像邊長或改用 PaddleOCR 引擎。命令行執行了沒反應命令行靠本地 HTTP 服務轉發指令先確認全局設置里 HTTP 服務已開啟默認是開的且用的不是備用啟動器。忽略區域為什么沒把水印去掉它按整塊文本生效不是逐字生效。框要完全包住水印可能出現的文字塊畫大一點比畫小安全。能同時裝兩個引擎嗎不要。兩種引擎插件會互相覆蓋快捷方式需要哪個裝哪個切換用插件導入就行。另外 HTTP 接口并發能力有限批量腳本建議串行調用。寫在最后Umi-OCR 把截圖、批量圖片、PDF 這三類最常見的文字識別需求做進了一個免安裝的免費離線軟件里個人使用或接入自動化腳本都夠用。項目倉庫https://gitcode.com/GitHub_Trending/um/Umi-OCR 遇到具體報錯時建議先看 更新日志 或直接在倉庫提 Issue。【免費下載鏈接】Umi-OCROCR software, free and offline. 開源、免費的離線OCR軟件。支持截屏/批量導入圖片PDF文檔識別排除水印/頁眉頁腳掃描/生成二維碼。內置多國語言庫。項目地址: https://gitcode.com/GitHub_Trending/um/Umi-OCR創作聲明:本文部分內容由AI輔助生成(AIGC),僅供參考