網路資源
OLMOCR:把 PDF 轉成 AI 最愛的 Markdown,打造更高品質的文件知識庫
OLMOCR 是開源 AI OCR 工具,可將 PDF、學術論文與技術文件轉換為結構化 Markdown,支援表格、公式與多欄版面解析,適合 RAG、知識庫建置、AI 文件搜尋與大型語言模型應用。
網路資源
OLMOCR 是開源 AI OCR 工具,可將 PDF、學術論文與技術文件轉換為結構化 Markdown,支援表格、公式與多欄版面解析,適合 RAG、知識庫建置、AI 文件搜尋與大型語言模型應用。
網路資源
Stirling PDF 是功能完整的開源 PDF 工具,提供超過 100 項 PDF 處理功能,包括合併、分割、OCR、格式轉換、電子簽名與自架部署,適合重視隱私的個人、企業與團隊使用。
網路資源
DeepSeek-OCR 是 DeepSeek AI 推出的視覺語言整合型開源 OCR 工具,支援影像中文字辨識與上下文理解,適合文件處理、法務掃描與多模態應用。
網路資源
PaddleOCR 多語言開源 OCR 工具,支援文字檢測、識別與版面分析,適用票據處理、文件數位化與 AI 自動化。
網路資源
PDF24 提供超過 30 種免費 PDF 處理功能,包括合併、分割、壓縮、格式轉換、OCR 文字辨識與數位簽名,線上與離線皆可使用,滿足多元 PDF 編輯需求。
網路資源
Docling 是一款開源文件解析和轉換工具,支持 PDF、DOCX、PPTX、HTML、Markdown 等多種格式,能將文件轉換為 Markdown 或 JSON,適合文檔管理和自動數據提取。其特點包括進階 PDF 解析、統一 DoclingDocument 格式、元數據提取、OCR 支援,以及與 LlamaIndex 和 LangChain 整合,支持文件檢索與問答應用。Docling 配備 CLI 界面,便於批量處理,是數據科學家、文檔撰寫者和知識管理專家的理想工具。
網路資源
在漫畫和圖片充斥的互聯網世界,語言差異經常成為閱讀和理解的障礙。但現在,有了GitHub上的Image/Manga Translator,這個問題可以迎刃而解。這個項目利用先進的OCR(光學字符識別)和機器翻譯技術,可以一鍵翻譯漫畫和圖片中的文字,讓非原語言讀者也能享受豐富的內容。
網路資源
ScanTextAI 是一個功能強大的線上服務,利用先進的光學字符識別(OCR)技術和人工智慧,輕鬆從圖像中提取和識別文字。不論是從紙質文件、照片或掃描件中,ScanTextAI 都能輕鬆地提取出文字,並將其轉換為可編輯和可搜尋的格式。