網路資源
OLMOCR:把 PDF 轉成 AI 最愛的 Markdown,打造更高品質的文件知識庫
OLMOCR 是開源 AI OCR 工具,可將 PDF、學術論文與技術文件轉換為結構化 Markdown,支援表格、公式與多欄版面解析,適合 RAG、知識庫建置、AI 文件搜尋與大型語言模型應用。
網路資源
OLMOCR 是開源 AI OCR 工具,可將 PDF、學術論文與技術文件轉換為結構化 Markdown,支援表格、公式與多欄版面解析,適合 RAG、知識庫建置、AI 文件搜尋與大型語言模型應用。
網路資源
Stirling PDF 是功能完整的開源 PDF 工具,提供超過 100 項 PDF 處理功能,包括合併、分割、OCR、格式轉換、電子簽名與自架部署,適合重視隱私的個人、企業與團隊使用。
網路資源
微軟開源神器 MarkItDown 登場!這款 Python 工具能將 PDF、Excel、PPT 等複雜文件一鍵轉換為 LLM 友善的 Markdown 格式。支援 RAG 應用開發與 AI 圖片描述,解決資料清洗與格式跑版難題,立即了解這款數據分析必備工具!
網路資源
Browserless 提供雲端無頭瀏覽器服務,支援 Puppeteer/Playwright,自動化抓取、測試與文件生成免維運,適合高需求瀏覽器操作任務。
網路資源
YouMind 是一款 AI 創作工作室級平台,整合素材蒐集、智能摘要、專案板整理與 AI 撰稿功能,支援 YouTube、Podcast、PDF 等多來源流程,並強調使用者資料不被用於模型訓練。
網路資源
NaturalReader 是由 NaturalSoft Limited 提供的高品質文字轉語音服務,支援多語言、多格式輸入(PDF/DOCX/ePub/圖片文字),並可下載音檔(MP3/WAV)或朗讀網頁,適合有聲教材、配音與無障礙閱讀需求。
網路資源
DeepSeek-OCR 是 DeepSeek AI 推出的視覺語言整合型開源 OCR 工具,支援影像中文字辨識與上下文理解,適合文件處理、法務掃描與多模態應用。
網路資源
Abogen 是開源文字轉語音工具,支援 ePub、PDF、Markdown 與純文字轉有聲書,並同步生成字幕,適合無障礙閱讀、語言學習與內容創作用途。
網路資源
OpenDataloader PDF 是一個開源工具,將 PDF 轉換為結構化資料(如 JSON、Markdown),支援段落解析、表格擷取與語意切分,特別適合用於 LLM、RAG 與 AI 知識庫建構,提升資料品質與應用效果。
網路資源
Every PDF:完全免費、開源、可離線使用的 PDF 桌面應用程式。提供 v2.0.0 PDF 編輯器、簽名、圖片與勾選框,支援合併/拆分、浮水印、頁面旋轉重排,重視隱私與效能。
網路資源
OCRFlux 是一款處理 PDF 檔案或掃描影像時而誕生的開源工具,其結合輕量化的多模態語言模型(僅 3B 參數),可有效將複雜版面的 PDF 或圖片內容轉換為乾淨、結構清晰的 Markdown 文件。
網路資源
ThetaWave AI 是一站式智能筆記平台,支援語音轉寫、影音與文件摘要、mindmap 與 flashcard 生成,助學生與職場人士高效整理學習與會議內容。
網路資源
Noiz 是集語音克隆、TTS 配音與 YouTube/PDF 智慧摘要於一身的 AI 工具,支援多語、情緒調整與影片配音,適合創作者與教育工作者提效創作與學習。
網路資源
PDF24 提供超過 30 種免費 PDF 處理功能,包括合併、分割、壓縮、格式轉換、OCR 文字辨識與數位簽名,線上與離線皆可使用,滿足多元 PDF 編輯需求。
網路資源
AnyParser 是 CambioML 推出的 AI 文件解析器,可從 PDF、Word、PPT、圖片等非結構化資料中精準提取文字、表格與圖表。透過視覺 LLM 技術,AnyParser 相較傳統 OCR 準確度提升 2 倍,並支援去識別化與多語言解析,適用於金融、法律、研究與企業文件管理。
網路資源
Cubby 是一款專為協作研究設計的工具,支援多元內容註解、音訊轉錄、AI 摘要生成與實時寫作整合,助力集中管理資料並高效協作,適合研究、學術與創作團隊使用。
網路資源
ebook2audiobook 是一款開源工具,利用先進的文字轉語音技術,將 EPUB、PDF 等格式的電子書轉換為高品質有聲書,支援語音自訂與本地處理,為讀者提供便捷的聆聽閱讀體驗。
網路資源
PlantUML 是一款開源圖表工具,透過簡單的文字語法生成時序圖、類別圖等多種專業圖表,支援多平台、多格式輸出,適合軟體設計與流程展示。