TAGGED CONTENT

標籤:爬蟲

所有標示為「爬蟲」的文章與網路資源。

← 回到所有文章

標籤篩選結果

31 篇
網路資源
收藏文章

Dumpling AI:AI 自動化的無代碼工具箱

Dumpling AI 提供一個強大的無代碼工具箱,讓使用者輕鬆整合 AI 自動化功能。無需編寫程式碼,使用者可以將 Dumpling AI 應用於多個平台如 Zapier 和 Make.com,實現網頁爬取、PDF 轉換、YouTube 字幕抓取等功能。這個工具還支援地圖和新聞搜尋、影片剪輯及執行 Javascript 程式碼等。

網路資源
收藏文章

Crawlee-Python:高效的網頁爬取和瀏覽器自動化工具

Crawlee-Python 是一款功能強大的網頁爬取和瀏覽器自動化工具庫,旨在幫助開發者建立可靠的爬蟲。此工具支援從網站中提取數據,用於 AI、大型語言模型、檢索增強生成(RAG)或 GPT 的應用,並能下載 HTML、PDF、JPG、PNG 等各種文件。Crawlee 可以與 BeautifulSoup、Playwright 和原生 HTTP 協作,支援有頭和無頭模式,以及代理輪換。

網路資源
收藏文章

Markdowner:快速將網站轉換成適合大型語言模型處理的 Markdown 格式工具

Markdowner 是一個開源工具,可以快速將任何網站轉換成適合大型語言模型(LLM)處理的 Markdown 格式數據。這個工具特別適合開發者和資料科學家,旨在提高 AI 應用程式的查詢效果。其功能包括自動抓取網站內容、詳細的 Markdown 模式、文字和 JSON 回應等。此外,Markdowner 也支援本地部署,使用者只需簡單的指令即可在自己的環境中運行此工具。

網路資源
收藏文章

Apify:專為開發者設計的網頁數據爬蟲與自動化利器

Apify是一個full-stack的網路爬蟲資料抓前平台,為開發者提供了一個建立、部署和發布網頁抓取、數據提取和網頁自動化工具的場所。它支援Python和JavaScript語言,並與Playwright、Puppeteer、Selenium、Scrapy等流行函式庫相容。使用者可以將其程式碼轉換成Apify Actor,這是一種易於開發、執行、共享和整合的無伺服器微應用。此外,Apify提供雲端部署、大型資料中心以及智慧IP位置轉換,以避免被封鎖。使用者還可以儲存和分享爬蟲結果,並將其Actor整合到任何工作流程中。