TAGGED CONTENT

標籤:Python

所有標示為「Python」的文章與網路資源。

← 回到所有文章

標籤篩選結果

105 篇
網路資源
收藏文章

Crawlee-Python:高效的網頁爬取和瀏覽器自動化工具

Crawlee-Python 是一款功能強大的網頁爬取和瀏覽器自動化工具庫,旨在幫助開發者建立可靠的爬蟲。此工具支援從網站中提取數據,用於 AI、大型語言模型、檢索增強生成(RAG)或 GPT 的應用,並能下載 HTML、PDF、JPG、PNG 等各種文件。Crawlee 可以與 BeautifulSoup、Playwright 和原生 HTTP 協作,支援有頭和無頭模式,以及代理輪換。

網路資源
收藏文章

Comic Translate:AI 漫畫自動翻譯工具

Comic Translate 是一款桌面應用程式,專門用於自動翻譯漫畫,包括漫畫、BD、Manhwa、Fumetti 等多種類型。此工具支援多種格式如圖片、PDF、EPUB、CBR、CBZ 等,並能翻譯多種語言。它運用了 GPT-4 的強大功能,提供高品質的翻譯服務,特別適用於翻譯距離較遠的語言對(如韓文和英文、日文和英文等)。

網路資源
收藏文章

ScrapeGraph.ai:智慧型網路爬蟲與資料抓取的開源工具

ScrapeGraph.ai 是一款開源的 Python 智慧型網路爬蟲庫,利用大型語言模型和直接圖形邏輯來創建網站、文件和XML文件的資料抓取管道。使用者只需以簡單的命令指示所需提取的訊息,此庫將自動完成資料抓取任務。支援Docker運行和多種大型語言模型,如OpenAI的GPT-3.5-turbo和Google的Gemini-pro。

網路資源
收藏文章

Awesome Python Applications:彙整在 GitHub 上各種強大的 Python 專案

Awesome Python Applications 彙整了一個龐大的開源Python應用程式清單,這些應用涵蓋了從網頁工具到音訊、影片處理,甚至包括AI/ML、圖形處理、遊戲開發等多個領域。該專案的目的在於展示Python不僅僅是一個強大的程式語言,而且也能被用於開發功能豐富、高效的應用程式。每個專案都附有對應的GitHub repository、官方網站和文件(如果有的話),為開發者提供了一個寶貴的資源庫,幫助他們學習、借鑒或參與到這些專案中。

網路資源
收藏文章

Apify:專為開發者設計的網頁數據爬蟲與自動化利器

Apify是一個full-stack的網路爬蟲資料抓前平台,為開發者提供了一個建立、部署和發布網頁抓取、數據提取和網頁自動化工具的場所。它支援Python和JavaScript語言,並與Playwright、Puppeteer、Selenium、Scrapy等流行函式庫相容。使用者可以將其程式碼轉換成Apify Actor,這是一種易於開發、執行、共享和整合的無伺服器微應用。此外,Apify提供雲端部署、大型資料中心以及智慧IP位置轉換,以避免被封鎖。使用者還可以儲存和分享爬蟲結果,並將其Actor整合到任何工作流程中。