一龍馬/AI 情報站讀懂消息背後的脈絡
星期三
搜尋

README 同時宣布雲端 API 尚在封閉測試,現階段成熟主體仍是可自行部署的開源套件

Python · ⭐ 80,813 · 🍴 8,354 · 🔥今日 +179

中文摘要

Crawl4AI 將網頁轉成適合 RAG、代理與資料管線使用的 Markdown,提供非同步瀏覽器池、快取、深度爬取、代理伺服器、Cookie、使用者腳本、CLI 與 Docker 部署,也可按問題進行 LLM 擷取。最新列出的 v0.9.3 是安全性版本,修補 PDF 處理路徑的任意檔案寫入、SSRF、阻斷服務,以及 Docker Playground 的兩項 XSS,另含 33 項錯誤修正;此前 v0.9.0 已把 Docker API 改為預設驗證並限制繫結介面。README 同時宣布雲端 API 尚在封閉測試,現階段成熟主體仍是可自行部署的開源套件。

一龍馬判讀

需要把公開網頁穩定餵給 LLM 的開發者,可獲得比自行拼裝 Playwright 與清理器更完整的控制面;但爬蟲會直接接觸不可信內容,既有部署應優先升級安全版本,並限制網路、檔案與 API 權限及遵守網站規範。

原文節錄

unclecode/crawl4ai

# 🚀🤖 Crawl4AI: Open-source LLM Friendly Web Crawler & Scraper.

取得部分原文 · 不代表內容已獨立查證

查看原文
完整收錄文字與來源

🚀🤖 Crawl4AI: Open-source LLM Friendly Web Crawler & Scraper. Don't be shy, join here: https://discord.gg/jP8KfhDhyN

收錄日期
2026-09-02
來源
github.com/trending
抓取時間
2026/09/02 05:50(台北)
來源資料
Python · ⭐ 80,813 · 🍴 8,354 · 🔥今日 +179