Bereiten Sie Webdaten für KI vor
Crawl4AI; ist ein Open-Source-Webcrawler und -Scraper, der für große Sprachmodelle optimiert ist. Es konvertiert Webseiten in saubere und strukturierte Formate (Markdown usw.), die Modelle der künstlichen Intelligenz problemlos verarbeiten können.
Aktualisierungen
- 31. August 2026: Sterne 75,853 → 80,563, neueste Version v0.9.3 (31. August 2026).
- 2. August 2026: Sterne 67,194 → 75,853, neueste Version v0.9.2 (15. Juli 2026).
Was es bringt
- Es konvertiert Webinhalte in ein sauberes und KI-freundliches Format.
- Speziell optimiert für LLM-Prozesse.
- Es ist schnell und Open Source.
Installation
pip install crawl4aiAusführung
crawl4ai-downloadInstallation (einzelner Befehl)
Helfen Sie mir, den Open-Source-Webcrawler Crawl4AI zu installieren; Versuchen wir es, indem wir es mit „pip install -U crawl4ai“ installieren, dann „crawl4ai-setup“ ausführen und eine Webseite mit dem Befehl „crwl https://www.nbcnews.com/business -o markdown“ in LLM-freundliches Markdown konvertieren.
Verwandte Begriffe aus dem Glossar
Links
TreScout hat dieses Werkzeug nicht entwickelt · wir haben es in den GitHub-Trends gefunden und stellen es vor. Diese Seite beschreibt das Repository so, wie es am 2026-05-29 war: Die Anzahl der Sterne und unser Text stammen von diesem Tag, das Repository kann sich seitdem geändert haben. Den aktuellen Stand finden Sie über den Link zum Repository. Diese Seite wurde maschinell übersetzt aus dem türkischen Original · maßgeblich ist die türkische Fassung.