← Descobrir
Descobrir · GitHub · Crawl4AI↑ +154 hoje

Prepare dados da Web para IA

Crawl4AI; é um rastreador e raspador da web de código aberto otimizado para modelos de linguagem grandes. Ele converte páginas da web em formatos limpos e estruturados (Markdown, etc.) que os modelos de inteligência artificial podem processar facilmente.

Atualizações

  • 31 de agosto de 2026: Estrelas 75,853 → 80,563, versão mais recente v0.9.3 (31 de agosto de 2026).
  • 2 de agosto de 2026: Estrelas 67,194 → 75,853, versão mais recente v0.9.2 (15 de julho de 2026).

O que você ganha

  • Ele converte o conteúdo da web em um formato limpo e compatível com IA.
  • Especialmente otimizado para processos LLM.
  • É rápido e de código aberto.

Instalação

com pip (PyPI)
pip install crawl4ai

Execução

Rastrear página web e preparar para IA
crawl4ai-download

Instalação (comando único)

🤖 Cole isto no seu agente (Claude Code · Codex · Antigravity)

Ajude-me a instalar o rastreador da web de código aberto chamado Crawl4AI; Vamos tentar instalá-lo com 'pip install -U crawl4ai', executando 'crawl4ai-setup' e convertendo uma página da web em Markdown compatível com LLM com o comando 'crwl https://www.nbcnews.com/business -o markdown'.

Termos relacionados do glossário

Para quem éColetores de dados da Web para IA/dados
DificuldadeMédio · Python
O que ofereceRastreamento e raspagem da web compatíveis com LLM
Condição préviaPitão
TaxaGratuito · código aberto (Apache-2.0)
Licença: Apache-2.0 · você pode usá-lo livremente, modificá-lo, fazer uso comercial (também inclui proteção de patente).

Links

A TreScout não desenvolveu esta ferramenta · nós a encontramos nas tendências do GitHub e a apresentamos. Esta página descreve o repositório em 2026-05-29: A contagem de estrelas e o nosso texto são daquele dia, o repositório pode ter mudado desde então. Consulte o link do repositório para ver o estado atual. Esta página foi traduzida automaticamente do original em turco · a versão turca é a que vale.