# O que é Web Scraping?

Processo de software que coleta e registra dados de sites usando métodos automáticos.

## Definição
Web scraping é o processo de capturar dados de sites por meio de software automático e salvá-los em um formato estruturado. É usado para coletar dados grandes que são impossíveis de copiar e colar manualmente.

## Como funciona
Um software se conecta ao site de destino como um navegador, lê os códigos da página, extrai os dados desejados (preços, títulos, etc.) e os transfere para um arquivo.

## Onde é usado
Sites de comparação de preços são usados ​​para coletar conjuntos de dados necessários para pesquisas de mercado e treinamento de modelos de inteligência artificial.

## Costuma ser confundido com
É confundido com rastreamento da web, mas enquanto o rastreamento é usado para indexar sites, a raspagem é feita para extrair dados específicos e entendê-los.

## Perguntas frequentes
**Todo site pode ser copiado?**
Tecnicamente sim, mas é ética e legalmente importante prestar atenção aos termos de uso dos sites e aos arquivos de bloqueio de robôs (robots.txt).

**A raspagem da web é difícil?**
É bastante fácil para sites simples, mas requer conhecimento técnico avançado para sites modernos e seguros.


## Termos relacionados
- [Data Pipeline](/pt/dictionary/data-pipeline/)
- [Document Parsing](/pt/dictionary/document-parsing/)
- [NLP](/pt/dictionary/nlp/)

## Ferramentas relacionadas
- [Puppeteer](/pt/discover/puppeteer/)
- [Scrapling](/pt/discover/scrapling/)
- [MediaCrawler](/pt/discover/mediacrawler/)
- [Browser](/pt/discover/browser/)
- [Camofox Browser](/pt/discover/camofox-browser/)

---
Fonte: TreScout Glossário · https://trescout.com/pt/dictionary/web-scraping/
