Recursos · Blog

Blog sobre coleta de dados

Guias, estudos e casos de sucesso sobre web scraping, monitoramento de preços e entrega de dados para demandas de análise, marketing e produto.

Guia geral de web scraping
Em que linguagem escrever um scraper? Panorama de soluções

Comparamos linguagens para escrever scrapers (Python, JavaScript, PHP, Go, Java e C#): velocidade, ecossistema, barreira de entrada e quando escolher cada uma.

6 fevereiro · 12 min
Tecnologias e proteções
Parser do DOM: análise detalhada

O que é um parser do DOM e como funciona por dentro: construção da árvore do documento, navegação pelos nós e diferenças em relação às abordagens em fluxo e com regex.

4 fevereiro · 6 min
Tecnologias e proteções
Seletores CSS para web scraping: panorama das construções

Guia rápido de seletores CSS para extrair dados: classes, atributos, pseudoclasses, combinadores e erros típicos ao selecionar elementos de uma página.

2 fevereiro · 8 min
Guia geral de web scraping
Bibliotecas para web scraping

Catálogo de bibliotecas de scraping para Python, JavaScript, PHP, Java, C# e Go: o que escolher para páginas estáticas, conteúdo dinâmico e APIs.

31 janeiro · 11 min
Scraping por linguagem
Scraping de buscas do Google: palavras-chave para mercados internacionais

Como coletar palavras-chave do Google: sugestões, Keyword Planner, concorrentes e Search Console, com ferramentas para projetos internacionais.

29 janeiro · 3 min
Scraping por linguagem
Parsing de XML em Python: ElementTree, lxml e processamento em fluxo

Trabalhar com XML em Python: ElementTree para tarefas simples, lxml para XPath e parsing em fluxo de arquivos de vários gigabytes com iterparse.

27 janeiro · 8 min
SEO e buscadores
Volumes de busca: Google Keyword Planner e alternativas

Como coletar volumes de busca com o Google Keyword Planner e o Google Trends: correspondências, palavras-chave negativas, sazonalidade e automação via API.

25 janeiro · 3 min
SEO e buscadores
Coletar e agrupar palavras-chave para SEO: da lista bruta aos clusters

Coleta e agrupamento de palavras-chave com Keyword Planner, Search Console, Ahrefs e SEMrush: fontes, limpeza, volumes e clusters pelo top do Google.

23 janeiro · 3 min
Scraping por linguagem
Web scraping em Python com lxml: velocidade e XPath

Por que lxml é um dos parsers de HTML e XML mais rápidos do Python: consultas XPath, comparação com BeautifulSoup e técnicas para documentos muito grandes.

21 janeiro · 6 min