Recursos · Blog

Tecnologias e proteções

Tecnologias e proteções: sites dinâmicos, sistemas anti-bots, proxies e como contornar bloqueios.

Tecnologias e proteções
Proteção anti-scraping: como funcionam os sistemas anti-bot modernos

Como funcionam os sistemas anti-bot modernos: fingerprinting, análise de comportamento, captchas e o que tudo isso implica para os donos de sites.

7 maio · 14 min
Tecnologias e proteções
Expressões regulares para o parsing: sintaxe, padrões e limites

Expressões regulares no parsing de dados: sintaxe básica, padrões úteis, limites de aplicação e por que o HTML exige um parser de verdade, e não regex.

27 abril · 8 min
Tecnologias e proteções
Proxies para web scraping: guia completo de tipos, privacidade e detecção

Guia de proxies para web scraping: datacenter, residenciais e móveis, rotação, verificação de privacidade e proteção contra a detecção.

25 abril · 14 min
Tecnologias e proteções
Scraping de sites com autenticação: guia completo com exemplos de código

Scraping de sites com autenticação: cookies e sessões, tokens, CSRF e exemplos de como fazer login a partir do código em Python, Node.js, PHP e Go.

19 abril · 10 min
Tecnologias e proteções
Scraping de sites com Selenium: guia detalhado

Selenium para o scraping de sites dinâmicos: configuração de drivers, esperas, como evitar a detecção de automação e quando optar por uma API.

7 abril · 10 min
Tecnologias e proteções
Scraping de sites dinâmicos: duas abordagens

Duas formas de fazer scraping de sites dinâmicos: engenharia reversa das requisições XHR à API e navegadores headless — vantagens, desvantagens e critérios de escolha.

2 março · 16 min
Tecnologias e proteções
Enriquecimento de dados: o que é, quais atributos são adicionados e de quais fontes vêm

O que é enriquecimento de dados: quais atributos são adicionados a empresas, produtos e contatos, de onde eles vêm e como funciona no nível técnico.

10 fevereiro · 9 min
Tecnologias e proteções
Normalização de dados: três sentidos distintos de um mesmo termo

O termo «normalização de dados» tem três sentidos: bancos de dados relacionais, machine learning e limpeza de dados extraídos por scraping. Analisamos cada um.

8 fevereiro · 8 min
Tecnologias e proteções
Parser do DOM: análise detalhada

O que é um parser do DOM e como funciona por dentro: construção da árvore do documento, navegação pelos nós e diferenças em relação às abordagens em fluxo e com regex.

4 fevereiro · 6 min