Guias, estudos e casos de sucesso sobre web scraping, monitoramento de preços e entrega de dados para demandas de análise, marketing e produto.
Como funcionam os sistemas anti-bot modernos: fingerprinting, análise de comportamento, captchas e o que tudo isso implica para os donos de sites.
Scraping, parsing e crawling: em que esses processos se diferenciam, como se relacionam entre si e por que são confundidos com tanta frequência.
Como coletar dados de sites sem ser programador: da cópia manual e das extensões ao web scraping sob encomenda, entregue pronto para uso.
Web scraping em Ruby: Nokogiri, HTTParty, Mechanize e Watir, da análise de páginas estáticas à automação do navegador.
Parsing de feeds RSS e Atom: estrutura dos formatos, bibliotecas prontas para usar e monitoramento de notícias e blogs sem rastrear páginas.
Expressões regulares no parsing de dados: sintaxe básica, padrões úteis, limites de aplicação e por que o HTML exige um parser de verdade, e não regex.
Guia de proxies para web scraping: datacenter, residenciais e móveis, rotação, verificação de privacidade e proteção contra a detecção.
Controle de um navegador real a partir do PHP: Symfony Panther, chrome-php e Selenium para scrapear sites dinâmicos com JavaScript sem sair do stack PHP.
Como trabalhar com XML em diferentes linguagens: DOM versus SAX, XPath, namespaces e leitura em fluxo de arquivos grandes sem estourar a memória.