Guias, estudos e casos de sucesso sobre web scraping, monitoramento de preços e entrega de dados para demandas de análise, marketing e produto.
Guia completo de web scraping em C#: HttpClient, HtmlAgilityPack, AngleSharp, Selenium e a montagem de um scraper de console pronto para usar.
Extração de dados via API em vez de HTML: autenticação, limites de requisições, paginação e parsing de respostas JSON, com exemplos em 7 linguagens.
Scraper para OpenCart: diferenças entre versões, módulos prontos para popular o catálogo e um exemplo de importação de produtos com conversão de preços para a moeda da loja.
Como fazer scraping para sites WordPress e preenchê-los com o conteúdo coletado: REST API, XML-RPC, plugins de importação e soluções sob medida.
Scraper para lojas PrestaShop: como a plataforma é organizada, quais módulos de importação o marketplace Addons oferece e um exemplo com conversão de moedas.
Panorama de extensões de navegador para fazer web scraping sem código: funções, limites das versões gratuitas e tarefas em que elas realmente bastam.
Seleção de livros sobre web scraping e extração de dados: dos manuais de scraping com Python às obras sobre crawlers, sistemas anti-bots e bancos de dados.
O que é enriquecimento de dados: quais atributos são adicionados a empresas, produtos e contatos, de onde eles vêm e como funciona no nível técnico.
O termo «normalização de dados» tem três sentidos: bancos de dados relacionais, machine learning e limpeza de dados extraídos por scraping. Analisamos cada um.