Guias, estudos e casos de sucesso sobre web scraping, monitoramento de preços e entrega de dados para demandas de análise, marketing e produto.
Guia completo de web scraping em PHP: cURL, DOMDocument, Simple HTML DOM, Guzzle e a organização de uma coleta periódica na hospedagem.
Extração de texto e tabelas de arquivos PDF: camadas de texto versus digitalizações, OCR com Tesseract e exemplos de código em Python, JavaScript e Java.
Web scraping com JavaScript e Node.js: axios, cheerio, Puppeteer e Playwright, de páginas simples à dinâmica complexa.
Guia completo de web scraping em Java: Jsoup, HtmlUnit, Selenium, multithreading e arquitetura industrial de scrapers e crawlers.
Web scraping em C++: libcurl, parsers de HTML, quando o desenvolvimento em baixo nível se justifica e o que ele traz em velocidade.
Parsing de logs de servidores e aplicações: formatos dos logs de acesso e de erros, expressões regulares, ferramentas prontas e exemplos de análise.
Coleta de taxas de câmbio: APIs oficiais de bancos centrais, agregadores, scraping de sites bancários e armazenamento do histórico para análise.
De onde obter cotações da bolsa: APIs de mercado, portais financeiros, exemplos de código em cinco linguagens e armazenamento do histórico de preços.
Parsing de JSON em detalhe: estruturas aninhadas, streaming de arquivos grandes, JSONPath e os erros típicos ao trabalhar com APIs.