Guide, ricerche e case study su web scraping, monitoraggio dei prezzi e fornitura di dati per analisi, marketing e prodotto.
Guida completa al web scraping in PHP: cURL, DOMDocument, Simple HTML DOM, Guzzle e come organizzare una raccolta periodica sull’hosting.
Estrazione di testo e tabelle dai file PDF: livelli di testo contro scansioni, OCR con Tesseract ed esempi di codice in Python, JavaScript e Java.
Web scraping con JavaScript e Node.js: axios, cheerio, Puppeteer e Playwright, dalle pagine semplici ai contenuti dinamici complessi.
Guida completa al web scraping in Java: Jsoup, HtmlUnit, Selenium, multithreading e architettura industriale di scraper e crawler.
Web scraping in C++: libcurl, parser HTML, quando ha senso lo sviluppo a basso livello e che cosa offre in velocità.
Parsing di log di server e applicazioni: formati di access ed error log, espressioni regolari, strumenti pronti ed esempi di analisi.
Raccolta dei tassi di cambio: API ufficiali delle banche centrali, aggregatori, scraping dei siti bancari e archiviazione dello storico per l’analisi.
Dove trovare le quotazioni di borsa: API di mercato, portali finanziari, esempi di codice in cinque linguaggi e archiviazione dello storico.
Il parsing di JSON in ogni dettaglio: strutture annidate, streaming di file di grandi dimensioni, JSONPath ed errori tipici nel lavoro con le API.