Guide, ricerche e case study su web scraping, monitoraggio dei prezzi e fornitura di dati per analisi, marketing e prodotto.
Guida completa al web scraping in C#: HttpClient, HtmlAgilityPack, AngleSharp, Selenium e l’assemblaggio di uno scraper da console pronto all’uso.
Estrazione di dati via API invece che da HTML: autenticazione, limiti di richieste, paginazione e parsing delle risposte JSON, con esempi in 7 linguaggi.
Scraper per OpenCart: differenze tra le versioni, moduli pronti per popolare il catalogo e un esempio di importazione dei prodotti con conversione dei prezzi nella valuta del negozio.
Come fare scraping per i siti WordPress e riempirli con i contenuti raccolti: REST API, XML-RPC, plugin di importazione e soluzioni su misura.
Scraper per negozi PrestaShop: come è organizzata la piattaforma, i moduli di importazione del marketplace Addons e un esempio con conversione di valuta.
Panoramica delle estensioni del browser per fare web scraping senza codice: funzioni, limiti delle versioni gratuite e compiti per cui un’estensione basta davvero.
Una selezione di libri su web scraping ed estrazione di dati: dai manuali di scraping con Python alle opere su crawler, sistemi anti-bot e database.
Che cos’è l’arricchimento dei dati: quali attributi si aggiungono ad aziende, prodotti e contatti, da dove si ricavano e come funziona a livello tecnico.
Il termine «normalizzazione dei dati» ha tre significati: database relazionali, machine learning e pulizia dei dati estratti con lo scraping. Li analizziamo uno per uno.