Costruirò uno scraper web personalizzato o un crawler automatizzato in python

Alcune informazioni sono state tradotte automaticamente.

Pakistan

Parlo Pashtu, Urdu, Inglese

Esperto di web scraping e automazione in Python, Selenium, Playwright, OCR

Costruisco pipeline di dati automatizzate che estraggono dati strutturati da siti web, inclusi siti protetti da login, captcha o contenuti scannerizzati/immagine, e li consegnano puliti in Excel/Sheet...
Informazioni su questo servizio

Creo scraper web personalizzati in Python e pipeline di automazione dei dati che trasformano contenuti web sparsi in dataset puliti e strutturati. Lavoro con requests + BeautifulSoup per siti standard e Playwright per siti con molto JavaScript o protetti da bot (Cloudflare, contenuti dinamici, pagine con login).

Recentemente ho completato un progetto reale di scraping di 13 glossari e siti di riferimento del settore petrolifero e del gas, gestendo HTML statico, dati embedded JSON-LD, interazioni JS-click e protezione Cloudflare, unendo tutto in un dataset CSV pulito e senza duplicati. Puoi vedere il progetto completo su GitHub.

Ecco cosa posso fare per te:

  • Scraping di elenchi di prodotti, directory, glossari, prezzi, info di contatto o qualsiasi dato strutturato del web
  • Gestione di pagine dinamiche/JS e protezioni di base contro i bot
  • Unione e deduplicazione di dati provenienti da più fonti in un unico file pulito
  • Consegna in formato CSV, Excel o JSON, a tua scelta

Inviami il(s) sito(i) di destinazione prima di ordinare così posso confermare la fattibilità (alcuni siti hanno blocchi tecnici o legali severi che segnalerò fin da subito, onestamente, piuttosto che promettere cose che non posso mantenere).

Tecnologia:

Python

•

Excel

•

selenium

•

Beautiful soup

•

Playwright

Tipo di informazioni:

Informazioni di contatto

Tecnica:

Automatizzato

Il mio portfolio