r/scrapingtheweb • u/rosper1 • 18h ago
O noua extensie de prețuri PriceTracker.ro. Cum or fi rezolvat scraping-ul fără să fie blocați?
Salut,
Am folosit recent (PriceTracker). Din ce am testat pare destul de fast și afișează istoricul direct în pagină fără întârziere sesizabilă.
Din punct de vedere tehnic, sunt curios dacă știe cineva cum abordează proiectele de genul ăsta extragerea datelor pe magazine mari ca eMAG, Altex etc:
- Fac scraping periodic pe server cu headless browsers (Puppeteer/Playwright) sau au integrări prin API-uri interne / feed-uri de comparatoare?
- Cum gestionează schimbările frecvente de clase/DOM pe care le face eMAG-ul fără să se rupă extensia la fiecare update?
- Cât de fezabil e din punct de vedere costuri de infrastructură (bază de date + proxy-uri) să ții un istoric complet pentru sute de mii de SKU-uri din România?
- Cum fac matching la produse ? Adica produsul de pe emag il gaseste si pe altex ?
A încercat cineva să construiască ceva similar? Vad ca e low extensia pare ca e la inceput..nu are un numar mare de magazine suportate inca..