1.3 KiB
1.3 KiB
Kühlfinder-Scraper (eigene Datenquelle)
Grundsatz: Wir übernehmen KEINE Daten von braucheklima.de. Bestand/Preis kommen direkt von den Händlern (öffentlich einsehbare Produkt-/Marktseiten bzw. deren JSON-Endpunkte).
Status
- OBI: verifiziert — Produktseite liefert serverseitig Preis + Markt-Status (web_fetch-Test 27.06.). Parser via JSON-LD + HTML-Heuristik.
- Toom/Bauhaus/Hornbach/Hagebau/Globus: Adapter nach OBI-Muster (Produktseite/Markt-Endpoint).
- MediaMarkt/Saturn/expert/Euronics: client-rendered → JSON-Availability-Endpoint (storeId-Param) oder Headless (Playwright) im Cron-Container.
- Amazon: PA-API (PartnerNet) statt Scraping — sauber + Affiliate.
Betrieb (Coolify)
- Scheduled Task:
cd scraper && node run.mjsalle 30–120 Min (in Hitzephasen enger). availability.json+history.jsonin ein persistentes Volume schreiben, das der nginx-Container unter/dataausliefert (compose mit shared volume) — so wird die Seite live, ohne Rebuild.- Rate-Limits/robots.txt respektieren, ehrlicher User-Agent, Jitter/Backoff (im Runner umgesetzt).
Recht
Öffentlich zugängliche Bestandsdaten; kein Umgehen von Schutzmaßnahmen, keine wesentlichen DB-Teile Dritter (kein braucheklima-Import). Vor Live-Verkauf juristisch absichern.