Scout: URGENTNI: Portal https://www.luxor.cz selhava. URL: https://

Vygenerovano: 2026-03-26 00:06 | Typ: scout | CzechAI

Model: qwen3:32b

Ukol: URGENTNI: Portal https://www.luxor.cz selhava. URL: https://www.luxor.cz Chyba: rescue_failed Posledni uspech: ? 1. Crawlni URL 2. Zmenila se struktura? 3. Anti-bot opatreni? 4. Existuje API? 5. Navrhni opravu.

Cas: 2026-03-26T00:05:59.456Z - 2026-03-26T00:06:55.536Z

PortalKat.ObtiznostRenderAnti-botDataStrategiePoznamky
Luxor knihydata_richmediumjavascriptnoneknihy, autori, ceny, dostupnostplaywrightStránka používá JavaScript pro dynamické načítání obsahu. Obsahuje cookies pro tracking a AB testování. API endpoint /api neexistuje, vrací HTML. Chyba rescue_failed pravděpodobně souvisí s novým cookie bannerem nebo změnou struktury stránky.

Shrnuti

**Shrnutí analýzy portálu Luxor knihy (https://www.luxor.cz):**

1. **Struktura a obsah:**
   - Portál se zaměřuje na prodej knih, s nabídkou přes 160 tisíc produktů.
   - Obsahuje cookies pro tracking (Spotify, Microsoft, Google) a AB testování.
   - Obsah je dynamicky načítán pomocí JavaScriptu.

2. **Anti-bot opatření:**
   - **Žádná známá anti-bot ochrana** (Cloudflare, CAPTCHA, rate-limiting).

3. **API dostupnost:**
   - **Žádné API nenalezeno** – endpoint `/api` vrací HTML místo JSON dat.

4. **Příčina chyby `rescue_failed`:**
   - Pravděpodobně souvisí s novým **cookie bannerem** nebo změnou struktury stránky (např. přechod na JavaScript-renderovaný obsah).

5. **Návrh řešení:**
   - **Nástroj:** Použijte **Playwright** pro zpracování JavaScript-renderovaného obsahu.
   - **Postup:**
     1. Přijměte cookie banner programově (např. kliknutím na „Povolit vše“).
     2. Extrahujte data po úplném vykreslení stránky.
     3. Pro analýzu dat použijte XPath nebo CSS selektory.
   - **Alternativa:** Monitorujte síťové žádosti v prohlížeči (vývojářské nástroje) pro identifikaci skrytých datových zdrojů.

6. **Doporučení:**
   - Aktualizujte stávající skripty pro práci s JavaScriptem.
   - Testujte pravidelně změny struktury portálu (např. pomocí webhooků nebo cronů).

**Závěr:** Portál je datově bohatý, ale vyžaduje zpracování dynamického obsahu. Bez API je nejefektivnější řešení založeno na renderování stránek a extrakci dat pomocí Playwright.