Přejít k navigační liště

Zdroják » Zprávičky » Cloudflare spustil nový /crawl endpoint pro automatické procházení webů

Cloudflare spustil nový /crawl endpoint pro automatické procházení webů

Zprávičky Různé

Cloudflare oznámil, že služba Browser Rendering nyní obsahuje nový endpoint /crawl, který umožňuje procházet (crawlovat) celý web jediným API voláním. Tento nástroj je nyní dostupný v otevřené beta verzi pro uživatele s bezplatnými i placenými plány.

Co umí /crawl:
• Stačí poslat URL startovní stránky a Cloudflare automaticky objeví a zpracuje všechny stránky webu, včetně renderování JavaScriptu.
• Výsledky lze získat ve formátech HTML, Markdown nebo strukturovaném JSON.
• Automatické objevování stránek funguje přes sitemapu i odkazy na stránkách.
• Podporuje Incremental crawling – zpracuje jen nově změněné stránky, což šetří čas a prostředky.
• Je možné nastavit hloubku procházení, limity stránek nebo zahrnutí/vyloučení určitých cest.
/crawl respektuje pravidla robots.txt, včetně crawl-delay, takže neprochází stránky, které to výslovně zakazují.

Jak to funguje:

  1. Pošlete POST žádost s URL – API vrátí job ID.
  2. Pomocí GET pak můžete získat stav nebo výsledky zpracování.

Příklad:

# Initiate a crawl
curl -X POST 'https://api.cloudflare.com/client/v4/accounts/{account_id}/browser-rendering/crawl' \
  -H 'Authorization: Bearer <apiToken>' \
  -H 'Content-Type: application/json' \
  -d '{
    "url": "https://blog.cloudflare.com/"
  }'

# Check results
curl -X GET 'https://api.cloudflare.com/client/v4/accounts/{account_id}/browser-rendering/crawl/{job_id}' \
  -H 'Authorization: Bearer <apiToken>'Code language: PHP (php)

Původní zpráva: https://developers.cloudflare.com/changelog/post/2026-03-10-br-crawl-endpoint/

Komentáře

Odebírat
Upozornit na
guest
0 Komentářů
Nejstarší
Nejnovější Nejvíce hlasů

Pamatujete na počítadlo návštěv? Malá archeologie čísla, které web ukazoval sám o sobě

Tento web navštívilo 1 247 lidí.“ Blikající číslice ve stylu tachometru, logo TOPlistu pod patičkou, návštěvní kniha o dvě řádky níž. Devadesátá léta a začátek nultých nechávaly návštěvnost viset přímo na stránce – veřejně, pro každého. Dnes je stejné číslo schované v administraci, pod přihlášením a za souhlasem s cookies. Co se vlastně stalo mezi tím?

Když web tvořilo jen HTML: návrat na začátek internetu

Přesně před pětatřiceti lety, 6. srpna 1991, oznámil Tim Berners-Lee v diskusní skupině alt.hypertext, že existuje něco jako World Wide Web. Tehdejší web neměl obrázky, styly ani skripty. Měl necelé dvě desítky značek a jediný úkol: propojit dokumenty. Co všechno jsme od té doby přidali, co se nám po cestě ztratilo a proč se dnes čím dál větší část oboru vrací k tomu, že samotné HTML umí překvapivě mnoho?