Zum Hauptinhalt springen
Piloterr
Zurück zur Bibliothek

API Website Crawler

Fetch public pages with fast HTTP crawling (no JavaScript). Best first choice for static or server-rendered HTML; use Rendering or WebUnlocker when JS or anti-bot blocks you.

Aktiv1 Credit = 1 AnfrageGET/v2/website/crawler

Endpunkt-Übersicht

Detaillierte Dokumentation, Preise und Anwendungsbeispiele.

Choosing the right endpointLink to Choosing the right endpoint

Piloterr exposes three complementary ways to fetch a public web page. Pick the lightest engine that works for your target site.

Endpoint Engine Credits Use when
Website Crawler HTTP request (no JavaScript) 1 The HTML you need is already in the first response: blogs, docs, server-rendered catalog pages, sitemaps.
Website Rendering Headless browser (JavaScript executed) 2 Content appears only after JS runs: React/Vue/Angular SPAs, lazy-loaded listings, pages that need wait_for or POST browser_instructions.
Website WebUnlocker Browser + unlock stack 3 Website Rendering or Website Crawler hit bot walls (Cloudflare, DataDome, Akamai, PerimeterX) and the domain is on Piloterr's approved whitelist.

Decision flow

  1. Try Crawler first if you do not need client-side rendering. It is the fastest and cheapest option.
  2. Switch to Rendering when the DOM is empty, prices load asynchronously, or you must wait for a selector / run browser steps.
  3. Escalate to WebUnlocker only for hardened retail or marketplace domains that block normal browser traffic. Whitelist approval is required before production use.

See also: Website Scraping guide.

OverviewLink to Overview

Website Crawler sends a direct HTTP GET to a public URL and returns the page HTML. No headless browser runs: there is no JavaScript execution, no DOM rendering, and no anti-bot unlock layer.

That makes Crawler ideal for volume and speed on sites that already ship meaningful HTML in the first response. When the page is a SPA, loads data after scroll, or sits behind advanced bot detection, move up to Website Rendering or Website WebUnlocker (see table above).

Costs 1 credit per successful call.

QuickstartLink to Quickstart

GET https://api.piloterr.com/v2/website/crawler?query=https://example.com

ParametersLink to Parameters

Parameter Type Required Description
query string yes Public URL with http:// or https://
allow_redirects boolean no Follow redirects when true (default). Set false to inspect redirect chains
return_page_source boolean no Return raw HTML source when true. Default false

ResponseLink to Response

Field Description
Response body HTML string of the fetched page
Need Endpoint
JavaScript-rendered content Website Rendering
Hard anti-bot on a whitelisted domain Website WebUnlocker
Detect protection before scraping Website Antibot

NotesLink to Notes

  • Only successful HTTP responses are billed.
  • Authenticated or paywalled pages are out of scope.
  • If you get empty or skeleton HTML, the site likely needs Website Rendering instead.

Main use casesLink to Main use cases

  • Bulk-fetch product or listing pages that render on the server
  • Monitor static competitor pages for content changes
  • Harvest blog posts, directories, and documentation at low latency
  • Capture redirect chains with allow_redirects=false

Verwandte APIs

Erweitern Sie Ihre Datenmöglichkeiten mit diesen ergänzenden Tools.

Website Antibot/v2/website/antibot

Erkennen Sie den Anti-Bot-Schutz einer Website vor dem Scraping. Vendor, Konfidenz und Hinweise in einem Aufruf.

GET1 Credit = 1 AnfrageAktiv
Website Crawler (POST)/v2/website/crawler

Webseiten und API-Endpunkte per URL crawlen und strukturierte JSON-Antworten per POST abrufen.

POST1 Credit = 1 AnfrageAktiv
Website Email Phone Extractor/v2/website/email_phone_extractor

Extrahieren Sie E-Mails und Telefonnummern von Websites für umfassende Kontaktdaten, einschließlich Social-Media-Profile auf über 12 Plattformen.

GET1 Credit = 1 AnfrageAktiv
Website Rendering/v2/website/rendering

Render JavaScript-heavy pages in a headless browser and return post-render HTML. Use when Crawler returns empty DOM; escalate to WebUnlocker if bot protection blocks the session.

GET2 Credits = 1 AnfrageAktiv
Website Rendering Instructions (POST)/v2/website/rendering

Führen Sie Browser-Automatisierungsanweisungen (scroll, scroll_to_bottom) während des Headless-Renderings aus, um Lazy-Loading-Inhalte auszulösen, Bot-Erkennung zu umgehen und dynamisch geladene Seiten zu scrapen.

POST2 Credits = 1 AnfrageAktiv
Website Screenshot/v2/website/screenshot

Screenshot API mit Browser-Rendering: erfasst Webseiten als PNG/JPEG/WebP oder PDF für Previews, QA, Reporting, Monitoring und Archivierung ohne Headless-Infrastruktur.

GET2 Credits = 1 AnfrageAktiv
Website Technology/v2/website/technology

Identifizieren Sie die Technologien hinter jeder Website CMS, Frameworks, Analytics, CDN, Hosting: für Wettbewerbsanalyse und technologische Einblicke.

GET1 Credit = 1 AnfrageAktiv
Website WebUnlocker/v2/website/webunlocker

Bypass advanced anti-bot systems (Cloudflare, DataDome, Akamai, PerimeterX) on whitelisted domains. Combines browser rendering and unlock tooling; use after Crawler and Rendering fail.

GET3 Credits = 1 AnfrageAktiv
Website WebUnlocker (POST)/v2/website/webunlocker

Senden Sie POST-Anfragen an freigeschaltete Websites oder APIs über WebUnlocker, um fortschrittlichen Anti-Bot-Schutz zu umgehen und die Upstream-Antwort abzurufen.

POST3 Credits = 1 AnfrageAktiv

Bereit loszulegen?

Ihre Web-Scraping-API ist nur einen Klick entfernt. Starten Sie mit +500 Credits, ohne Infrastruktur einrichten zu müssen, ohne Proxys zu verwalten und ohne Kreditkarte.

  • +500 Credits
  • Keine Kreditkarte erforderlich
  • Alle Endpunkte enthalten