Aller au contenu principal
Piloterr
Retour à la bibliothèque

API Website Antibot

Détectez quelle protection anti-bot protège un site avant de scraper. Obtenez le vendor, le niveau de confiance et les indices détectés en une requête.

Actif1 crédit = 1 requêteGET/v2/website/antibot

Vue d'ensemble de l'endpoint

Documentation détaillée, tarifs et exemples d'utilisation.

Vue d'ensembleLink to Vue d'ensemble

Avant de scraper un site, il est utile de savoir quelle protection anti-bot vous attend. L'API Website Antibot répond à cette question : envoyez une URL et récupérez le vendor reconnu par Piloterr (Cloudflare, DataDome, Akamai, captcha, etc.).

Piloterr charge la page une fois, comme une visite navigateur classique, et observe la réponse : en-têtes HTTP, cookies et contenu. Il remonte ce qu'il reconnaît, son niveau de confiance, et les indices qui ont déclenché la détection.

C'est de la détection uniquement. Pas de contournement de captcha, pas de bypass WAF, pas de scraping de pages protégées. Servez-vous-en pour choisir la suite : Website Crawler, Rendering ou WebUnlocker.

Coût : 1 crédit par appel.

Quand l'utiliserLink to Quand l'utiliser

  • Un crawl échoue : comprendre qui bloque.
  • Pré-vol avant un pipeline de données pour choisir le bon endpoint Piloterr.
  • Veille concurrentielle ou commerciale : détecter l'ajout d'une protection bot.
  • Réponse simple à un client ou collègue : "Ce site tourne sous Cloudflare Bot Management."

Démarrage rapideLink to Démarrage rapide

GET https://api.piloterr.com/v2/website/antibot?query=https://www.example.com&timeout=15

ParamètresLink to Paramètres

Paramètre Type Requis Défaut Description
query string oui - URL complète ou nom de domaine
timeout integer non 15 Délai max d'attente de la réponse (secondes)

Exemple de réponseLink to Exemple de réponse

{
  "requested_url": "https://www.example.com",
  "final_url": "https://www.example.com/",
  "status": 200,
  "vendor": "cloudflare",
  "confidence": "high",
  "detections": [
    {
      "vendor": "cloudflare",
      "confidence": "high",
      "evidence": [
        "Header cf-ray: abc123-LHR",
        "Cookie __cf_bm present (Bot Management)"
      ]
    }
  ]
}

Quand rien n'est détecté :

{
  "requested_url": "https://example.org",
  "final_url": "https://example.org/",
  "status": 200,
  "vendor": "none",
  "confidence": null,
  "detections": []
}

Comprendre la réponseLink to Comprendre la réponse

Champ Type Signification
requested_url string URL envoyée
final_url string URL finale après redirections
status integer Code HTTP de la cible (200, 403, 503, …)
vendor string Protection principale détectée. Raccourci du meilleur match dans detections. Valeur none si aucun match.
confidence string ou null Confiance pour le vendor principal : high, medium ou low. null quand vendor vaut none.
detections array Tous les matches trouvés, du plus fiable au moins fiable. Peut contenir plusieurs vendors (ex. Cloudflare + reCAPTCHA).

Chaque élément de detections :

Champ Type Signification
vendor string Protection identifiée (cloudflare, datadome, recaptcha, …)
confidence string Confiance pour ce match précis
evidence string[] Indices lisibles : headers, cookies ou marqueurs dans la page

Comment lire la réponse : vendor + confidence à la racine pour une réponse rapide. Ouvrez detections pour le détail ou quand plusieurs protections coexistent.

Protections détectéesLink to Protections détectées

Ce que vous voyez sur le site Valeur vendor
Cloudflare (WAF, Bot Management, page "Just a moment") cloudflare
Cloudflare Turnstile cloudflare
Akamai Bot Manager akamai
DataDome datadome
PerimeterX / HUMAN perimeterx
Imperva / Incapsula imperva
Kasada kasada
AWS WAF awswaf
Google reCAPTCHA recaptcha
hCaptcha hcaptcha

Bon à savoirLink to Bon à savoir

  • Une page de challenge (403, 503, "Checking your browser") reste une analyse réussie : c'est souvent le signal recherché.
  • none ne garantit rien. Certaines protections n'apparaissent qu'après exécution JavaScript.

Et ensuite sur Piloterr ?Link to Et ensuite sur Piloterr ?

Résultat Piste typique
none ou protection légère Website Crawler
Site très JavaScript Website Rendering
Bot manager fort (Cloudflare, DataDome, Akamai, …) Domaine whitelisté, puis Website WebUnlocker

Codes d'erreurLink to Codes d'erreur

Code Cause
400 URL manquante ou invalide
500 Site injoignable (timeout, DNS, connexion)

LimitesLink to Limites

  • Analyse passive : une requête HTTP, sans exécuter le JavaScript de la page.
  • Captchas ou scripts injectés dynamiquement peuvent rester invisibles.
  • Outil de recherche et de planification, pas de contournement.

API associées

Étendez vos capacités data avec ces outils complémentaires.

Website Crawler (POST)/v2/website/crawler

Explorez sites web et endpoints API par URL et obtenez des réponses JSON structurées via POST.

POST1 crédit = 1 requêteActif
Website Crawler/v2/website/crawler

Récupérez des pages publiques en crawl HTTP rapide (sans JavaScript). Premier choix pour le HTML statique ou SSR ; passez à Rendering ou WebUnlocker si le JS ou l'anti-bot bloque.

GET1 crédit = 1 requêteActif
Website Email Phone Extractor/v2/website/email_phone_extractor

Extrayez les e-mails et numéros de téléphone de n'importe quel site web pour obtenir des informations de contact complètes, y compris les profils sur 12+ plateformes sociales.

GET1 crédit = 1 requêteActif
Website Rendering/v2/website/rendering

Rendez les pages JavaScript dans un navigateur headless et récupérez le HTML post-rendu. À utiliser quand Crawler renvoie un DOM vide ; passez à WebUnlocker si l'anti-bot bloque la session.

GET2 crédits = 1 requêteActif
Website Rendering Instructions (POST)/v2/website/rendering

Exécutez des instructions d'automatisation navigateur (scroll, scroll_to_bottom) pendant le rendu headless pour déclencher le contenu en lazy loading, contourner la détection de bots et données des pages chargées dynamiquement.

POST2 crédits = 1 requêteActif
Website Screenshot/v2/website/screenshot

Extrayez des données Website Screenshot pour intégration en temps réel, analyse de marché et automatisation.

GET2 crédits = 1 requêteActif
Website Technology/v2/website/technology

Identifiez les technologies derrière n'importe quel site web CMS, frameworks, analytics, CDN, hébergement: pour une analyse de marché concurrentielle.

GET1 crédit = 1 requêteActif
Website WebUnlocker/v2/website/webunlocker

Contournez les anti-bots avancés (Cloudflare, DataDome, Akamai, PerimeterX) sur domaines whitelistés. Combine rendu navigateur et unlock ; à utiliser après échec de Crawler et Rendering.

GET3 crédits = 1 requêteActif
Website WebUnlocker (POST)/v2/website/webunlocker

Envoyez des requêtes POST vers des sites ou APIs whitelistés via WebUnlocker pour contourner les protections anti-bot avancées et récupérer la réponse amont.

POST3 crédits = 1 requêteActif

Prêt à commencer ?

Votre API de scraping web est à un clic. Commencez avec +500 crédits, sans infrastructure à gérer, sans proxies à configurer, et sans carte bancaire.

  • +500 crédits
  • Aucune carte bancaire requise
  • Tous les endpoints inclus