API Web Scraping

Web Scraping Scraper une page API

Scrapez n’importe quelle page web et récupérez son contenu principal en Markdown propre plus le titre et les métadonnées.

0,70 $US/1k req, paiement à la requête, sans abonnement.

Introducing Example 2.0 - Example Blog
example.com/blog/launch

Introducing Example 2.0

Everything new in the biggest Example release yet.

·

Today we are shipping the biggest release in our history…

Ce que l’API a renvoyé
{
"url": "https://www.example.com/blog/launch",
"title": "Introducing Example 2.0",
"description": "Everything new in the biggest Example release yet.",
"markdown": "# Introducing Example 2.0\n\nToday we are shipping the biggest release in our history…"
}
Disponibilité
97,33%
30d · 87 181 appels
Requêtes
89 627
30 j · par semaine, 12 dernières sem.
Réponse
2,8s
médiane · 30d

Tarifs et fournisseurs

Tarifs de l’API Web Scraping Scraper une page : une API, 5 fournisseurs interchangeables

Le fournisseur le moins cher répond en premier. S’il échoue, le suivant prend le relais dans le même appel.

« Bloqué » est la part des appels où le site lui-même a refusé la page. Elle n’est pas comptée dans la disponibilité. Chaque fournisseur après le premier ne voit que les pages sur lesquelles les précédents ont échoué, qui sont les sites les plus difficiles, donc ces chiffres ne sont pas une comparaison directe.

Vous payez
7,00 $US
0,70 $US/1k req, seulement pour ce que vous utilisez. Aucun forfait mensuel.
Vos 142 premières requêtes sont gratuites avec le solde de départ de 0,10 $US.

Essayer

Obtenez Web Scraping Scraper une page en une requête

formatsarray
Quelles représentations de la page renvoyer. N’importe quelle combinaison de : markdown (contenu de la page en Markdown), html (le HTML de la page exactement tel que le navigateur l’a reçu, y compris les balises head et script). Chaque format demandé est renvoyé sous le champ de sortie correspondant. Les deux par défaut. rawHtml est un alias obsolète de html, renvoyé sous un champ rawHtml pour les appelants antérieurs au renommage ; envoyez plutôt html.
Ouvrir dans
Obtenir une clé gratuite
Exemple de réponse
Les exécutions gratuites ne renvoient que les 3 premiers résultats. Alimentez une clé pour obtenir la réponse complète.
{
  "found": true,
  "data": {
    "url": "https://www.example.com/blog/launch",
    "title": "Introducing Example 2.0",
    "description": "Everything new in the biggest Example release yet.",
    "markdown": "# Introducing Example 2.0\n\nToday we are shipping the biggest release in our history…"
  }
}

Référence complète des paramètres et de la réponse : chaque champ, type et exemple de cet endpoint.

Référence

Une requête, une seule forme de réponse.

Chaque champ que vous envoyez et chaque champ que vous recevez, avec un vrai exemple.

Dernière vérification : 2026-10-07 · disponibilité et latence mesurées sur 30d

Corps de la requête

JSON, envoyé à cet endpoint.

  • urlstring

    https://www.example.com/blog/launch

    URL de la page à scraper.

  • blockAdsboolean

    Si true (valeur par défaut en amont), retire les éléments publicitaires et de consentement aux cookies avant la capture. Mettez false pour les conserver.

  • excludeTagsarray

    Sélecteurs CSS à supprimer avant la capture (par exemple ["nav", "footer", ".ads"]). Appliqués après includeTags.

  • formatsarray

    Quelles représentations de la page renvoyer. N’importe quelle combinaison de : markdown (contenu de la page en Markdown), html (le HTML de la page exactement tel que le navigateur l’a reçu, y compris les balises head et script). Chaque format demandé est renvoyé sous le champ de sortie correspondant. Les deux par défaut. rawHtml est un alias obsolète de html, renvoyé sous un champ rawHtml pour les appelants antérieurs au renommage ; envoyez plutôt html.

  • includeTagsarray

    Sélecteurs CSS à conserver. Si défini, seul le contenu correspondant à ces sélecteurs est capturé (par exemple ["article", "main"] ou ["#content"]).

  • mobileboolean

    Si true, rend la page avec une fenêtre et un user agent mobiles au lieu du bureau. Certains sites servent un contenu sensiblement différent au mobile.

  • onlyMainContentboolean

    Si true, ne renvoie que le contenu principal de l’article, en retirant navigation, en-têtes, pieds de page et autre contenu répétitif. false par défaut pour capturer la page entière.

  • waitForinteger

    Millisecondes à attendre que la page finisse son rendu avant la capture. À utiliser pour les pages riches en JavaScript ou les applications monopages dont le contenu se charge après le premier affichage. Plafonné à 15000 pour rester dans le délai de la requête. Cette attente est du temps que vous nous avez demandé de passer, donc votre réponse prend d’autant plus de temps, et elle est exclue de la latence publiée pour cet endpoint.

Vous envoyez. Un petit corps JSON. Les valeurs affichées sont des exemples à remplacer par les vôtres.

Réponse

JSON, une valeur d’exemple par champ.

  • foundboolean

    true

datadata
  • urlstring

    https://www.example.com/blog/launch

  • titlestring

    Introducing Example 2.0

  • descriptionstring

    Everything new in the biggest Example release yet.

  • markdownstring

    # Introducing Example 2.0 Today we are shipping the biggest release in our history…

Vous recevez. Des champs nommés et typés, dans la même forme quelle que soit la source qui répond.

FAQ

À propos de l’API Web Scraping Scraper une page

L’API Web Scraping Scraper une page d’AnyAPI renvoie des données Web Scraping en JSON normalisé à partir d’un appel POST à /v1/run/web.scrape. Scrapez n’importe quelle page web et récupérez son contenu principal en Markdown propre plus le titre et les métadonnées. AnyAPI route chaque requête sur 5 sources et bascule automatiquement quand l’une échoue. Elle coûte à partir de 0,70 $US pour 1 000 requêtes, en dollars US, sans abonnement et sans minimum mensuel. Ces 30 derniers jours, 97,3% des appels Web Scraping Scraper une page passés par AnyAPI ont réussi, avec un temps de réponse médian de 2,8 secondes, sur 87 181 appels mesurés.

Elle coûte à partir de 0,70 $US pour 1 000 requêtes, en dollars US, sans abonnement et sans minimum mensuel. Vous alimentez un portefeuille en USD et chaque appel le débite. Certaines requêtes échouées financées par le portefeuille entraînent des frais de traitement que nous répercutons au prix coûtant, sans marge ; la réponse d’erreur indique le montant facturé.

Scrapez n’importe quelle page web et récupérez son contenu principal en Markdown propre plus le titre et les métadonnées. La réponse est du JSON normalisé avec la même enveloppe que celle de tous les endpoints AnyAPI, donc analyser un second endpoint revient à changer l’URL et rien d’autre.

Ces 30 derniers jours, 97,3% des appels Web Scraping Scraper une page passés par AnyAPI ont réussi, avec un temps de réponse médian de 2,8 secondes, sur 87 181 appels mesurés. Ce sont les propres mesures d’AnyAPI du trafic passant par la passerelle, recalculées en continu, et non un objectif de niveau de service publié.

Oui. Un nouveau compte AnyAPI démarre avec 0,10 $US de solde gratuit, sans carte, ce qui couvre 142 appels Web Scraping Scraper une page à 0,0007 $US chacun.

AnyAPI interroge la suivante de ses 5 sources dans la même requête, la moins chère d’abord, donc la panne d’une source ne fait pas échouer votre appel.

Envoyez une requête POST à https://api.getanyapi.com/v1/run/web.scrape avec votre clé AnyAPI dans un en-tête « Authorization: Bearer » et l’entrée en corps JSON. La même clé et le même portefeuille fonctionnent sur tous les endpoints AnyAPI.

Non. Vous ajoutez des dollars US à un solde AnyAPI prépayé unique et chaque requête le débite. Il n’y a ni forfait mensuel ni minimum, et le même solde paie tous les endpoints AnyAPI.

Oui. Installez @getanyapi/sdk depuis npm pour TypeScript ou getanyapi depuis pip pour Python. Les deux appellent chaque endpoint AnyAPI avec la même clé, et n’importe quel client HTTP fonctionne aussi.

Oui. Un agent peut se connecter au serveur MCP d’AnyAPI à https://api.getanyapi.com/mcp, ou créer sa propre clé d’essai gratuit avec un seul POST non authentifié vers https://api.getanyapi.com/agent/signup et appeler cet endpoint en HTTP.