Web Scraping Scraper une page API
Scrapez n’importe quelle page web et récupérez son contenu principal en Markdown propre plus le titre et les métadonnées.
0,70 $US/1k req, paiement à la requête, sans abonnement.
Introducing Example 2.0
Everything new in the biggest Example release yet.
Today we are shipping the biggest release in our history…
{"url": "https://www.example.com/blog/launch","title": "Introducing Example 2.0","description": "Everything new in the biggest Example release yet.","markdown": "# Introducing Example 2.0\n\nToday we are shipping the biggest release in our history…"}
Tarifs et fournisseurs
Tarifs de l’API Web Scraping Scraper une page : une API, 5 fournisseurs interchangeables
Le fournisseur le moins cher répond en premier. S’il échoue, le suivant prend le relais dans le même appel.
« Bloqué » est la part des appels où le site lui-même a refusé la page. Elle n’est pas comptée dans la disponibilité. Chaque fournisseur après le premier ne voit que les pages sur lesquelles les précédents ont échoué, qui sont les sites les plus difficiles, donc ces chiffres ne sont pas une comparaison directe.
Essayer
Obtenez Web Scraping Scraper une page en une requête
{
"found": true,
"data": {
"url": "https://www.example.com/blog/launch",
"title": "Introducing Example 2.0",
"description": "Everything new in the biggest Example release yet.",
"markdown": "# Introducing Example 2.0\n\nToday we are shipping the biggest release in our history…"
}
}Référence complète des paramètres et de la réponse : chaque champ, type et exemple de cet endpoint.
Référence
Une requête, une seule forme de réponse.
Chaque champ que vous envoyez et chaque champ que vous recevez, avec un vrai exemple.
Dernière vérification : 2026-10-07 · disponibilité et latence mesurées sur 30d
Corps de la requête
JSON, envoyé à cet endpoint.
- urlstring
https://www.example.com/blog/launch
URL de la page à scraper.
- blockAdsboolean
Si true (valeur par défaut en amont), retire les éléments publicitaires et de consentement aux cookies avant la capture. Mettez false pour les conserver.
- excludeTagsarray
Sélecteurs CSS à supprimer avant la capture (par exemple ["nav", "footer", ".ads"]). Appliqués après includeTags.
- formatsarray
Quelles représentations de la page renvoyer. N’importe quelle combinaison de : markdown (contenu de la page en Markdown), html (le HTML de la page exactement tel que le navigateur l’a reçu, y compris les balises head et script). Chaque format demandé est renvoyé sous le champ de sortie correspondant. Les deux par défaut. rawHtml est un alias obsolète de html, renvoyé sous un champ rawHtml pour les appelants antérieurs au renommage ; envoyez plutôt html.
- includeTagsarray
Sélecteurs CSS à conserver. Si défini, seul le contenu correspondant à ces sélecteurs est capturé (par exemple ["article", "main"] ou ["#content"]).
- mobileboolean
Si true, rend la page avec une fenêtre et un user agent mobiles au lieu du bureau. Certains sites servent un contenu sensiblement différent au mobile.
- onlyMainContentboolean
Si true, ne renvoie que le contenu principal de l’article, en retirant navigation, en-têtes, pieds de page et autre contenu répétitif. false par défaut pour capturer la page entière.
- waitForinteger
Millisecondes à attendre que la page finisse son rendu avant la capture. À utiliser pour les pages riches en JavaScript ou les applications monopages dont le contenu se charge après le premier affichage. Plafonné à 15000 pour rester dans le délai de la requête. Cette attente est du temps que vous nous avez demandé de passer, donc votre réponse prend d’autant plus de temps, et elle est exclue de la latence publiée pour cet endpoint.
Réponse
JSON, une valeur d’exemple par champ.
- foundboolean
true
- urlstring
https://www.example.com/blog/launch
- titlestring
Introducing Example 2.0
- descriptionstring
Everything new in the biggest Example release yet.
- markdownstring
# Introducing Example 2.0 Today we are shipping the biggest release in our history…
FAQ
À propos de l’API Web Scraping Scraper une page
L’API Web Scraping Scraper une page d’AnyAPI renvoie des données Web Scraping en JSON normalisé à partir d’un appel POST à /v1/run/web.scrape. Scrapez n’importe quelle page web et récupérez son contenu principal en Markdown propre plus le titre et les métadonnées. AnyAPI route chaque requête sur 5 sources et bascule automatiquement quand l’une échoue. Elle coûte à partir de 0,70 $US pour 1 000 requêtes, en dollars US, sans abonnement et sans minimum mensuel. Ces 30 derniers jours, 97,3% des appels Web Scraping Scraper une page passés par AnyAPI ont réussi, avec un temps de réponse médian de 2,8 secondes, sur 87 181 appels mesurés.