Web Scraping Scraping della pagina API
Fai scraping di qualsiasi pagina web e ottieni il suo contenuto principale come Markdown pulito più titolo e metadati.
0,70 USD/1k richieste, paghi a richiesta, nessun abbonamento.
Introducing Example 2.0
Everything new in the biggest Example release yet.
Today we are shipping the biggest release in our history…
{"url": "https://www.example.com/blog/launch","title": "Introducing Example 2.0","description": "Everything new in the biggest Example release yet.","markdown": "# Introducing Example 2.0\n\nToday we are shipping the biggest release in our history…"}
Prezzi e provider
Prezzi dell'API Web Scraping Scraping della pagina: una sola API, 5 provider intercambiabili
Serve per primo il provider più economico. Se fallisce, subentra il successivo nella stessa chiamata.
Bloccate è la quota di chiamate in cui il sito web stesso ha rifiutato la pagina. Non conta contro la disponibilità. Ogni provider dopo il primo vede solo le pagine su cui hanno fallito i precedenti, cioè i siti più difficili, quindi queste cifre non sono un confronto diretto.
Provalo
Ottieni Web Scraping Scraping della pagina in una sola richiesta
{
"found": true,
"data": {
"url": "https://www.example.com/blog/launch",
"title": "Introducing Example 2.0",
"description": "Everything new in the biggest Example release yet.",
"markdown": "# Introducing Example 2.0\n\nToday we are shipping the biggest release in our history…"
}
}Riferimento completo di parametri e risposta - ogni campo, tipo ed esempio per questo endpoint.
Riferimento
Una richiesta, una sola forma di risposta.
Ogni campo che invii e ogni campo che ricevi, ciascuno con un esempio reale.
Ultima verifica 2026-10-07 · disponibilità e latenza misurate su 30d
Corpo della richiesta
JSON, inviato a questo endpoint.
- urlstring
https://www.example.com/blog/launch
URL della pagina di cui fare scraping.
- blockAdsboolean
Se true (valore predefinito a monte), rimuove gli elementi pubblicitari e di consenso ai cookie prima della cattura. Imposta false per mantenerli.
- excludeTagsarray
Selettori CSS da eliminare prima della cattura (per esempio ["nav", "footer", ".ads"]). Applicati dopo includeTags.
- formatsarray
Quali rappresentazioni della pagina restituire. Qualsiasi combinazione di: markdown (contenuto della pagina come Markdown), html (l'HTML della pagina esattamente come l'ha ricevuto il browser, compresi head e tag script). Ogni formato richiesto viene restituito nel campo di output corrispondente. Il valore predefinito è entrambi. rawHtml è un alias deprecato di html, restituito nel campo rawHtml per i chiamanti precedenti al cambio di nome; invia invece html.
- includeTagsarray
Selettori CSS da mantenere. Se impostato, viene catturato solo il contenuto che corrisponde a questi selettori (per esempio ["article", "main"] o ["#content"]).
- mobileboolean
Se true, renderizza la pagina con un viewport e uno user agent mobile invece di quelli desktop. Alcuni siti servono contenuti sostanzialmente diversi ai dispositivi mobili.
- onlyMainContentboolean
Se true, restituisce solo il contenuto principale dell'articolo, eliminando navigazione, intestazioni, piè di pagina e altro materiale ripetitivo. Il valore predefinito è false per catturare la pagina intera.
- waitForinteger
Millisecondi da attendere perché la pagina finisca il rendering prima della cattura. Usalo per pagine pesanti in JavaScript o single-page app il cui contenuto si carica dopo il primo disegno. Limitato a 15000 per restare entro il timeout della richiesta. Questa attesa è tempo che ci hai chiesto di spendere, quindi la tua risposta impiega altrettanto di più, ed è esclusa dalla latenza pubblicata per questo endpoint.
Risposta
JSON, un valore di esempio per campo.
- foundboolean
true
- urlstring
https://www.example.com/blog/launch
- titlestring
Introducing Example 2.0
- descriptionstring
Everything new in the biggest Example release yet.
- markdownstring
# Introducing Example 2.0 Today we are shipping the biggest release in our history…
FAQ
Sull'API Web Scraping Scraping della pagina
L'API Web Scraping Scraping della pagina di AnyAPI restituisce dati Web Scraping come JSON normalizzato da una sola chiamata POST a /v1/run/web.scrape. Fai scraping di qualsiasi pagina web e ottieni il suo contenuto principale come Markdown pulito più titolo e metadati. AnyAPI instrada ogni richiesta su 5 fonti e passa automaticamente a un'altra quando una fallisce. Costa da 0,70 USD ogni 1.000 richieste, in dollari statunitensi, senza abbonamento e senza minimo mensile. Negli ultimi 30 giorni, il 97,3% delle chiamate Web Scraping Scraping della pagina tramite AnyAPI è riuscito, con un tempo di risposta mediano di 2,8 secondi su 87.181 chiamate misurate.