API para Web Scraping: Fazer scraping de página
Faça scraping de qualquer página web e receba o conteúdo principal em Markdown limpo, além do título e dos metadados.
Rede de provedores
Provedores ordenados por tráfego
Teste
Faça sua primeira requisição
{
"found": true,
"data": {
"url": "https://www.example.com/blog/launch",
"title": "Introducing Example 2.0",
"description": "Everything new in the biggest Example release yet.",
"markdown": "# Introducing Example 2.0\n\nToday we are shipping the biggest release in our history…"
}
}interface WebScrapeResponse {
data: {
description: string;
html?: string;
language?: string;
markdown?: string;
rawHtml?: string;
title: string;
url: string;
} | null;
found: boolean;
reason?: "not_found";
}Referência completa de parâmetros e resposta - todos os campos, tipos e exemplos deste endpoint.
Referência
Requisição, resposta e preço
Última verificação em 2026-09-29 · disponibilidade e latência medidas em 30dcurl -X POST https://api.getanyapi.com/v1/run/web.scrape \
-H "Authorization: Bearer $ANYAPI_KEY" \
-H "Content-Type: application/json" \
-d '{"url":"https://www.example.com/blog/launch"}'| Campo | Tipo | Valor de exemplo |
|---|---|---|
| Corpo da requisição | ||
| url | string | "https://www.example.com/blog/launch"A URL da página para scraping. |
| blockAds | boolean | Quando true (padrão do upstream), remove elementos de anúncio e de consentimento de cookies antes da captura. Defina false para mantê-los. |
| excludeTags | array | Seletores CSS a remover antes da captura (ex.: ["nav", "footer", ".ads"]). Aplicado depois de includeTags. |
| formats | array | Quais representações da página retornar. Qualquer combinação de: markdown (conteúdo da página em Markdown), html (o HTML da página exatamente como o navegador o recebeu, incluindo as tags head e script). Cada formato solicitado é retornado no campo de saída correspondente. O padrão é ambos. rawHtml é um alias obsoleto de html, retornado em um campo rawHtml para quem integrou antes da renomeação; envie html no lugar dele. |
| includeTags | array | Seletores CSS a manter. Quando definido, apenas o conteúdo que corresponde a esses seletores é capturado (ex.: ["article", "main"] ou ["#content"]). |
| mobile | boolean | Quando true, renderiza a página com viewport e user agent de celular em vez de desktop. Alguns sites servem conteúdo substancialmente diferente para celular. |
| onlyMainContent | boolean | Quando true, retorna apenas o conteúdo principal do artigo, removendo navegação, cabeçalhos, rodapés e outros elementos repetitivos. O padrão é false, para capturar a página inteira. |
| waitFor | integer | Milissegundos de espera para a página terminar de renderizar antes da captura. Use em páginas com muito JavaScript ou em single-page apps cujo conteúdo carrega depois da primeira renderização. Limitado a 15000 para ficar dentro do timeout da requisição. Essa espera é um tempo que você pediu para gastarmos, então sua resposta demora esse tempo a mais, e ele fica fora da latência publicada para este endpoint. |
| Resposta | ||
| found | boolean | true |
| data | object | |
| data.url | string | "https://www.example.com/blog/launch" |
| data.title | string | "Introducing Example 2.0" |
| data.description | string | "Everything new in the biggest Example release yet." |
| data.markdown | string | "# Introducing Example 2.0\n\nToday we are shipping the biggest release in our history…" |
| Preço | ||
| Preço por requisição | USD | US$ 0,0007 |
| Preço /mil req. | USD | US$ 0,70 |
Dúvidas frequentes
Sobre o endpoint Fazer scraping de página da API para Web Scraping
O endpoint Fazer scraping de página da AnyAPI para Web Scraping retorna dados de Web Scraping em JSON normalizado com uma chamada POST para /v1/run/web.scrape. Faça scraping de qualquer página web e receba o conteúdo principal em Markdown limpo, além do título e dos metadados. A AnyAPI distribui cada requisição entre 4 fontes, com failover automático quando uma falha. Custa a partir de US$ 0,70 por mil requisições, em dólares, sem assinatura e sem mínimo mensal. Nos últimos 30 dias, 97,2% das chamadas ao endpoint Fazer scraping de página da API para Web Scraping feitas pela AnyAPI tiveram sucesso, com tempo de resposta mediano de 2,5 segundos, em 49.771 chamadas medidas.