API para Web Scraping

API para Web Scraping: Fazer scraping de página

Faça scraping de qualquer página web e receba o conteúdo principal em Markdown limpo, além do título e dos metadados.

POST/v1/run/web.scrape
Disponibilidade
97,20%
30d · 49.771 chamadas
Requisições
50.400
30d · semanal, últimas 12 sem.
Resposta
2,5s
mediana · 30d

Teste

Faça sua primeira requisição

formatsarray
Quais representações da página retornar. Qualquer combinação de: markdown (conteúdo da página em Markdown), html (o HTML da página exatamente como o navegador o recebeu, incluindo as tags head e script). Cada formato solicitado é retornado no campo de saída correspondente. O padrão é ambos. rawHtml é um alias obsoleto de html, retornado em um campo rawHtml para quem integrou antes da renomeação; envie html no lugar dele.
Abrir em
Obter chave grátis
Resposta de exemplo
Execuções grátis retornam só os primeiros 3 resultados. Recarregue uma chave para receber a resposta completa.
{
  "found": true,
  "data": {
    "url": "https://www.example.com/blog/launch",
    "title": "Introducing Example 2.0",
    "description": "Everything new in the biggest Example release yet.",
    "markdown": "# Introducing Example 2.0\n\nToday we are shipping the biggest release in our history…"
  }
}
Interface da resposta
interface WebScrapeResponse {
  data: {
    description: string;
    html?: string;
    language?: string;
    markdown?: string;
    rawHtml?: string;
    title: string;
    url: string;
  } | null;
  found: boolean;
  reason?: "not_found";
}

Referência completa de parâmetros e resposta - todos os campos, tipos e exemplos deste endpoint.

Referência

Requisição, resposta e preço

Última verificação em 2026-09-29 · disponibilidade e latência medidas em 30d
POST /v1/run/web.scrape
curl -X POST https://api.getanyapi.com/v1/run/web.scrape \
  -H "Authorization: Bearer $ANYAPI_KEY" \
  -H "Content-Type: application/json" \
  -d '{"url":"https://www.example.com/blog/launch"}'
CampoTipoValor de exemplo
Corpo da requisição
urlstring"https://www.example.com/blog/launch"A URL da página para scraping.
blockAdsbooleanQuando true (padrão do upstream), remove elementos de anúncio e de consentimento de cookies antes da captura. Defina false para mantê-los.
excludeTagsarraySeletores CSS a remover antes da captura (ex.: ["nav", "footer", ".ads"]). Aplicado depois de includeTags.
formatsarrayQuais representações da página retornar. Qualquer combinação de: markdown (conteúdo da página em Markdown), html (o HTML da página exatamente como o navegador o recebeu, incluindo as tags head e script). Cada formato solicitado é retornado no campo de saída correspondente. O padrão é ambos. rawHtml é um alias obsoleto de html, retornado em um campo rawHtml para quem integrou antes da renomeação; envie html no lugar dele.
includeTagsarraySeletores CSS a manter. Quando definido, apenas o conteúdo que corresponde a esses seletores é capturado (ex.: ["article", "main"] ou ["#content"]).
mobilebooleanQuando true, renderiza a página com viewport e user agent de celular em vez de desktop. Alguns sites servem conteúdo substancialmente diferente para celular.
onlyMainContentbooleanQuando true, retorna apenas o conteúdo principal do artigo, removendo navegação, cabeçalhos, rodapés e outros elementos repetitivos. O padrão é false, para capturar a página inteira.
waitForintegerMilissegundos de espera para a página terminar de renderizar antes da captura. Use em páginas com muito JavaScript ou em single-page apps cujo conteúdo carrega depois da primeira renderização. Limitado a 15000 para ficar dentro do timeout da requisição. Essa espera é um tempo que você pediu para gastarmos, então sua resposta demora esse tempo a mais, e ele fica fora da latência publicada para este endpoint.
Resposta
foundbooleantrue
dataobject
data.urlstring"https://www.example.com/blog/launch"
data.titlestring"Introducing Example 2.0"
data.descriptionstring"Everything new in the biggest Example release yet."
data.markdownstring"# Introducing Example 2.0\n\nToday we are shipping the biggest release in our history…"
Preço
Preço por requisiçãoUSDUS$ 0,0007
Preço /mil req.USDUS$ 0,70

Dúvidas frequentes

Sobre o endpoint Fazer scraping de página da API para Web Scraping

O endpoint Fazer scraping de página da AnyAPI para Web Scraping retorna dados de Web Scraping em JSON normalizado com uma chamada POST para /v1/run/web.scrape. Faça scraping de qualquer página web e receba o conteúdo principal em Markdown limpo, além do título e dos metadados. A AnyAPI distribui cada requisição entre 4 fontes, com failover automático quando uma falha. Custa a partir de US$ 0,70 por mil requisições, em dólares, sem assinatura e sem mínimo mensal. Nos últimos 30 dias, 97,2% das chamadas ao endpoint Fazer scraping de página da API para Web Scraping feitas pela AnyAPI tiveram sucesso, com tempo de resposta mediano de 2,5 segundos, em 49.771 chamadas medidas.

Custa a partir de US$ 0,70 por mil requisições, em dólares, sem assinatura e sem mínimo mensal. Você recarrega uma carteira em dólares e cada chamada desconta dela. Algumas requisições pagas pela carteira que falham geram cobranças de processamento, que repassamos pelo custo, sem margem; a resposta de erro mostra o valor cobrado.

Faça scraping de qualquer página web e receba o conteúdo principal em Markdown limpo, além do título e dos metadados. A resposta é JSON normalizado, com o mesmo envelope que todo endpoint da AnyAPI retorna, então processar um segundo endpoint é só trocar a URL, e nada mais.

Nos últimos 30 dias, 97,2% das chamadas ao endpoint Fazer scraping de página da API para Web Scraping feitas pela AnyAPI tiveram sucesso, com tempo de resposta mediano de 2,5 segundos, em 49.771 chamadas medidas. Estas são medições da própria AnyAPI sobre o tráfego que passa pelo gateway, recalculadas continuamente, e não uma meta de nível de serviço publicada.