NovedadesNuevo

Presentamos Web Scrape

Web Scrape
Web Scrape en el Playground: la página de inicio rápido de querying.ai devuelta en Markdown

Web Scrape extrae el contenido principal de una URL en Markdown por 1 crédito por solicitud completada.

Qué obtienes

  • markdown: el contenido principal de la página con sus títulos, párrafos, listas, tablas, enlaces e imágenes, y con la cabecera, el pie y la navegación del sitio eliminados.
  • title, description, author, publishedAt, siteName, language e image cuando la página los declara.
  • finalUrl y statusCode: la dirección final tras las redirecciones y el estado que devolvió el sitio.
  • images: cada imagen de markdown, en el orden en que aparece y con su texto alternativo.

Cómo funciona

Envía una URL pública http o https de hasta 2.048 caracteres. Web Scrape abre la página, renderiza las que dibuja un script, como las fichas de producto de una tienda, y conserva el contenido que busca el lector: el texto, las tablas y las imágenes. El resultado es Markdown limpio, listo para guardar, buscar o analizar.

maxChars fija la longitud, de 1.000 a 200.000 caracteres (100.000 por defecto). Una página larga se corta en un salto de párrafo y marca truncated: true. country (US por defecto) fija el idioma y la región con que se pide la página. Un PDF, una página que responde 404 o 410, o un sitio que rechaza la solicitud terminan la tarea con PAGE_UNAVAILABLE y la respuesta del sitio en el mensaje.

Para qué sirve

  • Lee las páginas que citan las respuestas de IA para ver qué contenido consigue citas.
  • Pasa un link de los resultados de GOOGLE_SERP para leer las páginas que posicionan en una búsqueda.
  • Sigue las páginas de producto y de precios de la competencia como texto que comparas en el tiempo.
  • Lee una página desde tu asistente de IA con la herramienta MCP scrape_page.

Envía la solicitud

Envía la solicitud con tu clave de API en la cabecera Authorization.

curl -X POST https://api.querying.ai/v1/async/task \
  -H "Authorization: Bearer $QUERYING_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "taskType": "WEB_SCRAPE",
    "payload": {
      "url": "https://docs.querying.ai/quickstart",
      "country": "US"
    }
  }'

Campos de la solicitud

taskTypestringObligatorio
El motor que se ejecuta, como CHATGPT o GOOGLE.
payload.urlstringObligatorio
La página que se lee: una dirección pública http o https, de hasta 2.048 caracteres.
payload.maxCharsinteger
Límite de longitud de markdown, de 1.000 a 200.000. Por defecto 100.000. Una página más larga termina en un salto de párrafo y lleva truncated.
payload.countrystring
País desde el que se pide la página; define su idioma y región. Por defecto US.
webhook.urlstring
Una dirección HTTPS de tu servidor. La tarea terminada se envía allí en cuanto se completa.
idempotencyKeystring
Tu propio ID para la solicitud. Cada clave crea una sola tarea por cuenta, así que un reenvío sigue siendo una sola tarea.

Respuesta

Así llega una tarea terminada, recortada para que se lea mejor.

JSON
{
  "success": true,
  "task": {
    "id": "910017b1-4fd5-4bc7-8895-bbe6b1b0d1df",
    "taskType": "WEB_SCRAPE",
    "status": "COMPLETED",
    "createdAt": "2026-10-02T15:48:34.088Z"
  },
  "credits": { "creditsToCharge": 1, "creditsCharged": 1 },
  "response": {
    "url": "https://docs.querying.ai/quickstart",
    "finalUrl": "https://docs.querying.ai/quickstart",
    "statusCode": 200,
    "title": "AI Search Data API Quickstart",
    "description": "Submit a task, receive a result — with webhooks or by polling.",
    "siteName": "querying.ai",
    "language": "en",
    "markdown": "# AI Search Data API Quickstart\n\n[한국어 시작 가이드](https://querying.ai/ko/guides/quickstart) · [API plans and credits](https://querying.ai/en/pricing)\n\n## 1\\. Set your credentials\n\n```shellscript\nexport BASE=\"https://api.querying.ai\"\nexport API_KEY=\"<your-key>\"\n```\n\n…",
    "images": [],
    "truncated": false
  }
}
task.statusstring
QUEUED, PROCESSING y al final COMPLETED con la respuesta o FAILED con error.
credits.creditsChargedinteger
Créditos cobrados por la tarea terminada. Una tarea fallida cobra 0.
response.markdownstring
El contenido principal de la página en Markdown: títulos, párrafos, listas, tablas, enlaces e imágenes.
response.titlestring
El título de la página, con description, author, siteName y language cuando la página los declara.
response.publishedAtstring
La fecha de publicación que declara la página, en ISO 8601.
response.finalUrlstring
La dirección final tras las redirecciones, con statusCode.
response.imagesarray
Las imágenes de markdown, en orden de lectura, cada una con url y alt.
response.truncatedboolean
true cuando markdown llegó a maxChars y termina en un salto de párrafo.

Recibe el resultado

La solicitud devuelve la tarea al instante con status QUEUED. Consulta GET /v1/async/task/{id} hasta que status sea COMPLETED o FAILED, o añade webhook.url y la tarea terminada llega a tu servidor con los mismos task, credits y response. Los resultados siguen disponibles 24 horas después de terminar la tarea.

curl https://api.querying.ai/v1/async/task/$TASK_ID \
  -H "Authorization: Bearer $QUERYING_API_KEY"

Precio

Cada página completada usa 1 crédito.

Más novedades

Recibe las novedades

Recibe las actualizaciones por correo.

Feed RSS