Integración simple del lado del servidor
Begin with api_key and a URL-encoded url. Add method, location, rendering, response, or asynchronous options only when the workload requires them.
API de scraping
Envía una URL y recibe el cuerpo de la página, una respuesta JSON o campos seleccionados mientras WebScrapingAPI opera enrutamiento por proxy, manejo de acceso, renderización JavaScript opcional y retemplazos internos target.
Una solicitud gestionada
Proporcione el target y las opciones de solicitud documentadas. WebScrapingAPI opera la capa de acceso y devuelve una respuesta que su tubería existente puede inspeccionar.
Begin with api_key and a URL-encoded url. Add method, location, rendering, response, or asynchronous options only when the workload requires them.
WebScrapingAPI operates proxy routing, rotation, access-handling strategies, and internal target retries behind the API request.
Review managed featuresReturn the page body, a JSON envelope, a JSON DOM, customer-defined selected fields, or an explicit documented error state.
Review response formatsCaracterísticas de acceso automatizado
Configure el contexto que necesita su flujo de trabajo. WebScrapingAPI opera la infraestructura de acceso de soporte mientras mantiene los estados fallidos visibles para su cliente.
01
El servicio selecciona y opera la ruta de proxy detrás de cada contexto de solicitud soportado.
02
Las estrategias de acceso automatizadas y los intentos internos target reducen la infraestructura que su aplicación tiene que ejecutar.
03
Los errores de validación, acceso, tarifa y servicio siguen siendo explícitos para que su aplicación pueda manejar deliberadamente las solicitudes fallidas.
04
Se ha establecidorender_js=1Cuando el target necesita ejecución del lado del cliente antes de que se devuelva la respuesta de la página.
05
Solicitar un país documentado y un contexto de ciudad, estado o ASN apoyado cuando la ubicación afecte a la respuesta.
06
Utilice métodos soportados, un cuerpo opcional, tiempo de espera, recuperación asincrona, modos JSON o reglas de extracción.
Mantenga el cuerpo de la página, envuélvelo con metadatos de solicitud, ejecute selectores en el límite de la API o obtenga un resultado en cola más tarde.
Utilice el cuerpo de página predeterminado con un parser existente.
Organismo de inspección, target encabezados, estado inicial, tipo, costo y metadatos.
Ejecutar CSS o XPath selectores de propiedad del cliente para texto, HTML, atributos, tablas o registros anidados.
Envía el trabajo de forma asíncrona y recupera la respuesta completada utilizando su identificador.
Límites de extracción:WebScrapingAPI ejecuta las reglas proporcionadas. Su equipo posee el esquema, selectores, validación de campo de negocio y mantenimiento de cambio de fuente. Elige API de datos o Datos gestionados cuando esas obligaciones se trasladen a WebScrapingAPI.
Cómo funciona
Su aplicación define la solicitud. WebScrapingAPI maneja la recuperación. Su cliente recibe la salida solicitada o un estado explícito en el que puede actuar.
Proporcione la clave de API, target URL, y solo el contexto documentado o las opciones de salida que la carga de trabajo necesita.
El servicio valida la solicitud, opera el enrutamiento proxy, aplica el manejo de acceso y los intentos internos, y hace renderizar JavaScript cuando se lo solicita.
Utilice el cuerpo de la página devuelta, el sobre JSON, los campos seleccionados o el error documentado dentro de su aplicación existente.
Integración de desarrolladores
Mantenga la clave API en el lado del servidor, codifique la URL target, comience con una solicitud básica y añada renderización, geografía o extracción solo cuando la carga de trabajo lo requiera.
01 · resumen de integración
Envíaapi_keyy una URL codificadaurl- Añadir .render_js=1, contexto geográfico, modo de respuesta o reglas de extracción sólo cuando las target y el flujo de trabajo aguas abajo lo requieren.
WSA_API_KEY server-sidecurl --get --fail-with-body --max-time 120 \
"https://api.webscrapingapi.com/v2" \
--data-urlencode "api_key=$WSA_API_KEY" \
--data-urlencode "url=https://example.com/public-page" \
--data-urlencode "json_response=1"import os
import requests
response = requests.get(
"https://api.webscrapingapi.com/v2",
params={
"api_key": os.environ["WSA_API_KEY"],
"url": "https://example.com/public-page",
"json_response": 1,
},
timeout=120,
)
response.raise_for_status()
print(response.json())const params = new URLSearchParams({
api_key: process.env.WSA_API_KEY,
url: "https://example.com/public-page",
json_response: "1",
});
const response = await fetch(
"https://api.webscrapingapi.com/v2?" + params,
{ signal: AbortSignal.timeout(120_000) }
);
if (!response.ok) throw new Error("API status " + response.status);
console.log(await response.json());<?php
$query = http_build_query([
"api_key" => getenv("WSA_API_KEY"),
"url" => "https://example.com/public-page",
"json_response" => 1,
]);
$client = curl_init("https://api.webscrapingapi.com/v2?" . $query);
curl_setopt_array($client, [
CURLOPT_RETURNTRANSFER => true,
CURLOPT_TIMEOUT => 120,
]);
$body = curl_exec($client);
$status = curl_getinfo($client, CURLINFO_RESPONSE_CODE);
$error = curl_error($client);
curl_close($client);
if ($body === false) throw new RuntimeException($error);
if ($status >= 400) throw new RuntimeException("API status " . $status);
echo $body;package main
import (
"fmt"
"io"
"net/http"
"net/url"
"os"
"time"
)
func main() {
params := url.Values{}
params.Add("api_key", os.Getenv("WSA_API_KEY"))
params.Add("url", "https://example.com/public-page")
params.Add("json_response", "1")
client := &http.Client{Timeout: 120 * time.Second}
response, err := client.Get(
"https://api.webscrapingapi.com/v2?" + params.Encode(),
)
if err != nil { panic(err) }
defer response.Body.Close()
if response.StatusCode >= 400 {
panic(fmt.Sprintf("API status %d", response.StatusCode))
}
body, err := io.ReadAll(response.Body)
if err != nil { panic(err) }
fmt.Println(string(body))
}import java.net.URI;
import java.net.URLEncoder;
import java.net.http.*;
import java.nio.charset.StandardCharsets;
import java.time.Duration;
String query = "api_key=" + URLEncoder.encode(
System.getenv("WSA_API_KEY"), StandardCharsets.UTF_8
) + "&url=" + URLEncoder.encode(
"https://example.com/public-page", StandardCharsets.UTF_8
) + "&json_response=1";
var request = HttpRequest.newBuilder()
.uri(URI.create("https://api.webscrapingapi.com/v2?" + query))
.timeout(Duration.ofSeconds(120))
.GET().build();
var response = HttpClient.newHttpClient()
.send(request, HttpResponse.BodyHandlers.ofString());
if (response.statusCode() >= 400) {
throw new RuntimeException("API status " + response.statusCode());
}
System.out.println(response.body());using System.Net;
var apiKey = WebUtility.UrlEncode(
Environment.GetEnvironmentVariable("WSA_API_KEY")
);
var target = WebUtility.UrlEncode(
"https://example.com/public-page"
);
var requestUrl =
"https://api.webscrapingapi.com/v2?api_key=" + apiKey +
"&url=" + target + "&json_response=1";
using var client = new HttpClient();
client.Timeout = TimeSpan.FromSeconds(120);
var response = await client.GetAsync(requestUrl);
response.EnsureSuccessStatusCode();
Console.WriteLine(await response.Content.ReadAsStringAsync());require "net/http"
require "uri"
uri = URI("https://api.webscrapingapi.com/v2")
uri.query = URI.encode_www_form(
api_key: ENV.fetch("WSA_API_KEY"),
url: "https://example.com/public-page",
json_response: 1
)
http = Net::HTTP.new(uri.host, uri.port)
http.use_ssl = true
http.open_timeout = 10
http.read_timeout = 120
response = http.get(uri.request_uri)
raise "API status #{response.code}" unless response.is_a?(Net::HTTPSuccess)
puts response.bodyPropiedad operativa
WebScrapingAPI opera el enrutamiento, la representación opcional y los intentos internos target. Su equipo posee target elegibilidad, la especificación de la solicitud, extracción, almacenamiento y uso en aguas posteriores.
WebScrapingAPI
Su equipo
Use the service only for eligible public webpages. Review source terms, applicable requirements, and the Acuerdo de servicio, then apply appropriate request, retention, and data-use policies.
Casos de uso
API de scraping es la capa de acceso. Su aplicación decide cómo la página se convierte en una observación, registro, alerta, resultado de prueba o entrada de modelo.
Selección de producto
Comienza con la propiedad operativa, no se superponen las características. API de scraping se ajusta a una solicitud de página gestionada; los productos adyacentes mueven un límite diferente.
Usted opera el cliente HTTP, la política de solicitud, retemplazos, análisis y almacenamiento. WebScrapingAPI proporciona la ruta de la red.
Proporcione una URL y opciones de solicitud. WebScrapingAPI opera la recuperación y devuelve el cuerpo de la página o la salida documentada.
Envía una solicitud REST respaldada por el navegador con espera documentada, interacciones, pasos de navegación y controles de salida.
Enviar parámetros de búsqueda y recibir resultados estructurados de motores de búsqueda compatibles.
Evaluar una colección de múltiples páginas limitada cuando la unidad de trabajo abarca páginas relacionadas en lugar de una sola solicitud.
Busque una fuente compatible mientras WebScrapingAPI opera el acceso, target extracción específica y mantenimiento del parser.
Define las fuentes, esquema, cadencia, calidad y destino mientras WebScrapingAPI opera el programa contratado.
Orientación de precios
El precio actual sigue siendo la fuente de la verdad. Utilice una muestra realista de solicitud para comprender las opciones y el comportamiento operativo que utilizará su carga de trabajo de producción.
Evaluación de los servicios propios
Comience con la ruta HTTP básica, luego prueba sólo los controles que su mezcla de producción target requiere.
FAQ
Utilice estas respuestas para elegir el producto y solicitar el camino, luego revise la documentación actual para obtener detalles de parámetros y errores.
API de scraping es un punto final de solicitud del lado del servidor que recupera una página web pública elegible mientras que WebScrapingAPI opera la infraestructura de acceso detrás de la solicitud. Su aplicación proporciona la URL y las opciones documentadas, luego recibe la respuesta de la página solicitada.
La respuesta predeterminada es el cuerpo de la página recuperada. Las opciones documentadas pueden devolver un sobre JSON, una representación JSON DOM, campos seleccionados con reglas de extracción o un resultado asíncrono que su aplicación recupera más tarde.
Sí. Establezca render_js=1 cuando una página requiere ejecución JavaScript del lado del cliente antes de devolver la respuesta. Utilice API de navegador cuando el flujo de trabajo necesita una secuencia documentada de interacciones del navegador, espera del estado de la página, clics o pasos de navegación.
WebScrapingAPI opera enrutamiento por proxy, rotación, estrategias de manejo de acceso y intentos internos target dentro del servicio.
API de scraping soporta las solicitudes GET, POST, PUT y PATCH. Incluya un cuerpo de solicitud cuando el método seleccionado y el flujo de trabajo target requieren uno.
Los controles documentados incluyen el país y el contexto de ciudad, estado o ASN compatibles. La disponibilidad exacta puede depender del plan, la geografía y la ruta actuales, así que confirme las ubicaciones requeridas por su carga de trabajo.
Sí. Las reglas de extracción de CSS o XPath proporcionadas por el cliente pueden devolver texto seleccionado, HTML, atributos, tablas, listas o registros anidados. Su equipo es dueño de los selectores, esquema, validación y mantenimiento de cambio de fuente para esas reglas.
Sí. Requiere una solicitud con la opción documentada asincrona, retenga el identificador devuelto y obtenga el resultado completado más tarde pasando ese identificador como snapshot_id.
Inspeccione el estado y el cuerpo de errores HTTP documentados, use retry y backoff limitados cuando sea apropiado, y distingue un fallo de API de contenido que esté presente pero incompleto para su esquema de negocio.
API de scraping administra la recuperación de una página. Los proxies dejan el cliente HTTP y la lógica de recogida con su equipo, API de navegador ejecuta interacciones de navegador documentadas dentro de una solicitud REST del lado del servidor y API de datos devuelve registros estructurados mantenidos para fuentes compatibles.
Su primera petición
Comience a servido por sí mismo, o traiganos la mezcla target, respuesta requerida, geografía y perfil de solicitud esperado para una revisión de producción.