Saltar al contenido

Blog

Perspectivas e ingeniería

Análisis en profundidad de la infraestructura de datos web, las técnicas de extracción y el futuro de los datos estructurados a gran escala.

Últimos artículos

181 artículos

Los 7 mejores proveedores de proxies dedicados y compartidos para web scraping
La ciencia del web scraping

Los 7 mejores proveedores de proxies dedicados y compartidos para web scraping

La elección de un proxy es un paso fundamental en cualquier proyecto de web scraping. Hoy compararemos las direcciones IP dedicadas y las compartidas, y te recomendaremos algunos proveedores.

Anda Miuțescu13 min read
Leer artículo
Guía completa para la extracción de datos inmobiliarios de la web
Casos de uso

Guía completa para la extracción de datos inmobiliarios de la web

El web scraping se ha convertido en una parte fundamental del sector inmobiliario. Tanto los agentes como los particulares sacan mucho provecho de las herramientas de scraping. A continuación te explicamos cómo hacerlo:

Robert Munceanu10 min read
Leer artículo
Tutorial de BeautifulSoup: Construir un raspador real de Python desde cero
Guías

Tutorial de BeautifulSoup: Construir un raspador real de Python desde cero

TL;DR: Este tutorial de BeautifulSoup te guía a través de un scraper Python completo, desde la instalación pip hasta un script reforzado que pagina Hacker News, exporta a CSV y JSON, y se mantiene lo suficientemente educado como para no ser bloqueado. Cada fragmento es ejecutable, y señalamos los momentos exactos en los que BeautifulSoup es la herramienta equivocada.

Sorin-Gabriel Marica19 min read
Leer artículo
Web scraping en Java: cómo crear un scraper fiable en Java
Guías

Web scraping en Java: cómo crear un scraper fiable en Java

En resumen: Empieza con HttpClient y Jsoup cuando los datos estén presentes en el HTML devuelto; recurre a una fuente JSON expuesta cuando sea necesario; y añade renderizado o Selenium únicamente para los estados que dependan del navegador. Este tutorial de Java sobre web scraping amplía un código base de Java 21 con paginación, concurrencia limitada, reintentos, sesiones, validación y salida duradera.

Raluca Penciuc32 min read
Leer artículo
Web Scraping con Selenium: Tutorial paso a paso en Python
Guías

Web Scraping con Selenium: Tutorial paso a paso en Python

TL;DR: Selenium te permite scrapear sitios web con mucho JavaScript manejando un navegador real desde código Python. Este tutorial te guía a través de cada fase: instalación de Selenium, configuración de Chrome, localización e interacción con elementos, manejo de esperas y paginación, exportación de datos limpios y escalado de tu scraper con proxies, Selenium Grid y alternativas basadas en API.

Robert Sfichi33 min read
Leer artículo
La guía definitiva para el web scraping con C++
Guías

La guía definitiva para el web scraping con C++

El C++ se puede utilizar para muchas cosas, pero ¿alguna vez has visto un rastreador web escrito en C++? Pues aquí tienes uno, además de un tutorial sobre cómo crear el tuyo propio.

Raluca Penciuc13 min read
Leer artículo

Empieza a crear

¿Estás listo para ampliar tu recopilación de datos?

Únete a más de 2000 empresas que utilizan WebScrapingAPI para extraer datos de la web a escala empresarial sin ningún gasto de infraestructura.