Buscar archivos, recuperar, empacar y entregar.
- Apply the selected archive filters
- Prepare the matched snapshot set
- Keep snapshot metadata with stored pages
- Deliver through the selected archive path
Datos y feeds
Busque capturas pasadas por dominio, patrón de URL, rango de fecha, idioma y tipo de contenido. Reciba páginas correspondientes con metadatos instantáneos para investigación, retroalimentación, datos de IA y análisis de cambios.
Diseño de la consulta
Definir lo que pertenece a la búsqueda antes de recuperar páginas. Un resumen enfocado mantiene el conjunto correspondiente relevante, más fácil de estimar y más sencillo de procesar en el torrente inferior.
01 · fuente
Nombre de los dominios públicos y patrones de trayectoria que contienen las páginas de su investigación, índice o corpus necesita.
02 · tiempo
Utilice un rango de fechas preciso para que cada captura coincida pertenezca al período que desea analizar o completar.
03 · contenido
Estricto por idioma y tipo de contenido cuando el flujo de trabajo receptor espera un tipo particular de material fuente.
04 · destino
Elija cómo debe llegar el paquete de archivo y guarde el contenido de la página junto a sus metadatos de captura desde la primera entrega.
Contexto histórico
Las capturas coincidentes crean un historial datado para cada URL o familia de URL. Mantenga la página almacenada y captura el contexto juntos para que los equipos de aguas abajo puedan comparar versiones con un eje de tiempo claro.
Mantenga la página tal como apareció en el momento de la captura.
Guarde otra captura para la comparación de campos, texto, enlace o diseño río abajo.
Complete la ventana solicitada con la última captura de coincidencia en el conjunto de resultados.
Revise el alcance correspondiente con los dominios, caminos, fechas, idiomas y tipos de contenido seleccionados. Refinar la consulta hasta que el resultado represente la parte histórica que puede usar su flujo de trabajo.
Recuperación y entrega
El proceso de producción es deliberado: definir filtros, revisar el alcance y la estimación correspondientes, preparar las páginas históricas seleccionadas y luego entregar contenido y metadatos juntos.
Dominio, patrones de URL, rango de fechas, idioma, tipo de contenido y destino.
Compruebe si la forma del resultado se alinea con la pregunta histórica antes de la recuperación.
Package stored pages with URL, capture time, language, type, and collection metadata.
Seleccione S3 o entrega webhook para el flujo de trabajo de datos de recepción.
Archivo web proporciona páginas históricas y contexto. Datos gestionados es el camino operado cuando la salida terminada debe ser un conjunto de datos estructurado mantenido.
Casos de uso
Archivo web se ajusta a las cargas de trabajo que necesitan estados de página anteriores, un target recargado, o un conjunto repetible de capturas históricas antes de que comience el análisis.
Aplicación del producto
Archivo web comienza con capturas ya presentes en una ventana histórica.
Productos | Mejor punto de partida | Lo que recibes | Aplicación para el funcionamiento |
|---|---|---|---|
Archivo web | Un dominio histórico, familia de URL y ventana de fecha | Páginas públicas almacenadas con metadatos instantáneos | Descubrimiento histórico, análisis de cambios y retroalimentación |
Un dominio de datos y esquema disponibles | Detalles y muestras representativas de los conjuntos de datos preparados | Descubra una colección existente antes de elegir la entrega | |
Una colección estructurada definida, cadencia y destino | Entrega estructurada programada recurrente | Mantener un alcance de datos conocido fluyendo a los sistemas en aguas subidas | |
Una nueva colección de múltiples páginas | Resultados de recogida alineados durante la evaluación | Recoger páginas elegibles relacionadas en los puntos de entrada aprobados | |
Fuente de apoyo target | Registros estructurados mantenidos a petición | Acceso a la fuente dirigida por la aplicación a través de un esquema conocido | |
Una fuente personalizada, esquema, cadencia y destino | Una entrega estructurada totalmente operativa | Recogida, extracción, calidad y mantenimiento |
Orientación de precios
La información sobre los precios actuales es la fuente de la verdad. Una revisión útil comienza con el alcance de la consulta, el volumen esperado, el paquete de contenido, el destino y los requisitos de soporte.
Evaluación de los archivos
Traer un conjunto de dominios, patrones de ruta, rango de fechas, idioma y necesidades de tipo de contenido, plus el sistema que recibirá el paquete de archivo.
FAQ
Utilice estas respuestas para dar forma a la primera consulta de archivo, comprender el registro entregado y elegir el límite de producto correcto.
Archivo web ayuda a los equipos a encontrar instantáneas históricas de páginas públicas ya presentes en el archivo. Define los dominios relevantes, patrones de URL, rango de fecha, idioma y tipo de contenido, luego recibe las páginas correspondientes con contexto de captura.
Una instantánea entregada empareja la página almacenada con metadatos de instantánea como la URL de origen, el tiempo de captura, el idioma, el tipo de contenido y el contexto de recopilación necesarios para organizarla o compararla en el río abajo.
La búsqueda se puede realizar con un dominio o conjunto de dominios, patrones de URL, un rango de fechas, idioma y tipo de contenido. Los filtros más ajustados hacen que el conjunto coincidente sea más fácil de revisar y mantener la entrega enfocada en la parte histórica de su flujo de trabajo.
Sí. El flujo de evaluación está diseñado en torno a revisar el alcance y la estimación coincidentes antes de que se prepare el paquete de instantáneas.
El paquete de archivo se puede entregar a S3 o webhook, con páginas almacenadas y sus metadatos instantáneos mantenidos juntos. Elige el camino que mejor se adapte a tu ingestión, almacenamiento y flujo de trabajo de procesamiento.
Archivo web busca capturas históricas ya presentes en una ventana de tiempo elegida. API de rastreo es el mejor ajuste cuando necesita planificar una nueva colección limitada en páginas públicas elegibles relacionadas.
Archivo web ofrece páginas históricas con metadatos capturados.Mercado de datosayuda a los equipos a descubrir y a tomar muestras de conjuntos de datos preparados,Fuentes de datosproporciona una entrega estructurada programada recurrente, y API de datos Registros estructurados mantenidos para la fuente de apoyo target S.
Recupera capturas para la misma familia de URL o URL a través de un rango de fechas definido, retenga cada tiempo de captura y compare las versiones en su flujo de trabajo de investigación, indexación, monitoreo o extracción.
Trae los dominios, patrones de URL, rango de fecha, filtros de idioma y tipo de contenido, alcance esperado, preferencias de entrega y requisitos de soporte.
Breve información histórica
Compartir los dominios, caminos, fechas, filtros de contenido y destino.