Desarrollo y DevOps

Extraer datos de sitios web multi-página y guardar en Google Drive

16 nodos 304 176 Automatic trigger
Descargar

Descripción del flujo de trabajo

Flujo de trabajo automatizado que extrae contenido de múltiples URLs usando solicitudes HTTP, procesa y filtra datos con lógica condicional, luego organiza resultados en Google Drive en lotes controlados para evitar sobrecargas.

Cómo funciona

  1. 1.Recibir lista de URLs manualmente o desde fuente externa
  2. 2.Dividir enlaces en lotes procesables con limitación de velocidad
  3. 3.Obtener cada página web mediante HTTP y analizar contenido XML
  4. 4.Filtrar y extraer datos requeridos usando condiciones personalizadas
  5. 5.Guardar resultados procesados como archivos organizados en Google Drive

Casos de uso

  • Monitorear precios de productos en múltiples páginas y registrar cambios
  • Recopilar listados de empleos o inmuebles de sitios clasificados
  • Extraer artículos de noticias o blogs periódicamente para archivo

Requisitos

  • URLs válidas y accesibles desde la red de n8n
  • Cuenta Google Drive activa con permisos de escritura
  • Comprensión básica de estructura HTML/XML del sitio destino

Valor del servicio

Ideal como servicio de automatización operativa para conectar sistemas, reducir tareas manuales y acelerar la entrega de resultados a clientes o equipos internos.

Aplicaciones utilizadas

Split In Batches Google Drive

Detalles

Disparador Automatic trigger
Nodos 16
Aplicaciones 2
Vistas 304
Descargas 176

Cómo usar

  1. 1.Haz clic en "Descargar plantilla"
  2. 2.Abre tu panel de n8n
  3. 3.Ve a Workflows > Import from File
  4. 4.Selecciona el archivo descargado y configura las credenciales

Nodos utilizados (16)

/

Sticky Note

Sticky Note

#1

When clicking ‘Test workflow’

Manual Trigger

#2

Loop Over Items

Split In Batches

#3

Wait

Wait

#4

Limit

Limit

#5

Get List of Website URLs

HTTP Request

#6

Convert to JSON

Xml

#7

Create List of Website URLs

Split Out

#8

Filter By Topics or Pages

Filter

#9

Set Website URL

Set

#10

Jina.ai Web Scraper

HTTP Request

#11

Save Webpage Contents to Google Drive

Google Drive

#12

Extract Title & Markdown Content

Code

#13

Sticky Note1

Sticky Note

#14

Sticky Note2

Sticky Note

#15

Sticky Note3

Sticky Note

#16