Requisitos previos#
- Una cuenta de AWS con acceso a Lambda
- Una clave de la API de Firecrawl — obtén una gratis
Configuración#
Buscar en la web#
Crea el archivo index.mjs con un manejador de búsqueda:
Hacer scraping de una página#
Agrega una acción scrape al mismo manejador:
Interactuar con una página#
Agrega una acción interact para controlar una sesión activa del navegador: haz clic en botones, rellena formularios y extrae contenido dinámico:
Desplegar#
Empaqueta y despliega con la AWS CLI:
Note
Establece el timeout de Lambda en al menos 30 segundos. El scraping de páginas dinámicas y las sesiones de interactuar pueden tardar más que el timeout predeterminado de 3 segundos.
Próximos pasos#
Documentación de búsqueda
Buscar en la web y obtener el contenido completo de la página
Documentación de scraping
Todas las opciones de scraping, incluidos los formatos, las acciones y los proxies
Documentación de interacción
Haz clic, completa formularios y extrae contenido dinámico
Referencia del SDK de Node
Referencia completa del SDK con rastreo, mapeo, extracción por lotes y más

