Pré-requisitos#
- Uma conta da AWS com acesso ao Lambda
- Uma chave da API do Firecrawl — obtenha uma gratuitamente
Configuração#
Fazer uma busca na web#
Crie index.mjs com um handler de busca:
Fazer scraping de uma página#
Adicione uma ação scrape ao mesmo handler:
Interaja com uma página#
Adicione uma ação interact para controlar uma sessão do navegador em tempo real — clique em botões, preencha formulários e extraia conteúdo dinâmico:
Deploy#
Empacote e faça o deploy com a AWS CLI:
Note
Defina o tempo limite do Lambda para pelo menos 30 segundos. O scraping de páginas dinâmicas e as sessões de interação podem demorar mais do que o tempo limite padrão de 3 segundos.
Próximos passos#
Documentação de busca
Faça uma busca na web e obtenha o conteúdo completo da página
Documentação de scraping
Todas as opções de scraping, incluindo formatos, ações e proxies
Documentação de interação
Clique, preencha formulários e extraia conteúdo dinâmico
Referência do SDK de Node
Referência completa do SDK com rastreamento, map, extração em lote e muito mais

