Skip to main content

Elixir

O SDK Elixir do Firecrawl é um cliente gerado automaticamente para a API v2 do Firecrawl, desenvolvido com Req e NimbleOptions.
3 min read

Faça scraping de páginas individuais, rastreie sites inteiros e mapeie URLs na sua aplicação Elixir. O SDK valida todos os parâmetros em tempo de execução com NimbleOptions e usa Req para HTTP, para que você receba mensagens de erro claras para erros de digitação e opções inválidas antes que qualquer requisição seja feita.

Toda função tem uma variante com bang (!) que gera uma exceção em caso de erro, em vez de retornar tuplas {:error, ...}.

Instalação#

Adicione firecrawl à sua lista de dependências no mix.exs e configure sua chave de API:

Elixir

Ou passe a chave de API em cada requisição:

Elixir

Uso#

  1. Obtenha uma chave de API em firecrawl.dev
  2. Defina a chave de API na configuração do seu aplicativo ou passe-a como opção para qualquer função.
Elixir

Fazendo scraping de uma URL#

Faça o scraping de uma única URL com scrape_and_extract_from_url. Ela retorna o conteúdo da página como dados estruturados, incluindo markdown, metadados e quaisquer outros formatos que você solicitar.

Elixir

Rastrear um site#

Para rastrear um site, use crawl_urls. Ele aceita a URL inicial e parâmetros opcionais, como limite de páginas, domínios permitidos e formato de resultado.

Elixir

Iniciar um rastreamento#

Inicie um job de rastreamento e receba o ID do job sem bloqueio:

Elixir

Verificando o status do rastreamento#

Consulte o status de um job de rastreamento com get_crawl_status:

Elixir

Cancelar um rastreamento#

Cancele um job de rastreamento com cancel_crawl:

Elixir

Mapeie um site#

Use map_urls para gerar uma lista de URLs a partir de um site:

Elixir

Faça uma busca na web e, opcionalmente, faça scraping dos resultados:

Elixir

Extração em lote#

Realize o scraping de várias URLs em um único job em lote:

Elixir

agente#

Inicie uma tarefa de extração de dados com agente:

Elixir

Inicie sessões de navegador na nuvem e execute código remotamente.

Criar uma sessão#

Elixir

Executar código#

Elixir

Perfis#

Salve e reutilize o estado do navegador (cookies, localStorage etc.) entre sessões:

Elixir

Listar & encerrar sessões#

Elixir

Instâncias auto-hospedadas#

Para usar uma instância auto-hospedada do Firecrawl, passe a opção base_url:

Elixir

Tratamento de erros#

Funções sem bang retornam {:ok, response} ou {:error, exception}. As variantes com bang levantam uma exceção em caso de erro. O NimbleOptions valida todos os parâmetros antes de a requisição ser enviada, detectando imediatamente erros de digitação, campos obrigatórios ausentes e erros de tipo.

Elixir

Todas as funções disponíveis#

FunçãoDescrição
scrape_and_extract_from_urlFaz scraping de uma única URL
scrape_and_extract_from_urlsFaz extração em lote de várias URLs
crawl_urlsFaz o rastreamento de um site
get_crawl_statusVerifica o status do job de rastreamento
get_crawl_errorsObtém os erros do job de rastreamento
get_active_crawlsLista os rastreamentos ativos
cancel_crawlCancela um job de rastreamento
map_urlsMapeia URLs em um site
search_and_scrapeBusca e faz scraping dos resultados
start_agentInicia uma tarefa de extração com agente
get_agent_statusVerifica o status do job do agente
cancel_agentCancela um job do agente
create_browser_sessionCria uma sessão de navegador
execute_browser_codeExecuta código em uma sessão de navegador
list_browser_sessionsLista as sessões de navegador
delete_browser_sessionExclui uma sessão de navegador
get_batch_scrape_statusVerifica o status da extração em lote
get_batch_scrape_errorsObtém os erros da extração em lote
cancel_batch_scrapeCancela uma extração em lote
get_credit_usageObtém os créditos restantes

Todas as funções acima têm uma variante com bang (!) (por exemplo, scrape_and_extract_from_url!) que gera uma exceção em vez de retornar tuplas de erro.

Para ver a documentação completa da API, consulte hexdocs.pm/firecrawl.