Skip to main content

Java

O SDK Java do Firecrawl é um wrapper da API do Firecrawl para ajudar você a transformar sites em markdown com facilidade.
3 min read

Instalação#

O SDK Java oficial é mantido no monorepo do Firecrawl em apps/java-sdk.

Para instalar o SDK Java do Firecrawl, adicione a dependência do Maven Central:

Note
Requer Java 11 ou posterior.

Uso#

  1. Obtenha uma chave de API em firecrawl.dev
  2. Defina a chave de API como uma variável de ambiente chamada FIRECRAWL_API_KEY ou passe-a com FirecrawlClient.builder().apiKey(...)

Aqui está um exemplo rápido usando a superfície atual da API do SDK:

Fazendo scraping de uma URL#

Para fazer scraping de uma única URL, use o método scrape.

Análise de arquivos enviados#

A versão mais recente do SDK Java (com.firecrawl:firecrawl-java) oferece suporte ao upload direto de arquivos para /v2/parse. parse não oferece suporte a changeTracking nem a opções disponíveis apenas no navegador, como screenshot, branding, actions, waitFor, location e mobile.

Java

Extração de JSON#

Extraia JSON estruturado com JsonFormat por meio do endpoint scrape:

Rastreamento de um site#

Para rastrear um site e aguardar sua conclusão, use crawl.

Iniciar um Rastreamento#

Inicie uma tarefa sem esperar usando startCrawl.

Verificando o status do rastreamento#

Verifique o progresso do rastreamento com getCrawlStatus.

Cancelando um Rastreamento#

Cancele um rastreamento em execução com cancelCrawl.

Mapear um site#

Descubra links em um site com map.

Buscando na Web#

Faça uma busca com configurações de busca optional usando search.

Scraping em batch#

Faça o scraping de várias URLs em paralelo com batchScrape.

Agente#

Execute um agente com IA usando agent.

Com um esquema JSON para saída estruturada:

Uso & métricas#

Verifique a concorrência e os créditos restantes:

Suporte assíncrono#

As variantes assíncronas já vêm integradas e retornam CompletableFuture.

Browser#

O SDK Java inclui utilitários do Browser Sandbox.

Criar uma sessão#

Executar código#

Sessão Interativa Vinculada ao Scraping#

Use o ID do job de scraping para executar código adicional no navegador no mesmo contexto reproduzido:

  • interact(...) executa código na sessão do navegador vinculada ao scraping (e a inicializa no primeiro uso).
  • stopInteraction(...) interrompe explicitamente a sessão interativa quando você terminar.

Listar & encerrar sessões#

Configuração#

FirecrawlClient.builder() oferece suporte às seguintes opções:

OpçãoTipoPadrãoDescrição
apiKeyStringvariável de ambiente FIRECRAWL_API_KEY ou propriedade do sistema firecrawl.apiKeySua API key do Firecrawl
apiUrlStringhttps://api.firecrawl.dev (ou FIRECRAWL_API_URL)URL base da API
timeoutMslong300000Tempo limite da requisição HTTP em ms
maxRetriesint3Tentativas automáticas para falhas transitórias
backoffFactordouble0.5Fator de backoff exponencial em segundos
asyncExecutorExecutorForkJoinPool.commonPool()Executor personalizado para métodos assíncronos
httpClientOkHttpClientConstruído a partir de timeoutMsInstância pré-configurada de OkHttpClient

Cliente HTTP personalizado#

Você pode passar um OkHttpClient pré-configurado para controlar o pool de conexões, interceptadores, configuração de SSL, configurações de proxy e qualquer outro recurso do OkHttp. Quando fornecida, a configuração timeoutMs é ignorada e prevalece a configuração do próprio cliente.

Tratamento de erros#

O SDK lança exceções em tempo de execução em com.firecrawl.errors.

Você é um agente de IA que precisa de uma chave de API do Firecrawl? Consulte firecrawl.dev/agent-onboarding/SKILL.md para obter instruções automatizadas de onboarding.