Instalação#
O SDK Java oficial é mantido no monorepo do Firecrawl em apps/java-sdk.
Para instalar o SDK Java do Firecrawl, adicione a dependência do Maven Central:
Uso#
- Obtenha uma chave de API em firecrawl.dev
- Defina a chave de API como uma variável de ambiente chamada
FIRECRAWL_API_KEYou passe-a comFirecrawlClient.builder().apiKey(...)
Aqui está um exemplo rápido usando a superfície atual da API do SDK:
Fazendo scraping de uma URL#
Para fazer scraping de uma única URL, use o método scrape.
Análise de arquivos enviados#
A versão mais recente do SDK Java (com.firecrawl:firecrawl-java) oferece suporte ao upload direto de arquivos para /v2/parse.
parse não oferece suporte a changeTracking nem a opções disponíveis apenas no navegador, como screenshot, branding, actions, waitFor, location e mobile.
Extração de JSON#
Extraia JSON estruturado com JsonFormat por meio do endpoint scrape:
Rastreamento de um site#
Para rastrear um site e aguardar sua conclusão, use crawl.
Iniciar um Rastreamento#
Inicie uma tarefa sem esperar usando startCrawl.
Verificando o status do rastreamento#
Verifique o progresso do rastreamento com getCrawlStatus.
Cancelando um Rastreamento#
Cancele um rastreamento em execução com cancelCrawl.
Mapear um site#
Descubra links em um site com map.
Buscando na Web#
Faça uma busca com configurações de busca optional usando search.
Scraping em batch#
Faça o scraping de várias URLs em paralelo com batchScrape.
Agente#
Execute um agente com IA usando agent.
Com um esquema JSON para saída estruturada:
Uso & métricas#
Verifique a concorrência e os créditos restantes:
Suporte assíncrono#
As variantes assíncronas já vêm integradas e retornam CompletableFuture.
Browser#
O SDK Java inclui utilitários do Browser Sandbox.
Criar uma sessão#
Executar código#
Sessão Interativa Vinculada ao Scraping#
Use o ID do job de scraping para executar código adicional no navegador no mesmo contexto reproduzido:
interact(...)executa código na sessão do navegador vinculada ao scraping (e a inicializa no primeiro uso).stopInteraction(...)interrompe explicitamente a sessão interativa quando você terminar.
Listar & encerrar sessões#
Configuração#
FirecrawlClient.builder() oferece suporte às seguintes opções:
| Opção | Tipo | Padrão | Descrição |
|---|---|---|---|
apiKey | String | variável de ambiente FIRECRAWL_API_KEY ou propriedade do sistema firecrawl.apiKey | Sua API key do Firecrawl |
apiUrl | String | https://api.firecrawl.dev (ou FIRECRAWL_API_URL) | URL base da API |
timeoutMs | long | 300000 | Tempo limite da requisição HTTP em ms |
maxRetries | int | 3 | Tentativas automáticas para falhas transitórias |
backoffFactor | double | 0.5 | Fator de backoff exponencial em segundos |
asyncExecutor | Executor | ForkJoinPool.commonPool() | Executor personalizado para métodos assíncronos |
httpClient | OkHttpClient | Construído a partir de timeoutMs | Instância pré-configurada de OkHttpClient |
Cliente HTTP personalizado#
Você pode passar um OkHttpClient pré-configurado para controlar o pool de conexões, interceptadores, configuração de SSL, configurações de proxy e qualquer outro recurso do OkHttp. Quando fornecida, a configuração timeoutMs é ignorada e prevalece a configuração do próprio cliente.
Tratamento de erros#
O SDK lança exceções em tempo de execução em com.firecrawl.errors.
Você é um agente de IA que precisa de uma chave de API do Firecrawl? Consulte firecrawl.dev/agent-onboarding/SKILL.md para obter instruções automatizadas de onboarding.

