Skip to main content

Busca

Pesquise na web e obtenha o conteúdo completo dos resultados
8 min read

Pesquise na web e obtenha conteúdo limpo e estruturado de cada resultado em uma única chamada de API. Envie uma consulta para /search e o Firecrawl retorna títulos, descrições e URLs. Adicione scrapeOptions para também recuperar, para cada resultado, o markdown, HTML, links ou capturas de tela da página completa.

Os resultados de busca incluem Highlights relevantes para a consulta por padrão. Defina highlights como false quando quiser a descrição simples ou o snippet de cada site.

Para a lista completa de parâmetros, consulte a Referência da API do endpoint /search.

Experimente no Playground

Teste buscas no Playground interativo — sem precisar de código.

Fazendo uma pesquisa com o Firecrawl#

Usado para realizar pesquisas na web e, opcionalmente, obter conteúdo dos resultados.

Instalação#

Recompensa: 5.000 créditos por feedback sobre fontes governamentais e jurídicas

Para se qualificar, participe de uma entrevista com informações relevantes (casos de uso bem elaborados e concretos etc.) com nosso Assistente de Feedback do Firecrawl. Leva apenas alguns minutos, pode ser interrompida a qualquer momento e é adequada tanto para humanos quanto para agentes (basta colar o link no seu ambiente de execução agêntico!). É mais útil se você realiza buscas ou scraping em sites governamentais, judiciais, regulatórios ou de registros públicos e já enfrentou suas particularidades na prática.

Iniciar a entrevista

Inclua seu email para se qualificar. As entrevistas são avaliadas quanto à qualidade ao final de cada semana.

Uso básico#

Resposta#

Os SDKs retornam o objeto de dados diretamente. O cURL retorna o payload completo.

JSON
Note

Usuários de SDKs: os resultados de busca são agrupados por tipo de origem, não em um array genérico .data. Acesse os resultados da web com result.web, os de notícias com result.news e os de imagens com result.images.

Python
JavaScript

Tipos de resultados de busca#

Além dos resultados da web padrão, o Search oferece tipos de resultados especializados por meio do parâmetro sources:

  • web: resultados da web padrão (padrão)
  • news: resultados focados em notícias
  • images: resultados de busca de imagens

Você pode solicitar várias fontes em uma única chamada (por exemplo, sources: ["web", "news"]). Quando fizer isso, o parâmetro limit é aplicado por tipo de fonte — assim, limit: 5 com sources: ["web", "news"] retorna até 5 resultados da web e até 5 resultados de notícias (10 no total). Se você precisar de parâmetros diferentes por fonte (por exemplo, valores diferentes de limit ou scrapeOptions diferentes), faça chamadas separadas.

Categorias de busca#

Filtre os resultados de busca por categorias específicas usando o parâmetro categories:

  • research: Restrinja a busca na web a sites acadêmicos e de pesquisa (arxiv.org, nature.com, ieee.org, pubmed.ncbi.nlm.nih.gov, biorxiv.org, medrxiv.org e similares). Retorna resultados comuns de páginas da web com snippets — não registros de artigos. Para pesquisar os próprios artigos, use o Research Index
  • pdf: Pesquise por PDFs
  • developer: Pesquise no Índice para desenvolvedores — issues, pull requests mescladas e READMEs de repositórios públicos de código, além de sites de documentação selecionados
Note

research é um filtro de sites, não o índice de artigos. Ele restringe a busca comum na web a uma lista fixa de domínios acadêmicos e retorna snippets de páginas desses domínios.

Para pesquisar literatura científica — resumos completos, trechos de artigos e expansão do grafo de citações em um índice de artigos do PubMed, bioRxiv, medRxiv e arXiv — use o Research Index.

Restrinja a busca na web a sites acadêmicos e de pesquisa. A busca retorna páginas hospedadas nesses domínios — páginas de destino, páginas de resumo e páginas de editoras — com os snippets usuais:

cURL

Para buscar os próprios artigos, em vez dos sites que os hospedam, use o Research Index, que pesquisa resumos de artigos no PubMed, bioRxiv, medRxiv e arXiv e pode ler trechos de um artigo:

cURL

Pesquise no Índice para desenvolvedores fontes primárias sobre uma questão de programação:

cURL

Os resultados para desenvolvedores são retornados no grupo padrão web, cada um com category: "developer"; a categoria developer não pode ser combinada com outras categorias. Para obter resultados ranqueados com as passagens correspondentes e usar os filtros de repositório e fonte de documentação, use o endpoint de busca para desenvolvedores.

Combine várias categorias em uma única pesquisa:

cURL

Filtros de domínio#

Use includeDomains para restringir os resultados da busca a domínios específicos ou excludeDomains para remover domínios específicos da busca. Esses campos adicionam internamente os operadores site: e -site: à consulta, então informe apenas os domínios, sem protocolo nem caminho.

Note

includeDomains e excludeDomains são mutuamente exclusivos. Use um ou outro em uma única requisição.

Incluir domínios#

cURL

Domínios a excluir#

cURL

Formato de resposta de categoria#

Cada resultado de busca inclui um campo category indicando sua fonte:

Exemplos:

cURL
cURL

Pesquisa de imagens em alta definição com filtro por tamanho#

Use operadores de imagem para encontrar imagens em alta resolução:

cURL
cURL

Resoluções HD comuns:

  • imagesize:1920x1080 - Full HD (1080p)
  • imagesize:2560x1440 - QHD (1440p)
  • imagesize:3840x2160 - 4K UHD
  • larger:1920x1080 - HD ou superior
  • larger:2560x1440 - QHD ou superior

Busca com Coleta de Conteúdo#

Pesquise e recupere conteúdo dos resultados de busca em uma única operação.

Todas as opções do endpoint /scrape são compatíveis neste endpoint de busca por meio do parâmetro scrapeOptions.

Resposta com conteúdo extraído#

Buscar e depois fazer scraping (padrão de duas etapas)#

Se você precisar filtrar ou processar resultados de busca antes de fazer scraping, use uma abordagem em duas etapas: primeiro faça a busca e, depois, faça scraping das URLs que quiser.

Tip

Quando usar cada abordagem:

  • Uma etapa (scrapeOptions na busca): você quer o conteúdo de todos os resultados. É mais simples e mais rápido.
  • Duas etapas (buscar e depois fazer scraping): você quer filtrar, classificar ou fazer scraping seletivo dos resultados. É mais flexível.

As duas abordagens usam o Firecrawl na etapa de scraping. Não use requisições HTTP genéricas nem gere resumos apenas com base nos snippets da busca -- o conteúdo completo da página obtido pelo scraping do Firecrawl é o que torna os resultados mais embasados e completos.

Opções avançadas de busca#

A API de busca do Firecrawl oferece diversos parâmetros para personalizar suas buscas:

Personalização de localização#

Use o parâmetro tbs para filtrar resultados por período. Observe que tbs se aplica apenas a resultados da fonte web — ele não filtra resultados de news ou images. Se você precisar de notícias com filtro de tempo, considere usar a fonte web com o operador site: para direcionar domínios de notícias específicos.

Valores comuns de tbs:

  • qdr:h - Última hora
  • qdr:d - Últimas 24 horas
  • qdr:w - Última semana
  • qdr:m - Último mês
  • qdr:y - Último ano
  • sbd:1 - Ordenar por data (mais recentes primeiro)

Para um filtro temporal mais preciso, você pode especificar intervalos de datas exatos usando o formato de intervalo personalizado:

Você pode combinar sbd:1 com filtros de tempo para obter resultados ordenados por data dentro de um intervalo de tempo. Por exemplo, sbd:1,qdr:w retorna resultados da última semana ordenados do mais recente para o mais antigo, e sbd:1,cdr:1,cd_min:12/1/2024,cd_max:12/31/2024 retorna resultados de dezembro de 2024 ordenados por data.

Tempo limite personalizado#

Defina um tempo limite personalizado para operações de busca:

Defina safe como true para filtrar conteúdo explícito dos resultados de busca (SafeSearch). Quando omitido, os resultados são retornados sem filtragem, como antes.

cURL

Zero Data Retention (ZDR)#

Para equipes com requisitos rigorosos de tratamento de dados, a Firecrawl oferece opções de Zero Data Retention (ZDR) para o endpoint /search por meio do parâmetro enterprise. A busca com ZDR está disponível nos planos Enterprise — visite firecrawl.dev/enterprise para começar.

Note

Isso é diferente da opção de scraping zeroDataRetention, que controla o ZDR para operações de scraping. Consulte Scrape ZDR para mais detalhes. O parâmetro enterprise se aplica apenas à parte de busca da requisição.

ZDR de ponta a ponta#

Com o ZDR de ponta a ponta, tanto o Firecrawl quanto nosso provedor de busca upstream aplicam retenção zero de dados. Nenhum dado de consulta ou de resultado é armazenado em nenhum ponto do pipeline.

  • Custo: 10 créditos por 10 resultados
  • Parâmetro: enterprise: ["zdr"]
cURL

ZDR anonimizado#

Com o ZDR anonimizado, o Firecrawl aplica retenção zero total de dados do nosso lado. Nosso provedor de busca pode armazenar a consulta em cache, mas ela é totalmente anonimizada — nenhuma informação identificável é anexada.

  • Custo: 2 créditos por 10 resultados
  • Parâmetro: enterprise: ["anon"]
cURL

Combinando ZDR de busca com ZDR de scraping#

Se você estiver usando busca com scraping de conteúdo (scrapeOptions), o parâmetro enterprise aplica automaticamente ZDR a todos os scrapes resultantes. O exemplo de solicitação a seguir aplica ZDR às partes de busca e scraping do processo:

cURL

Implicações de custos#

O custo de uma busca é de 2 créditos por 10 resultados, arredondado para cima (1–10 resultados = 2 créditos, 11–20 = 4 créditos, e assim por diante). Se as opções de scraping estiverem ativadas, os custos padrão de scraping se aplicam a cada resultado de busca:

  • Basic scrape: 1 crédito por página da web
  • PDF parsing: 1 crédito por página de PDF
  • JSON mode: 4 créditos adicionais por página da web

Para ajudar a controlar os custos:

  • Defina parsers: [] se a análise de PDF não for necessária
  • Limite o número de resultados de busca com o parâmetro limit

Opções avançadas de scraping#

Para mais detalhes sobre as opções de scraping, consulte a documentação do recurso Scrape. Tudo, exceto o Agente FIRE-1 e os recursos de rastreamento de alterações, é compatível com este endpoint de busca.

Você é um agente de IA que precisa de uma chave de API da Firecrawl? Consulte firecrawl.dev/agent-onboarding/SKILL.md para obter instruções de onboarding automatizado.

Feedback sobre busca#

Quando um resultado de busca é útil ou deixa de fora conteúdo importante, envie feedback com POST /v2/search/{jobId}/feedback. O primeiro envio de feedback para um job de busca pode reembolsar 1 crédito, sujeito aos limites da equipe, e ajuda a melhorar a qualidade da busca do Firecrawl. Consulte Feedback sobre busca.