Skip to main content

Recherche

Recherchez sur le web et obtenez le contenu complet des résultats
8 min read

Recherchez sur le web et obtenez un contenu propre et structuré pour chaque résultat en un seul appel d’API. Transmettez une requête à /search et Firecrawl renvoie les titres, les descriptions et les URL. Ajoutez scrapeOptions pour récupérer également, pour chaque résultat, le markdown de la page complète, le HTML, les liens ou les captures d’écran.

Les résultats de recherche incluent par défaut des Highlights pertinents par rapport à la requête. Définissez highlights sur false si vous souhaitez plutôt la description simple ou l’extrait de chaque site web.

Pour la liste complète des paramètres, consultez la référence de l’API du point de terminaison de recherche.

Essayez-le dans le Playground

Testez la recherche dans le Playground interactif — aucun code nécessaire.

Effectuer une recherche avec Firecrawl#

Permet d’effectuer des recherches sur le web et, en option, de récupérer le contenu des résultats.

Installation#

Prime : récompense de 5 000 crédits pour vos retours sur les sources gouvernementales et juridiques

Pour être éligible, participez à un entretien pertinent (cas d'utilisation concrets et réfléchis, etc.) avec notre assistant de retours Firecrawl. Cela ne prend que quelques minutes, peut être interrompu à tout moment et convient aussi bien aux humains qu'aux agents (il suffit de coller le lien dans votre harness agentique !). Cet entretien est particulièrement utile si vous effectuez des recherches ou du scraping sur des sites gouvernementaux, judiciaires, réglementaires ou d'archives publiques, et si vous avez déjà été confronté à leurs particularités.

Démarrer l'entretien

Indiquez votre e-mail pour être éligible. Les entretiens sont évalués chaque fin de semaine.

Utilisation de base#

Réponse#

Les SDKs renvoient directement l’objet de données. cURL renvoie le payload complet.

JSON
Note

Utilisateurs des SDKs : les résultats de recherche sont regroupés par type de source, et non dans un tableau .data générique. Accédez aux résultats web avec result.web, aux actualités avec result.news et aux images avec result.images.

Python
JavaScript

Types de résultats de recherche#

En plus des résultats web classiques, Search prend en charge des types de résultats spécialisés via le paramètre sources :

  • web : résultats web standard (par défaut)
  • news : résultats axés sur l’actualité
  • images : résultats de recherche d’images

Vous pouvez demander plusieurs sources dans un seul appel (par exemple, sources: ["web", "news"]). Dans ce cas, le paramètre limit s’applique par type de source — ainsi, limit: 5 avec sources: ["web", "news"] renvoie jusqu’à 5 résultats web et jusqu’à 5 résultats d’actualité (10 au total). Si vous avez besoin de paramètres différents par source (par exemple, des valeurs limit différentes ou des scrapeOptions différentes), effectuez plutôt des appels séparés.

Catégories de recherche#

Filtrez les résultats de recherche par catégorie à l’aide du paramètre categories :

  • research : limitez la recherche web aux sites web académiques et de recherche (arxiv.org, nature.com, ieee.org, pubmed.ncbi.nlm.nih.gov, biorxiv.org, medrxiv.org et sites similaires). Renvoie des résultats de pages web classiques avec des snippets — et non des fiches d’articles. Pour rechercher les articles eux-mêmes, utilisez le Research Index
  • pdf : recherchez des PDF
  • developer : recherchez dans le Developer Index — tickets, pull requests fusionnées et README de dépôts de code publics, ainsi que des sites de documentation sélectionnés
Note

research est un filtre de sites web, et non l’index d’articles. Il restreint la recherche web classique à une liste fixe de domaines académiques et renvoie les snippets des pages correspondantes.

Pour rechercher la littérature scientifique — résumés complets, lecture de passages dans les articles et exploration du graphe de citations à partir d’un index d’articles de PubMed, bioRxiv, medRxiv et arXiv — utilisez plutôt le Research Index.

Limitez la recherche web aux sites académiques et de recherche. Cette opération renvoie des pages web hébergées sur ces domaines — pages d’accueil, pages de résumé, pages d’éditeurs — avec les snippets habituels :

cURL

Pour effectuer des recherches dans les publications elles-mêmes plutôt que sur les sites web qui les hébergent, utilisez le Research Index, qui recherche dans les résumés de publications sur PubMed, bioRxiv, medRxiv et arXiv, et peut lire des passages au sein d’une publication :

cURL

Recherchez dans le Developer Index des sources primaires pour répondre à une question de programmation :

cURL

Les résultats pour développeurs sont renvoyés dans le groupe web standard, chacun avec la valeur category: "developer" ; la catégorie developer ne peut pas être combinée avec d’autres catégories. Pour obtenir des résultats classés avec les passages correspondants, ainsi que pour utiliser les filtres par référentiel et par source de documentation, utilisez le point de terminaison de recherche pour développeurs.

Combinez plusieurs catégories dans une seule recherche :

cURL

Filtres de domaines#

Utilisez includeDomains pour limiter les résultats de recherche à des domaines spécifiques, ou excludeDomains pour exclure certains domaines de la recherche. Ces champs ajoutent en interne les opérateurs site: et -site: à la requête ; indiquez donc uniquement les domaines, sans protocole ni chemin.

Note

includeDomains et excludeDomains sont mutuellement exclusifs. Utilisez l'un ou l'autre dans une même requête.

Domaines à inclure#

cURL

Domaines à exclure#

cURL

Format de réponse par catégorie#

Chaque résultat de recherche comporte un champ category indiquant sa source :

Exemples :

cURL
cURL

Recherche d’images HD avec filtre de taille#

Utilisez les opérateurs de recherche d’images pour trouver des images en haute résolution :

cURL
cURL

Résolutions HD courantes :

  • imagesize:1920x1080 - Full HD (1080p)
  • imagesize:2560x1440 - QHD (1440p)
  • imagesize:3840x2160 - 4K UHD
  • larger:1920x1080 - HD et supérieur
  • larger:2560x1440 - QHD et supérieur

Recherche avec extraction de contenu#

Recherchez et récupérez le contenu des résultats de recherche en une seule opération.

Toutes les options du point de terminaison /scrape sont prises en charge par ce point de terminaison de recherche via le paramètre scrapeOptions.

Réponse avec contenu extrait#

Recherche puis scraping (schéma en deux étapes)#

Si vous devez filtrer ou traiter les résultats de recherche avant le scraping, utilisez une approche en deux étapes : lancez d’abord une recherche, puis scrapez les URL souhaitées.

Tip

Quand utiliser chaque approche :

  • En une étape (scrapeOptions dans la recherche) : vous voulez récupérer le contenu de tous les résultats. Plus simple et plus rapide.
  • En deux étapes (recherche puis scraping) : vous voulez filtrer, classer ou scraper certains résultats de façon sélective. Plus flexible.

Les deux approches utilisent Firecrawl pour l’étape de scrape. N’utilisez pas une récupération HTTP générique et ne vous contentez pas de résumer à partir des seuls extraits de recherche -- c’est le contenu complet de la page obtenu avec le scrape Firecrawl qui rend les résultats fiables et complets.

Options de recherche avancées#

L’API de recherche de Firecrawl prend en charge plusieurs paramètres pour personnaliser votre recherche :

Personnalisation de la localisation#

Utilisez le paramètre tbs pour filtrer les résultats par période. Notez que tbs s’applique uniquement aux résultats de la source web — il ne filtre pas les résultats news ou images. Si vous avez besoin d’actualités filtrées par période, envisagez d’utiliser une source web avec l’opérateur site: pour cibler des domaines d’actualités spécifiques.

Valeurs tbs courantes :

  • qdr:h - Dernière heure
  • qdr:d - Dernières 24 heures
  • qdr:w - Dernière semaine
  • qdr:m - Dernier mois
  • qdr:y - Dernière année
  • sbd:1 - Trier par date (du plus récent au plus ancien)

Pour un filtrage temporel plus précis, vous pouvez spécifier des plages de dates exactes à l’aide du format personnalisé de plage de dates :

Vous pouvez combiner sbd:1 avec des filtres temporels pour obtenir des résultats triés par date dans une plage donnée. Par exemple, sbd:1,qdr:w renvoie les résultats de la dernière semaine, triés du plus récent au plus ancien, et sbd:1,cdr:1,cd_min:12/1/2024,cd_max:12/31/2024 renvoie les résultats de décembre 2024 triés par date.

Délai d’attente personnalisé#

Définissez un délai d’attente personnalisé pour les opérations de recherche :

Définissez safe sur true pour filtrer le contenu explicite des résultats de recherche (SafeSearch). S'il n'est pas renseigné, les résultats sont renvoyés sans filtrage, comme auparavant.

cURL

Zero Data Retention (ZDR)#

Pour les équipes ayant des exigences strictes en matière de traitement des données, Firecrawl propose des options Zero Data Retention (ZDR) pour le point de terminaison /search via le paramètre enterprise. La recherche ZDR est disponible avec les offres Enterprise — rendez-vous sur firecrawl.dev/enterprise pour démarrer.

Note

Ceci est distinct de l’option de scrape zeroDataRetention, qui contrôle le ZDR pour les opérations de scraping. Consultez Scrape ZDR pour plus de détails. Le paramètre enterprise s’applique uniquement à la partie recherche de la requête.

ZDR de bout en bout#

Avec le ZDR de bout en bout, Firecrawl et notre fournisseur de recherche en amont appliquent tous deux une politique de rétention zéro des données. Aucune donnée de requête ni de résultat n’est stockée à aucun moment du pipeline.

  • Coût : 10 crédits pour 10 résultats
  • Paramètre : enterprise: ["zdr"]
cURL

ZDR anonymisé#

Avec le ZDR anonymisé, Firecrawl applique une politique complète de rétention zéro des données de notre côté. Notre fournisseur de recherche peut mettre la requête en cache, mais elle est entièrement anonymisée — aucune information permettant de vous identifier n’y est associée.

  • Coût : 2 crédits pour 10 résultats
  • Paramètre : enterprise: ["anon"]
cURL

Combiner la recherche ZDR avec Scrape ZDR#

Si vous utilisez la recherche avec du scraping de contenu (scrapeOptions), le paramètre enterprise applique automatiquement le ZDR à tous les scrapings qui en résultent. L’exemple de requête suivant applique le ZDR aux parties recherche et scraping du processus :

cURL

Impact sur les coûts#

Le coût d’une recherche est de 2 crédits pour 10 résultats de recherche, arrondi à l’unité supérieure (1 à 10 résultats = 2 crédits, 11 à 20 = 4 crédits, et ainsi de suite). Si les options de scraping sont activées, les coûts de scraping standard s’appliquent à chaque résultat de recherche :

  • Basic scrape : 1 crédit par page web
  • PDF parsing : 1 crédit par page PDF
  • mode JSON : 4 crédits supplémentaires par page web

Pour aider à contrôler les coûts :

  • Définissez parsers: [] si l’analyse de PDF n’est pas nécessaire
  • Limitez le nombre de résultats de recherche avec le paramètre limit

Options de scraping avancées#

Pour plus de détails sur les options de scraping, consultez la documentation de la fonctionnalité Scrape. Toutes les fonctionnalités, à l’exception de l’agent FIRE-1 et du suivi des modifications, sont prises en charge par ce point de terminaison de recherche.

Êtes-vous un agent IA qui a besoin d’une clé API Firecrawl ? Consultez firecrawl.dev/agent-onboarding/SKILL.md pour obtenir des instructions d’intégration automatisée.

Commentaires sur la recherche#

Lorsqu’un résultat de recherche est utile ou omet un contenu important, envoyez vos commentaires avec POST /v2/search/{jobId}/feedback. Le premier envoi de commentaires pour un job de recherche peut donner lieu au remboursement d’1 crédit, sous réserve des limites de l’équipe, et contribue à améliorer la qualité de la recherche de Firecrawl. Voir Search Feedback.