Skip to main content

Outils Firecrawl MCP

Choisissez un outil Firecrawl MCP et découvrez sa disponibilité et son fonctionnement.
5 min read

Firecrawl MCP propose des outils pour rechercher, extraire, interagir avec et surveiller du contenu web. Votre client MCP reçoit le schéma d’entrée exact de chaque outil disponible lorsqu’il se connecte.

Disponibilité des outils#

Mode de connexionOutils disponibles
OAuth hébergéEnsemble complet d’outils, sous réserve de l’offre et de la politique de l’équipe
Clé API hébergéeEnsemble complet d’outils, sous réserve de l’offre et de la politique de l’équipe
Mode hébergé sans cléfirecrawl_search, firecrawl_scrape et firecrawl_parse
Local avec l’API cloud FirecrawlOutils basés sur l’API ; le Parse direct de fichiers locaux n’est pas disponible
Local avec une API Firecrawl auto-hébergéeOutils pris en charge par les services activés dans ce déploiement

Commencez par Premiers pas, puis choisissez Pour les agents ou Pour les humains. Certains outils facultatifs peuvent être désactivés par l’environnement ou la politique de l’équipe.

Choisir un outil#

TâcheOutilÀ utiliser lorsque
Lire une pagefirecrawl_scrapeVous connaissez l’URL et avez besoin du contenu de la page ou de champs structurés.
Extraire des données structuréesfirecrawl_scrape avec le format JSONVous avez l’URL et souhaitez des données correspondant à un prompt ou à un schéma JSON.
Découvrir les URL d’un sitefirecrawl_mapVous devez trouver des pages avant de décider quoi extraire.
Recherche sur le webfirecrawl_searchVous avez une requête plutôt qu’une URL connue.
Parse un fichierfirecrawl_parseVous avez besoin du contenu d’un fichier PDF, d’un document, d’une feuille de calcul ou d’un fichier HTML.
Extraire de nombreuses pagesfirecrawl_crawl and firecrawl_check_crawl_statusVous devez parcourir un site ou une section. L’outil de crawl interroge la tâche jusqu’à ce qu’elle atteigne un état final avant de renvoyer le résultat.
Effectuer une recherche autonomefirecrawl_agent and firecrawl_agent_statusLa tâche couvre plusieurs sources et les pages exactes ne sont pas connues.
Interagir avec une page en directfirecrawl_interact and firecrawl_interact_stopVous avez besoin de clics, de remplissage de formulaires, de navigation ou d’extraction de pages dynamiques.
Rechercher la littérature scientifiquefirecrawl_research_*Vous devez trouver des publications, lire des passages de l’une d’elles ou suivre les citations. Effectue des recherches dans le Research Index des résumés de publications de PubMed, bioRxiv, medRxiv et arXiv.
Répondre à une question de programmationfirecrawl_developer_searchVous avez besoin de réponses provenant de sources primaires, notamment de tickets, de pull requests fusionnées, de README et de documentation sélectionnée.
Surveiller les changementsfirecrawl_monitor_*Vous avez besoin de vérifications récurrentes, de diffs et de notifications par webhook ou e-mail.
Envoyer un retour sur le produitfirecrawl_search_feedback and firecrawl_feedbackVous souhaitez évaluer les résultats de recherche ou signaler la qualité d’un point de terminaison.
Note

L’ancien outil MCP Extract est obsolète et ne fait pas partie de l’ensemble d’outils actuel. Utilisez Scrape avec le format JSON pour une page connue, ou Agent lorsque Firecrawl doit découvrir les sources. Consultez Choisir l’extracteur de données pour la comparaison complète.

Tip

Utilisez le schéma affiché par votre client MCP pour les arguments actuels. Les guides des fonctionnalités ci-dessous expliquent le fonctionnement interne de Firecrawl sans dupliquer ces schémas ici.

Comportement important#

Parse un fichier local

Un serveur MCP local connecté à une API Firecrawl auto-hébergée peut lire directement filePath. Le serveur hébergé ne peut pas accéder aux fichiers de votre machine ; il utilise donc un transfert en deux appels :

  1. Appelez firecrawl_parse avec filePath pour recevoir une commande de téléversement et uploadRef.
  2. Exécutez la commande de téléversement sur la machine pouvant lire le fichier.
  3. Appelez de nouveau firecrawl_parse avec l’uploadRef renvoyé.

La commande de téléversement utilise une cible signée à courte durée de validité et ne contient pas votre clé API Firecrawl. Utilisez firecrawl_scrape pour l’URL d’un document public.

Vérifier un crawl en cours

firecrawl_crawl démarre normalement un crawl et l’interroge jusqu’à ce qu’il atteigne un état final avant de renvoyer une réponse. Si ce délai d’attente expire, reprenez la tâche avec firecrawl_check_crawl_status et l’ID du crawl. Utilisez le même outil d’état pour un crawl créé en dehors de l’appel MCP actuel.

firecrawl_agent est asynchrone : il renvoie un identifiant de tâche, et firecrawl_agent_status interroge cette tâche jusqu’à ce qu’elle se termine ou échoue.

Fermer les sessions Interact

Commencez avec une url ou réutilisez le scrapeId d’un appel Scrape précédent. Une fois le workflow terminé, appelez firecrawl_interact_stop avec le scrapeId pour libérer la session.

Gérer les monitors en toute sécurité

La famille firecrawl_monitor_* permet de créer, lister, mettre à jour, exécuter et inspecter des monitors récurrents. firecrawl_monitor_delete supprime définitivement un monitor et ne doit être appelé que si l’utilisateur souhaite explicitement le supprimer.

Activer les outils de retour facultatifs

Définissez FIRECRAWL_NO_SEARCH_FEEDBACK=1 pour empêcher l’enregistrement de firecrawl_search_feedback. Définissez FIRECRAWL_NO_ENDPOINT_FEEDBACK=1 pour empêcher l’enregistrement de firecrawl_feedback.

Guides des fonctionnalités#

Dépannage#

  • Un outil est manquant : vérifiez le mode de connexion dans Premiers pas, reconnectez-vous ou redémarrez le client, puis vérifiez si la politique de l’équipe désactive les outils facultatifs.
  • Le client renvoie 401 : vérifiez d’abord l’URL du serveur configurée.
    • Si l’URL configurée est /v2/mcp-oauth, reconnectez-vous via le client.
    • Si elle est /v2/mcp, remplacez la clé API de ce serveur ou mettez à jour l’URL du serveur existant vers /v2/mcp-oauth et finalisez la connexion.
    • Démarrez une nouvelle session client après l’une ou l’autre de ces modifications.
  • Le client est limité en débit : consultez les limites de débit actuelles, attendez l’intervalle de nouvelle tentative ou passez d’un accès sans clé à un accès authentifié.