Firecrawl MCP propose des outils pour rechercher, extraire, interagir avec et surveiller du contenu web. Votre client MCP reçoit le schéma d’entrée exact de chaque outil disponible lorsqu’il se connecte.
Disponibilité des outils#
| Mode de connexion | Outils disponibles |
|---|---|
| OAuth hébergé | Ensemble complet d’outils, sous réserve de l’offre et de la politique de l’équipe |
| Clé API hébergée | Ensemble complet d’outils, sous réserve de l’offre et de la politique de l’équipe |
| Mode hébergé sans clé | firecrawl_search, firecrawl_scrape et firecrawl_parse |
| Local avec l’API cloud Firecrawl | Outils basés sur l’API ; le Parse direct de fichiers locaux n’est pas disponible |
| Local avec une API Firecrawl auto-hébergée | Outils pris en charge par les services activés dans ce déploiement |
Commencez par Premiers pas, puis choisissez Pour les agents ou Pour les humains. Certains outils facultatifs peuvent être désactivés par l’environnement ou la politique de l’équipe.
Choisir un outil#
| Tâche | Outil | À utiliser lorsque |
|---|---|---|
| Lire une page | firecrawl_scrape | Vous connaissez l’URL et avez besoin du contenu de la page ou de champs structurés. |
| Extraire des données structurées | firecrawl_scrape avec le format JSON | Vous avez l’URL et souhaitez des données correspondant à un prompt ou à un schéma JSON. |
| Découvrir les URL d’un site | firecrawl_map | Vous devez trouver des pages avant de décider quoi extraire. |
| Recherche sur le web | firecrawl_search | Vous avez une requête plutôt qu’une URL connue. |
| Parse un fichier | firecrawl_parse | Vous avez besoin du contenu d’un fichier PDF, d’un document, d’une feuille de calcul ou d’un fichier HTML. |
| Extraire de nombreuses pages | firecrawl_crawl and firecrawl_check_crawl_status | Vous devez parcourir un site ou une section. L’outil de crawl interroge la tâche jusqu’à ce qu’elle atteigne un état final avant de renvoyer le résultat. |
| Effectuer une recherche autonome | firecrawl_agent and firecrawl_agent_status | La tâche couvre plusieurs sources et les pages exactes ne sont pas connues. |
| Interagir avec une page en direct | firecrawl_interact and firecrawl_interact_stop | Vous avez besoin de clics, de remplissage de formulaires, de navigation ou d’extraction de pages dynamiques. |
| Rechercher la littérature scientifique | firecrawl_research_* | Vous devez trouver des publications, lire des passages de l’une d’elles ou suivre les citations. Effectue des recherches dans le Research Index des résumés de publications de PubMed, bioRxiv, medRxiv et arXiv. |
| Répondre à une question de programmation | firecrawl_developer_search | Vous avez besoin de réponses provenant de sources primaires, notamment de tickets, de pull requests fusionnées, de README et de documentation sélectionnée. |
| Surveiller les changements | firecrawl_monitor_* | Vous avez besoin de vérifications récurrentes, de diffs et de notifications par webhook ou e-mail. |
| Envoyer un retour sur le produit | firecrawl_search_feedback and firecrawl_feedback | Vous souhaitez évaluer les résultats de recherche ou signaler la qualité d’un point de terminaison. |
L’ancien outil MCP Extract est obsolète et ne fait pas partie de l’ensemble d’outils actuel. Utilisez Scrape avec le format JSON pour une page connue, ou Agent lorsque Firecrawl doit découvrir les sources. Consultez Choisir l’extracteur de données pour la comparaison complète.
Utilisez le schéma affiché par votre client MCP pour les arguments actuels. Les guides des fonctionnalités ci-dessous expliquent le fonctionnement interne de Firecrawl sans dupliquer ces schémas ici.
Comportement important#
Parse un fichier local
Un serveur MCP local connecté à une API Firecrawl auto-hébergée peut lire directement filePath. Le serveur hébergé ne peut pas accéder aux fichiers de votre machine ; il utilise donc un transfert en deux appels :
- Appelez
firecrawl_parseavecfilePathpour recevoir une commande de téléversement etuploadRef. - Exécutez la commande de téléversement sur la machine pouvant lire le fichier.
- Appelez de nouveau
firecrawl_parseavec l’uploadRefrenvoyé.
La commande de téléversement utilise une cible signée à courte durée de validité et ne contient pas votre clé API Firecrawl. Utilisez firecrawl_scrape pour l’URL d’un document public.
Vérifier un crawl en cours
firecrawl_crawl démarre normalement un crawl et l’interroge jusqu’à ce qu’il atteigne un état final avant de renvoyer une réponse. Si ce délai d’attente expire, reprenez la tâche avec firecrawl_check_crawl_status et l’ID du crawl. Utilisez le même outil d’état pour un crawl créé en dehors de l’appel MCP actuel.
firecrawl_agent est asynchrone : il renvoie un identifiant de tâche, et firecrawl_agent_status interroge cette tâche jusqu’à ce qu’elle se termine ou échoue.
Fermer les sessions Interact
Commencez avec une url ou réutilisez le scrapeId d’un appel Scrape précédent. Une fois le workflow terminé, appelez firecrawl_interact_stop avec le scrapeId pour libérer la session.
Gérer les monitors en toute sécurité
La famille firecrawl_monitor_* permet de créer, lister, mettre à jour, exécuter et inspecter des monitors récurrents. firecrawl_monitor_delete supprime définitivement un monitor et ne doit être appelé que si l’utilisateur souhaite explicitement le supprimer.
Activer les outils de retour facultatifs
Définissez FIRECRAWL_NO_SEARCH_FEEDBACK=1 pour empêcher l’enregistrement de firecrawl_search_feedback. Définissez FIRECRAWL_NO_ENDPOINT_FEEDBACK=1 pour empêcher l’enregistrement de firecrawl_feedback.
Guides des fonctionnalités#
Extrayez du contenu ou des champs structurés depuis une URL.
Trouvez des sources web, d'actualités, d'images et pour développeurs pertinentes.
Recherchez des publications, lisez des passages et suivez les citations.
Répondez aux questions de programmation à partir des tickets, PR, README et de la documentation.
Parcourez et extrayez un site ou une section.
Convertissez des fichiers en sortie exploitable par les LLM.
Interagissez avec des pages dynamiques dans une session de navigateur active.
Menez des recherches autonomes à partir de plusieurs sources.
Suivez les modifications des pages et recevez des notifications.
Dépannage#
- Un outil est manquant : vérifiez le mode de connexion dans Premiers pas, reconnectez-vous ou redémarrez le client, puis vérifiez si la politique de l’équipe désactive les outils facultatifs.
- Le client renvoie
401: vérifiez d’abord l’URL du serveur configurée.- Si l’URL configurée est
/v2/mcp-oauth, reconnectez-vous via le client. - Si elle est
/v2/mcp, remplacez la clé API de ce serveur ou mettez à jour l’URL du serveur existant vers/v2/mcp-oauthet finalisez la connexion. - Démarrez une nouvelle session client après l’une ou l’autre de ces modifications.
- Si l’URL configurée est
- Le client est limité en débit : consultez les limites de débit actuelles, attendez l’intervalle de nouvelle tentative ou passez d’un accès sans clé à un accès authentifié.

