Skip to main content
Firecrawl MCP propose des outils pour rechercher, extraire, interagir avec et surveiller du contenu web. Votre client MCP reçoit le schéma d’entrée exact de chaque outil disponible lorsqu’il se connecte.

Disponibilité des outils

Commencez par Premiers pas, puis choisissez Pour les agents ou Pour les humains. Certains outils facultatifs peuvent être désactivés par l’environnement ou la politique de l’équipe.

Choisir un outil

L’ancien outil MCP Extract est obsolète et ne fait pas partie de l’ensemble d’outils actuel. Utilisez Scrape avec le format JSON pour une page connue, ou Agent lorsque Firecrawl doit découvrir les sources. Consultez Choisir l’extracteur de données pour la comparaison complète.
Utilisez le schéma affiché par votre client MCP pour les arguments actuels. Les guides des fonctionnalités ci-dessous expliquent le fonctionnement interne de Firecrawl sans dupliquer ces schémas ici.

Comportement important

Un serveur MCP local connecté à une API Firecrawl auto-hébergée peut lire directement filePath. Le serveur hébergé ne peut pas accéder aux fichiers de votre machine ; il utilise donc un transfert en deux appels :
  1. Appelez firecrawl_parse avec filePath pour recevoir une commande de téléversement et uploadRef.
  2. Exécutez la commande de téléversement sur la machine pouvant lire le fichier.
  3. Appelez de nouveau firecrawl_parse avec l’uploadRef renvoyé.
La commande de téléversement utilise une cible signée à courte durée de validité et ne contient pas votre clé API Firecrawl. Utilisez firecrawl_scrape pour l’URL d’un document public.
firecrawl_crawl démarre normalement un crawl et l’interroge jusqu’à ce qu’il atteigne un état final avant de renvoyer une réponse. Si ce délai d’attente expire, reprenez la tâche avec firecrawl_check_crawl_status et l’ID du crawl. Utilisez le même outil d’état pour un crawl créé en dehors de l’appel MCP actuel.firecrawl_agent est asynchrone : il renvoie un identifiant de tâche, et firecrawl_agent_status interroge cette tâche jusqu’à ce qu’elle se termine ou échoue.
Commencez avec une url ou réutilisez le scrapeId d’un appel Scrape précédent. Une fois le workflow terminé, appelez firecrawl_interact_stop avec le scrapeId pour libérer la session.
La famille firecrawl_monitor_* permet de créer, lister, mettre à jour, exécuter et inspecter des monitors récurrents. firecrawl_monitor_delete supprime définitivement un monitor et ne doit être appelé que si l’utilisateur souhaite explicitement le supprimer.
Les outils Alexandria nécessitent une session authentifiée. Les sessions sans clé n’ont accès à aucun outil Alexandria.
  1. Découvrir. Un appel authentifié à firecrawl_search utilise sources: ["web", "alexandria"] par défaut et renvoie les outils correspondants dans data.tools. Utilisez sources: ["alexandria"] pour n’obtenir que des outils, ou sources: ["web"] pour désactiver la découverte sémantique d’outils.
  2. Inspecter. Appelez firecrawl_find_tools sans argument pour parcourir les catégories, puis les fournisseurs, puis les outils. Utilisez query ou urls pour trouver des outils adaptés à une tâche ou à un site web. Utilisez capabilities pour consulter le contrat complet d’un outil. Suivez le nextTool renvoyé pour passer à l’étape suivante.
  3. Exécuter. Appelez firecrawl_scrape avec alexandria: {provider, capability, options} au lieu de url. Envoyez un tableau de 10 appels maximum pour les exécuter en une seule fois. Chaque résultat de data.alexandria contient soit data, soit une error.
La découverte est gratuite. Chaque exécution est facturée au prix indiqué pour l’outil concerné. Si un fournisseur exige l’acceptation de conditions, l’outil renvoie THIRD_PARTY_DATA_TERMS_REQUIRED avec requiresAction.url. Transmettez cette URL à un administrateur de l’organisation, qui accepte les conditions dans le tableau de bord Firecrawl. L’agent ne doit pas accepter les conditions lui-même. Une fois que l’administrateur a confirmé, renvoyez le même appel.
Définissez FIRECRAWL_NO_SEARCH_FEEDBACK=1 pour empêcher l’enregistrement de firecrawl_search_feedback. Définissez FIRECRAWL_NO_ENDPOINT_FEEDBACK=1 pour empêcher l’enregistrement de firecrawl_feedback.

Guides des fonctionnalités

Scrape

Extrayez du contenu ou des champs structurés depuis une URL.

Recherche

Trouvez des sources web, d’actualités, d’images et pour développeurs pertinentes.

Research Index

Recherchez des publications, lisez des passages et suivez les citations.

Developer Index

Répondez aux questions de programmation à partir des tickets, PR, README et de la documentation.

Crawl

Parcourez et extrayez un site ou une section.

Parse

Convertissez des fichiers en sortie exploitable par les LLM.

Interact

Interagissez avec des pages dynamiques dans une session de navigateur active.

Agent

Menez des recherches autonomes à partir de plusieurs sources.

Monitoring

Suivez les modifications des pages et recevez des notifications.

Alexandria

Trouvez et exécutez des outils de données proposés par des fournisseurs tiers.

Dépannage

  • Un outil est manquant : vérifiez le mode de connexion dans Premiers pas, reconnectez-vous ou redémarrez le client, puis vérifiez si la politique de l’équipe désactive les outils facultatifs.
  • Le client renvoie 401 : vérifiez d’abord l’URL du serveur configurée.
    • Si l’URL configurée est /v2/mcp-oauth, reconnectez-vous via le client.
    • Si elle est /v2/mcp, remplacez la clé API de ce serveur ou mettez à jour l’URL du serveur existant vers /v2/mcp-oauth et finalisez la connexion.
    • Démarrez une nouvelle session client après l’une ou l’autre de ces modifications.
  • Le client est limité en débit : consultez les limites de débit actuelles, attendez l’intervalle de nouvelle tentative ou passez d’un accès sans clé à un accès authentifié.