Skip to main content

Elixir

Le SDK Elixir de Firecrawl est un client auto-généré pour l’API v2 de Firecrawl, conçu avec Req et NimbleOptions.
4 min read

Scrapez des pages individuelles, effectuez le crawl de sites entiers et la cartographie d’URL depuis votre application Elixir. Le SDK valide tous les paramètres à l’exécution avec NimbleOptions et utilise Req pour les requêtes HTTP, afin que vous obteniez des erreurs claires en cas de faute de frappe ou d’option invalide avant même qu’une requête ne soit envoyée.

Chaque fonction dispose d’une variante bang (!) qui lève une exception au lieu de renvoyer des tuples {:error, ...}.

Installation#

Ajoutez firecrawl à votre liste de dépendances dans mix.exs et configurez votre clé API :

Elixir

Ou transmettez la clé API à chaque requête :

Elixir

Utilisation#

  1. Obtenez une clé API sur firecrawl.dev
  2. Définissez la clé API dans la configuration de votre application ou passez-la en option à n’importe quelle fonction.
Elixir

Scraper une URL#

Scrapez une seule URL avec scrape_and_extract_from_url. Cette fonction renvoie le contenu de la page sous forme de données structurées, y compris le markdown, les métadonnées et tous les autres formats demandés.

Elixir

Effectuer le crawl d’un site web#

Pour effectuer le crawl d’un site web, utilisez crawl_urls. Cette méthode prend l’URL de départ ainsi que des paramètres facultatifs, tels que la limite de pages, les domaines autorisés et le format de sortie.

Elixir

Démarrer un crawl#

Démarrez une tâche de crawl et obtenez l’ID de tâche sans bloquer :

Elixir

Vérifier l’état d’un crawl#

Vérifiez l’état d’une tâche de crawl avec get_crawl_status :

Elixir

Annuler un crawl#

Annulez une tâche de crawl avec cancel_crawl :

Elixir

Cartographier un site web#

Utilisez map_urls pour générer une liste d’URL d’un site web :

Elixir

Recherchez sur le web et scrapez éventuellement les résultats :

Elixir

Extraction par lot#

Extrayez plusieurs URL en un seul lot :

Elixir

Agent#

Démarrez une tâche d’extraction de données pilotée par un agent :

Elixir

Browser#

Démarrez des sessions de navigateur dans le cloud et exécutez du code à distance.

Créer une session#

Elixir

Exécuter du code#

Elixir

Profils#

Enregistrez et réutilisez l’état du navigateur (cookies, localStorage, etc.) d’une session à l’autre :

Elixir

Lister & fermer des sessions#

Elixir

Instances autohébergées#

Pour utiliser une instance autohébergée de Firecrawl, passez l’option base_url :

Elixir

Gestion des erreurs#

Les fonctions sans bang renvoient {:ok, response} ou {:error, exception}. Les variantes bang déclenchent une exception en cas d’erreur. NimbleOptions valide tous les paramètres avant l’envoi de la requête, ce qui permet de détecter immédiatement les fautes de frappe, les champs obligatoires manquants et les erreurs de type.

Elixir

Toutes les fonctions disponibles#

FonctionDescription
scrape_and_extract_from_urlScraper une seule URL
scrape_and_extract_from_urlsEffectuer une extraction par lot de plusieurs URL
crawl_urlsEffectuer le crawl d’un site web
get_crawl_statusVérifier l’état d’une tâche de crawl
get_crawl_errorsObtenir les erreurs d’une tâche de crawl
get_active_crawlsLister les crawls actifs
cancel_crawlAnnuler une tâche de crawl
map_urlsCartographier les URL d’un site web
search_and_scrapeRechercher et scraper les résultats
start_agentDémarrer une tâche d’extraction avec un agent
get_agent_statusVérifier l’état d’une tâche d’agent
cancel_agentAnnuler une tâche d’agent
create_browser_sessionCréer une session de navigateur
execute_browser_codeExécuter du code dans une session de navigateur
list_browser_sessionsLister les sessions de navigateur
delete_browser_sessionSupprimer une session de navigateur
get_batch_scrape_statusVérifier l’état d’une extraction par lot
get_batch_scrape_errorsObtenir les erreurs d’une extraction par lot
cancel_batch_scrapeAnnuler une extraction par lot
get_credit_usageObtenir les crédits restants

Chaque fonction ci-dessus possède une variante avec bang (!) (par exemple, scrape_and_extract_from_url!) qui lève une erreur au lieu de renvoyer des tuples d’erreur.

Pour la documentation complète de l’API, consultez hexdocs.pm/firecrawl.