Skip to main content

Ruby

Le SDK Ruby de Firecrawl est une surcouche de l'API Firecrawl qui vous permet de convertir facilement des sites web en Markdown.
3 min read

Installation#

Le SDK Ruby officiel est maintenu dans le monorepo Firecrawl, dans apps/ruby-sdk.

Pour installer le SDK Ruby de Firecrawl, ajoutez-le à votre projet :

Ajoutez-le à votre Gemfile :

Puis exécutez :

Note
Ruby 3.0 ou version ultérieure requis.

Utilisation#

  1. Obtenez une clé API sur firecrawl.dev
  2. Définissez la clé API comme variable d’environnement nommée FIRECRAWL_API_KEY, ou passez-la directement avec Firecrawl::Client.new(api_key: ...)

Voici un exemple rapide avec l’API actuelle du SDK :

Scraping d’une URL#

Pour extraire le contenu d’une seule URL, utilisez la méthode scrape.

Extraction JSON#

Extrayez du JSON structuré via le point de terminaison scrape en ajoutant un format json, avec un prompt et un schéma :

Lancer un crawl sur un site web#

Pour lancer un crawl sur un site web et attendre son achèvement, utilisez crawl. Il interroge automatiquement l'état de la tâche jusqu'à ce qu'elle soit terminée.

Démarrer un crawl#

Démarrez une tâche sans attendre avec start_crawl.

Vérifier l’état du crawl#

Consultez la progression du crawl avec get_crawl_status.

Annuler un crawl#

Annulez un crawl en cours à l’aide de cancel_crawl.

Cartographier un site web#

Découvrez les liens d’un site avec map.

Recherche sur le Web#

Effectuez une recherche avec des paramètres facultatifs à l’aide de search.

Scraping par lots#

Scrapez plusieurs URL en parallèle à l’aide de batch_scrape.

Agent#

Exécutez un agent propulsé par l’IA avec agent.

À l’aide d’un schéma JSON pour une sortie structurée :

Utilisation & métriques#

Consultez la concurrence et les crédits restants :

Browser#

Le SDK Ruby inclut des fonctions utilitaires pour Browser Sandbox.

Session interactive liée à une tâche de scraping#

Utilisez l’ID d’une tâche de scraping pour exécuter du code supplémentaire dans le navigateur, dans le même contexte rejoué :

  • interact(...) exécute du code dans la session de navigateur liée au scraping (et l’initialise lors de la première utilisation).
  • stop_interactive_browser(...) arrête explicitement la session interactive lorsque vous avez terminé.

Configuration#

Firecrawl::Client.new accepte les options suivantes :

OptionTypePar défautDescription
api_keyStringvariable d’environnement FIRECRAWL_API_KEYVotre clé d’API Firecrawl
api_urlStringhttps://api.firecrawl.dev (ou FIRECRAWL_API_URL)URL de base de l’API
timeoutInteger300Délai d’attente de la requête HTTP, en secondes
max_retriesInteger3Tentatives automatiques en cas d’échecs temporaires
backoff_factorFloat0.5Facteur de backoff exponentiel, en secondes

Gestion des erreurs#

Le SDK lève des exceptions dans le module Firecrawl.

Vous êtes un agent IA et vous avez besoin d’une clé API Firecrawl ? Consultez firecrawl.dev/agent-onboarding/SKILL.md pour obtenir les instructions d’onboarding automatisé.