Skip to main content

Elixir

El SDK de Firecrawl para Elixir es un cliente autogenerado para la API v2 de Firecrawl, desarrollado con Req y NimbleOptions.
3 min read

Haz scraping de páginas individuales, rastrea sitios completos y mapea URL desde tu aplicación de Elixir. El SDK valida todos los parámetros en tiempo de ejecución con NimbleOptions y usa Req para HTTP, así que obtienes errores claros por errores tipográficos y opciones no válidas antes de realizar cualquier solicitud.

Cada función tiene una variante con bang (!) que lanza una excepción en lugar de devolver tuplas {:error, ...}.

Instalación#

Añade firecrawl a tu lista de dependencias en mix.exs y configura tu clave de API:

Elixir

O pasa la clave de API en cada solicitud:

Elixir

Uso#

  1. Obtén una clave de API en firecrawl.dev
  2. Configura la clave de API en tu aplicación o pásala como opción a cualquier función.
Elixir

Scraping de una URL#

Haz scraping de una URL con scrape_and_extract_from_url. Devuelve el contenido de la página como datos estructurados, incluidos markdown, metadatos y cualquier otro formato que solicites.

Elixir

Rastrear un sitio web#

Para rastrear un sitio web, usa crawl_urls. Recibe la URL inicial y parámetros opcionales, como el límite de páginas, los dominios permitidos y el formato de salida.

Elixir

Iniciar un rastreo#

Inicia un trabajo de rastreo y devuelve el ID del trabajo sin bloquear:

Elixir

Consultar el estado de un rastreo#

Consulta el estado de un trabajo de rastreo con get_crawl_status:

Elixir

Cancelar un rastreo#

Cancela un trabajo de rastreo con cancel_crawl:

Elixir

Mapea un sitio web#

Usa map_urls para generar una lista de URL de un sitio web:

Elixir

Busca en la web y, opcionalmente, haz scraping de los resultados:

Elixir

Extracción por lotes#

Haz scraping de varias URL en un único trabajo por lotes:

Elixir

Agent#

Inicia una tarea de extracción de datos con agentes:

Elixir

Browser#

Inicia sesiones de navegador en la nube y ejecuta código de forma remota.

Crear una sesión#

Elixir

Ejecutar código#

Elixir

Perfiles#

Guarda y reutiliza el estado del navegador (cookies, localStorage, etc.) entre sesiones:

Elixir

Listar & cerrar sesiones#

Elixir

Instancias autogestionadas#

Para usar una instancia autogestionada de Firecrawl, pasa la opción base_url:

Elixir

Manejo de errores#

Las funciones sin bang devuelven {:ok, response} o {:error, exception}. Las variantes con bang lanzan una excepción en caso de error. NimbleOptions valida todos los parámetros antes de enviar la solicitud, detectando de inmediato errores tipográficos, campos obligatorios ausentes y errores de tipo.

Elixir

Todas las funciones disponibles#

FunciónDescripción
scrape_and_extract_from_urlHace scraping de una sola URL
scrape_and_extract_from_urlsRealiza una extracción por lotes de varias URL
crawl_urlsRastrea un sitio web
get_crawl_statusComprueba el estado del trabajo de rastreo
get_crawl_errorsObtiene los errores del trabajo de rastreo
get_active_crawlsLista los rastreos activos
cancel_crawlCancela un trabajo de rastreo
map_urlsMapea las URL de un sitio web
search_and_scrapeBusca y hace scraping de los resultados
start_agentInicia una tarea de extracción con agente
get_agent_statusComprueba el estado del trabajo del agente
cancel_agentCancela un trabajo del agente
create_browser_sessionCrea una sesión del navegador
execute_browser_codeEjecuta código en una sesión del navegador
list_browser_sessionsLista las sesiones del navegador
delete_browser_sessionElimina una sesión del navegador
get_batch_scrape_statusComprueba el estado de la extracción por lotes
get_batch_scrape_errorsObtiene los errores de la extracción por lotes
cancel_batch_scrapeCancela una extracción por lotes
get_credit_usageObtiene los créditos restantes

Todas las funciones anteriores tienen una variante bang (!) (por ejemplo, scrape_and_extract_from_url!) que lanza una excepción en lugar de devolver tuplas de error.

Para consultar la documentación completa de la API, consulta hexdocs.pm/firecrawl.