Skip to main content

Kit de desarrollo de agentes (ADK)

Integra Firecrawl con el ADK de Google mediante MCP para flujos de trabajo avanzados de agentes
3 min read

Integra Firecrawl con el Kit de desarrollo de agentes (ADK) de Google para crear agentes de IA potentes con capacidades de web scraping mediante el Model Context Protocol (MCP).

Descripción general#

Firecrawl ofrece un servidor MCP que se integra sin fricciones con el ADK de Google, permitiendo que tus agentes realicen scraping, crawling y extracción de datos estructurados de cualquier sitio web de manera eficiente. La integración es compatible tanto con instancias de Firecrawl en la nube como autogestionadas, con HTTP en streaming para un rendimiento óptimo.

Funcionalidades#

  • web scraping, rastreo y descubrimiento de contenido eficientes en cualquier sitio
  • Búsqueda avanzada y extracción inteligente de contenido
  • Investigación profunda
  • Despliegue flexible (en la nube o autogestionado)
  • Optimizado para entornos web modernos con soporte HTTP por streaming

Requisitos previos#

  • Obtén una clave de API para Firecrawl en firecrawl.dev
  • Instala el Google SDK

Configuración#

Configura FIRECRAWL_API_KEY en el entorno desde el que se inicia ADK. No incluyas su valor en los prompts del agente, el control de código fuente ni la URL del MCP. El paquete MCP local requiere Node.js 22 o una versión posterior.

Herramientas disponibles#

HerramientaNombreDescripción
Herramienta de scrapingfirecrawl_scrapeExtrae contenido de una única URL con opciones avanzadas
Herramienta de mapeofirecrawl_mapGenera el mapa de un sitio para descubrir todas las URL indexadas
Herramienta de búsquedafirecrawl_searchBusca en la web y, opcionalmente, extrae contenido de los resultados
Herramienta de rastreofirecrawl_crawlInicia un rastreo asíncrono con opciones avanzadas
Consultar estado del rastreofirecrawl_check_crawl_statusConsulta el estado de un trabajo de rastreo

Configuración#

Configuración requerida#

FIRECRAWL_API_KEY: Tu clave de API de Firecrawl

  • Obligatorio al usar la API en la nube (por defecto)
  • Opcional al usar una instancia autogestionada con FIRECRAWL_API_URL

Configuración opcional#

URL de la API de Firecrawl (para instancias autogestionadas):

  • FIRECRAWL_API_URL: Endpoint de API personalizado
  • Ejemplo: https://firecrawl.your-domain.com
  • Si no se especifica, se usará la API en la nube

Ejemplo: agente de investigación web#

Mejores prácticas#

  1. Usa la herramienta adecuada para cada tarea:

    • firecrawl_search cuando primero necesites encontrar páginas relevantes
    • firecrawl_scrape para páginas individuales
    • firecrawl_crawl para descubrir y extraer sitios completos
    • llamadas repetidas a firecrawl_scrape cuando ya tengas una lista corta de URL conocidas
  2. Supervisa tu uso: Usa tu panel de Firecrawl y las respuestas de la API para hacer seguimiento del consumo de créditos.

  3. Gestiona los errores de forma adecuada: Muestra al usuario los errores de MCP/API y reintenta solo cuando tu flujo de trabajo del agente pueda hacerlo de forma segura.

  4. Optimiza el rendimiento: Usa firecrawl_map antes de hacer scraping cuando el agente necesite descubrir URL relevantes.