- Extraer contenido limpio: Eliminar anuncios, elementos de navegación y otras distracciones para obtener solo el contenido principal
- Convertir a formatos estructurados: Transformar páginas web en Markdown, HTML o JSON
- Capturar metadatos: Extraer metadatos SEO, etiquetas Open Graph y otra información de la página
- Manejar sitios con uso intensivo de JavaScript: Procesar contenido de aplicaciones web modernas que dependen de JavaScript
- Filtrar contenido: Enfocarse en partes específicas de una página usando selectores CSS
- Procesar a escala: Manejar necesidades de scraping de alto volumen con una API confiable
- Buscar en la web: Realizar búsquedas web inteligentes y obtener resultados estructurados
- Rastrear sitios completos: Rastrear múltiples páginas de un sitio web y agregar su contenido
- Scrape: Extraer contenido estructurado (Markdown, HTML, metadatos) de una sola página web.
- Search: Buscar información en la web utilizando las capacidades de búsqueda inteligente de Firecrawl.
- Crawl: Rastrear múltiples páginas de un sitio web, devolviendo contenido estructurado y metadatos para cada página.
Instrucciones de uso
Integra Firecrawl en el flujo de trabajo. Puede buscar, extraer o rastrear sitios web. Requiere clave API.Herramientas
firecrawl_scrape
Extrae contenido estructurado de páginas web con soporte integral de metadatos. Convierte el contenido a markdown o HTML mientras captura metadatos SEO, etiquetas Open Graph e información de la página.
Entrada
Salida
firecrawl_search
Busca información en la web usando Firecrawl
Entrada
Salida
firecrawl_crawl
Rastrea sitios web completos y extrae contenido estructurado de todas las páginas accesibles
Entrada
Salida
Notas
- Categoría:
tools - Tipo:
firecrawl
