Skip to main content

Usando o Firecrawl com o CrewAI

O Firecrawl está integrado ao CrewAI, o framework para orquestração de agentes de IA. Esta página apresenta todas as ferramentas do Firecrawl adicionadas ao framework.

Instalando as ferramentas do Firecrawl no CrewAI

Ferramentas

Ferramenta FirecrawlCrawlWebsite

Exemplo

Use o FirecrawlScrapeFromWebsiteTool da seguinte forma para permitir que seu agente carregue sites:

Arguments

  • api_key: Opcional. Especifica a chave de API do Firecrawl. O padrão é a variável de ambiente FIRECRAWL_API_KEY.
  • url: A URL base a partir da qual o rastreamento será iniciado.
  • page_options: Opcional.
    • onlyMainContent: Opcional. Retorna apenas o conteúdo principal da página, excluindo cabeçalhos, menus de navegação, rodapés etc.
    • includeHtml: Opcional. Inclui o conteúdo HTML bruto da página. Gerará uma chave html na resposta.
  • crawler_options: Opcional. Opções para controlar o comportamento do rastreamento.
    • includes: Opcional. Padrões de URL a serem incluídos no rastreamento.
    • exclude: Opcional. Padrões de URL a serem excluídos do rastreamento.
    • generateImgAltText: Opcional. Gera texto alternativo para imagens usando LLMs (requer um plano pago).
    • returnOnlyUrls: Opcional. Se verdadeiro, retorna apenas as URLs como uma lista no status do rastreamento. Observação: a resposta será uma lista de URLs dentro de data, não uma lista de documentos.
    • maxDepth: Opcional. Profundidade máxima de rastreamento. Profundidade 1 é a URL base, profundidade 2 inclui a URL base e seus filhos diretos, e assim por diante.
    • mode: Opcional. O modo de rastreamento a ser usado. O modo Fast faz o rastreamento 4x mais rápido em sites sem sitemap, mas pode não ser tão preciso e não deve ser usado em sites fortemente renderizados com JavaScript.
    • limit: Opcional. Número máximo de páginas a serem rastreadas.
    • timeout: Opcional. Tempo limite em milissegundos para a operação de rastreamento.

FirecrawlScrapeWebsiteTool

Exemplo

Use o FirecrawlScrapeWebsiteTool da seguinte forma para permitir que seu agente carregue sites:

Argumentos

  • api_key: Opcional. Especifica a chave de API do Firecrawl. O padrão é a variável de ambiente FIRECRAWL_API_KEY.
  • url: A URL a ser extraída (scraped).
  • page_options: Opcional.
    • onlyMainContent: Opcional. Retorna apenas o conteúdo principal da página, excluindo headers, navs, footers etc.
    • includeHtml: Opcional. Inclui o HTML bruto da página. Gerará uma chave html na resposta.
  • extractor_options: Opcional. Opções para extração, baseada em LLM, de informações estruturadas a partir do conteúdo da página.
    • mode: O modo de extração a ser usado, atualmente suporta llm-extraction.
    • extractionPrompt: Opcional. Um prompt descrevendo quais informações extrair da página.
    • extractionSchema: Opcional. O esquema dos dados a serem extraídos.
  • timeout: Opcional. Tempo limite, em milissegundos, para a requisição.

FirecrawlSearchTool

Exemplo

Use o FirecrawlSearchTool da seguinte maneira para permitir que seu agente carregue sites:

Argumentos

  • api_key: Opcional. Especifica a chave da API do Firecrawl. O padrão é a variável de ambiente FIRECRAWL_API_KEY.
  • query: String de consulta de pesquisa a ser usada na busca.
  • page_options: Opcional. Opções para formatação do resultado.
    • onlyMainContent: Opcional. Retorna apenas o conteúdo principal da página, excluindo cabeçalhos, menus de navegação, rodapés etc.
    • includeHtml: Opcional. Inclui o conteúdo HTML bruto da página. Retornará uma chave html na resposta.
    • fetchPageContent: Opcional. Busca o conteúdo completo da página.
  • search_options: Opcional. Opções para controlar o comportamento do crawling.
    • limit: Opcional. Número máximo de páginas a serem rastreadas.