Skip to main content
Hero Light

Firecrawl へようこそ

Firecrawl は、URL を渡すだけでクロールし、クリーンな Markdown に変換する API サービスです。アクセス可能なサブページをすべてクロールし、各ページのクリーンな Markdown を提供します。サイトマップは不要です。

使い方

ホスティング版で使いやすいAPIを提供しています。プレイグラウンドとドキュメントはこちらにあります。バックエンドをセルフホストすることも可能です。 まずは以下のリソースをご確認ください: セルフホスト: セルフホストする場合はこちらのガイドをご参照ください。

APIキー

APIを利用するには、Firecrawl に登録し、APIキーを取得してください。

クローリング

URL とアクセス可能なすべてのサブページをクロールします。クロールジョブを送信し、進行状況の確認に使えるジョブ ID を返します。

インストール

使い方

SDK を使わない場合や、Webhook もしくは別のポーリング方式を利用したい場合は、wait_until_donefalse に設定できます。 この場合は jobId が返されます。 cURL では、/crawl は常に jobId を返し、それを使ってクロール状況を確認できます。

クローラー ジョブの確認

クローラー ジョブのステータスを確認し、結果を取得します。

レスポンス

スクレイピング

単一のURLをスクレイプするには、scrape_url メソッドを使用します。URLを引数に取り、スクレイプ結果を辞書 (ディクショナリ) 型で返します。

レスポンス

抽出

LLM抽出を使うと、任意のURLから構造化データを簡単に取り出せます。pydanticのスキーマもサポートしており、設定がより容易です。使い方は次のとおりです:

コントリビューション

貢献を歓迎しています。プルリクエストを送信する前に、貢献ガイドをお読みください。