---
type: entity
title: Firecrawl
created: 2026-07-13
updated: 2026-07-13
tags: [firecrawl, web-scraping, mcp, ai-agent, llm-tools, api, open-source, agpl]
---

## 基本信息

- **名称**：Firecrawl（🔥 火行者，中文资料中亦称"火行者"）
- **来源**：[firecrawl/firecrawl](https://github.com/firecrawl/firecrawl)
- **类型**：开源项目 + 托管服务（Open Source + Cloud）
- **许可证**：AGPL-3.0（项目主体）；SDK 与部分 UI 组件 MIT
- **托管服务**：[firecrawl.dev](https://firecrawl.dev/)
- **创始人**：Eric Ciarla、Nicolas Camara、Caleb Peffer

## 简介

Firecrawl 是一个面向 AI Agent 时代的网络数据 API。它把任意 URL 转换为干净的 Markdown、结构化 JSON 或截图，并提供搜索、爬取、交互、URL 发现等端点。设计上**默认面向 LLM 消费**（而非人类阅读），因此输出格式（如 markdown 干净度、结构化字段、token 效率）是核心优化目标。

## 核心能力

| 端点 | 用途 |
|------|------|
| Search | 搜索网络并返回完整页面内容 |
| Scrape | 单 URL → Markdown/HTML/JSON/截图 |
| Interact | 先抓后用 AI prompt 操作页面（点击、输入、滚动等） |
| Agent | 自然语言描述需求，自动搜索+浏览+提取，无需 URL |
| Crawl | 一次请求抓取整站所有 URL |
| Map | 一次性发现站内所有 URL |
| Batch Scrape | 异步批量抓取数千 URL |

## 关键技术指标（厂商声明）

- 覆盖 96% 的网络（含 JS 重度页面）
- P95 延迟 3.4 秒（百万级页面实测）
- 默认尊重 robots.txt
- 支持 PDF / DOCX 等媒体解析
- 内置 spark-1-mini（默认，便宜 60%）与 spark-1-pro（复杂任务）两种 Agent 模型

## 相关概念

- [[wiki/concepts/web-scraping|Web Scraping]]
- [[wiki/concepts/mcp|MCP]]（提供 firecrawl-mcp-server）
- [[wiki/concepts/agent-skills|Agent Skills]]（CLI Skill 是典型实例）
- [[wiki/concepts/scrapling-mcp|Scrapling MCP]] — 同类思路的 MCP 实现（自托管 Python）

## 最新动态（来自 [[wiki/library/firecrawlfirecrawl The API to search, scrape, and interact with the web at scale. 🔥|Firecrawl README EN]]）

- **2026-07-13**：Ingest firecrawl/firecrawl README（中英双版本）
- Agent 端点是 `/extract` 的进化版（更快、更可靠、无需事先知道 URL）
- 支持 Pydantic schema 结构化输出
- 一条命令接入 Claude Code / Antigravity / OpenCode 等 Agent 框架

## 历史记录

- 2026-07-13：首次入 wiki；新建 entity 页（来源：firecrawl/firecrawl GitHub README，中英双版本）

## 参考来源

- [[wiki/library/firecrawlfirecrawl The API to search, scrape, and interact with the web at scale. 🔥|Firecrawl (英文 README)]]
- [[wiki/library/firecrawlfirecrawl The API to search, scrape, and interact with the web at scale. 🔥 1|Firecrawl (中文 README)]]