---
type: library
origin: firecrawlfirecrawl The API to search, scrape, and interact with the web at scale. 🔥.md
originPath: sources/firecrawlfirecrawl The API to search, scrape, and interact with the web at scale. 🔥.md
ingested: 2026-07-13
language: en
variant: english-original
tags: [firecrawl, web-scraping, mcp, ai-agent, llm-tools, api, open-source]
---

## 摘要

Firecrawl 是一个面向大规模网络抓取、搜索与交互的 API 项目（GitHub: firecrawl/firecrawl），同时提供 AGPL-3.0 开源版本与 firecrawl.dev 云端托管服务。其核心目标是把任何 URL 转换为 LLM 就绪的 Markdown / 结构化 JSON / 截图，并提供搜索、爬取、批抓、URL 发现（Map）、AI Agent 等端点。基准声明覆盖 96% 的网络（含 JS 重度页面）、P95 延迟 3.4s，专为实时 Agent 与动态应用设计。

## 关键要点

- **核心端点**：Search（搜索并返回完整内容）、Scrape（单 URL → Markdown/JSON/截图）、Interact（先抓后用 AI prompt 操作页面）
- **扩展端点**：Agent（自然语言描述需求，自动搜索+浏览+提取，无需提供 URL）、Crawl（整站抓取）、Map（一次性发现站内所有 URL）、Batch Scrape（异步批量抓取数千 URL）
- **LLM-Ready 输出**：干净 Markdown、结构化 JSON、截图，并支持按 schema 提取（Pydantic BaseModel）
- **零配置基础设施**：自动处理代理轮换、限速、JS 屏蔽内容、PDF/DOCX 解析、点击/滚动/输入/等待等浏览器动作
- **Spark-1 Agent 模型**：内置两种 Agent 模型（spark-1-mini 默认 60% 便宜 / spark-1-pro 复杂任务），是 `/extract` 的进化版
- **Agent 集成**：通过 `npx -y firecrawl-cli@latest init --all --browser` 一键接入 Claude Code / Antigravity / OpenCode 等；MCP 配置一行即用
- **媒体解析**：支持抓取网页托管的 PDF、DOCX 等
- **SDK 覆盖**：Python（firecrawl-py）、Node.js、Java、Elixir、Rust（官方），Go（社区）
- **创始人**：Eric Ciarla、Nicolas Camara、Caleb Peffer
- **许可**：项目主体 AGPL-3.0；SDK 与部分 UI 组件 MIT
- **合规**：默认尊重 robots.txt；强调使用者需自行遵守目标站点的隐私政策与 ToS

## 本文件对 wiki 的贡献

- 新增实体：[[wiki/entities/firecrawl|Firecrawl]]
- 新增/更新概念：[[wiki/concepts/web-scraping|Web Scraping]]（补充商业级 API 范式）、[[wiki/concepts/mcp|MCP]]（补充 MCP server 实例）、[[wiki/concepts/agent-skills|Agent Skills]]（Firecrawl CLI Skill 是 Agent Skill 的典型实例）
- 可能触发的 synthesis：[[wiki/synthesis/web-scraping-tools-comparison|Web Scraping 工具对比]]（Scrapling vs Firecrawl，本地 Python 库 vs 托管 API）

## 相关页面

- [[wiki/entities/scrapling|Scrapling]] — 同类网页抓取项目（Python 自适应抓取）
- [[wiki/concepts/web-scraping|Web Scraping]]
- [[wiki/concepts/mcp|MCP]]
- [[wiki/concepts/agent-skills|Agent Skills]]