开发者 API v1.0 与 AI SDK 工具链

FlyCrawl 开发者集成中心

将极速网页转 Markdown、域名站点地图生成 (/map)、实时网络搜索 (/search)、批量抓取以及大模型结构化 Schema 提取无缝集成到 Python、LangChain、Cursor、Claude、Node.js 与 Go 中。

🧪 Swagger OpenAPI Spec 🤖 Model Context Protocol (MCP) 🔑 获取 API 密钥
POST /scrape

Web to Markdown

Single-page fast extraction + actions & caching.

POST /map

Site Mapper

Discover all URLs on a domain in <2 seconds.

POST /search

Search & Scrape

Live web search with auto-scraped Markdown results.

POST /extract

LLM Schema Extract

Extract typed JSON data matching any schema.

POST /batch/scrape

Batch Scraper

Scrape 50+ URLs concurrently in parallel.

🧪 实时 API 测试控制台(文档内置)
HTTP 200 OK — JSON Response
// Output will appear here after clicking 'Send Live Request'
🤖 AI AGENTS PROTOCOL
Model Context Protocol (MCP) v3.5

🤖 FlyCrawl Model Context Protocol (MCP) Server

将 FlyCrawl 作为原生工具直接连接到 Claude Desktop、Cursor IDE、Windsurf 与 AI 智能体系统,实现高速网页抓取、实时网络搜索、站点地图绘制及结构化实体提取。

File: claude_desktop_config.json
{
  "mcpServers": {
    "flycrawl": {
      "command": "python",
      "args": ["-m", "flycrawl.mcp"],
      "env": {
        "FLYCRAWL_API_URL": "http://localhost:5120/api/v1",
        "FLYCRAWL_API_KEY": "fly_live_your_api_key"
      }
    }
  }
}

🛠️ 面向 AI 模型开放的原生 MCP 工具集

⚡ flycrawl_scrape
将单个网址转换为纯净的 Fit-Markdown。
🗺️ flycrawl_map
在 2 秒内发现指定域名下的所有 URL 子页面。
🔍 flycrawl_search
实时搜索全网并自动抓取前排结果。
🧠 flycrawl_extract
通过 JSON Schema 结构化提取实体数据。
🕸️ flycrawl_crawl
多页面深度递归爬虫引擎。

官方 SDK 与主流开发框架集成

# pip install flycrawl
from flycrawl import FlyCrawlApp

app = FlyCrawlApp(api_key="fly_live_your_api_key")

# 1. Scrape with Fit-Markdown & 24h Smart Cache
doc = app.scrape_url("https://example.com", params={"format": "markdown", "maxAge": 86400})
print(doc["content"])

# 2. Fast Site Mapping (<2s)
sitemap = app.map_url("https://example.com", params={"limit": 1000})
print(f"Discovered {sitemap['total_links']} URLs")

# 3. Live Web Search & Auto-Scrape
search_results = app.search("latest LLM reasoning benchmarks", limit=5)
for res in search_results["results"]:
    print(res["title"], res["url"])
            
🤖 本机 MCP 服务器 v3.5

模型上下文协议 (MCP) 服务器

JSON-RPC 2.0 Endpoint: /api/v1/mcp

直接将 FlyCrawl 连接为 Cursor IDE、Claude Desktop、Windsurf 或自定义 AI 代理中的本机工具服务器。允许法学硕士一键自动抓取、爬网、搜索和矢量化网络内容。

{
  "mcpServers": {
    "flycrawl": {
      "url": "https://api.flycrawl.net/api/v1/mcp",
      "headers": {
        "Authorization": "Bearer YOUR_FLYCRAWL_API_KEY"
      }
    }
  }
}
                    
flycrawl_vectorize

Web Scrape + Chunk + 1536-dim Embedding

flycrawl_scrape

Ultra-clean Fit-Markdown for LLM prompts

flycrawl_search

Live real-time search with scraped results

flycrawl_crawl

Recursive multi-page deep site crawl