Firecrawl 替代方案 —— 图图搜 API

自建 BM25 全文索引 + 全网兜底,一行请求即得结构化结果,中文更准。

Firecrawl 擅长把单个网页抓取并转成 LLM 友好的 Markdown。如果你要的不是「抓某一页」,而是「对全网提问、拿回一组相关结果」,图图搜是更贴合的选择。

图图搜自建爬虫 + Tantivy BM25 全文索引,本地结果不足时用外部搜索兜底,返回带标题 / 摘要 / 来源(local/brave)标注的结构化 JSON,并支持 llms.txt——为 RAG、Agent、AI 应用提供实时检索。

图图搜 vs Firecrawl

对比项图图搜Firecrawl
核心能力全网检索,返回一组相关结果抓取指定网页转 Markdown
自建索引✅ Tantivy BM25 全文以实时抓取为主
中文分词✅ jieba一般
来源标注✅ local / brave
llms.txt✅ 支持部分

主要功能

自建全网索引

spider-rs 爬虫 + Tantivy BM25 索引,聚焦高权重站点,不只是单页抓取。

结构化 JSON

GET /api/v1/search 一行请求返 title / url / snippet / source,直接喂给模型。

中文搜索更准

title/body 用 jieba 分词,「异步编程」也能命中「编程」,中文语义不整段成一个词。

合规与安全

爬取遵守 robots.txt + Crawl-delay,出站 SSRF 守卫(拒私网/回环/云元数据)。

使用步骤

  1. 1
    拿 API Key
    在开发者页申请 key,或先用公共层按 IP 免费试。
  2. 2
    发一个请求
    GET /api/v1/search?q=你的问题,带上 Authorization 头。
  3. 3
    用结构化结果
    解析返回的 results 数组(标题/链接/摘要/来源),喂给 LLM 或直接展示。

常见问题

图图搜和 Firecrawl 定位有何不同?
Firecrawl 偏「抓取指定网页转 Markdown」;图图搜偏「对全网检索返回一组相关结果」。要做 RAG / 联网问答,后者更省事。
支持中文搜索吗?
支持,且专门优化:索引用 jieba 中文分词,中文关键词召回明显好于按整段处理的方案。
结果里能看出来源吗?
能。每条结果带 source 标注(本地索引 local 或外部兜底 brave),便于你判断可信度与引用。
有速率限制吗?
有。带 key 按 key 的 rate_limit 计,响应带 X-RateLimit-* 头;不带 key 走公共层按客户端 IP 计。

现在就接入图图搜 API

免费额度 · 一行请求即得结构化结果 · 支持 llms.txt