Firecrawl 替代方案 —— 图图搜 API
自建 BM25 全文索引 + 全网兜底,一行请求即得结构化结果,中文更准。
Firecrawl 擅长把单个网页抓取并转成 LLM 友好的 Markdown。如果你要的不是「抓某一页」,而是「对全网提问、拿回一组相关结果」,图图搜是更贴合的选择。
图图搜自建爬虫 + Tantivy BM25 全文索引,本地结果不足时用外部搜索兜底,返回带标题 / 摘要 / 来源(local/brave)标注的结构化 JSON,并支持 llms.txt——为 RAG、Agent、AI 应用提供实时检索。
图图搜 vs Firecrawl
| 对比项 | 图图搜 | Firecrawl |
|---|---|---|
| 核心能力 | 全网检索,返回一组相关结果 | 抓取指定网页转 Markdown |
| 自建索引 | ✅ Tantivy BM25 全文 | 以实时抓取为主 |
| 中文分词 | ✅ jieba | 一般 |
| 来源标注 | ✅ local / brave | — |
| llms.txt | ✅ 支持 | 部分 |
主要功能
自建全网索引
spider-rs 爬虫 + Tantivy BM25 索引,聚焦高权重站点,不只是单页抓取。
结构化 JSON
GET /api/v1/search 一行请求返 title / url / snippet / source,直接喂给模型。
中文搜索更准
title/body 用 jieba 分词,「异步编程」也能命中「编程」,中文语义不整段成一个词。
合规与安全
爬取遵守 robots.txt + Crawl-delay,出站 SSRF 守卫(拒私网/回环/云元数据)。
使用步骤
- 1 拿 API Key在开发者页申请 key,或先用公共层按 IP 免费试。
- 2 发一个请求GET /api/v1/search?q=你的问题,带上 Authorization 头。
- 3 用结构化结果解析返回的 results 数组(标题/链接/摘要/来源),喂给 LLM 或直接展示。
常见问题
- 图图搜和 Firecrawl 定位有何不同?
- Firecrawl 偏「抓取指定网页转 Markdown」;图图搜偏「对全网检索返回一组相关结果」。要做 RAG / 联网问答,后者更省事。
- 支持中文搜索吗?
- 支持,且专门优化:索引用 jieba 中文分词,中文关键词召回明显好于按整段处理的方案。
- 结果里能看出来源吗?
- 能。每条结果带 source 标注(本地索引 local 或外部兜底 brave),便于你判断可信度与引用。
- 有速率限制吗?
- 有。带 key 按 key 的 rate_limit 计,响应带 X-RateLimit-* 头;不带 key 走公共层按客户端 IP 计。
现在就接入图图搜 API
免费额度 · 一行请求即得结构化结果 · 支持 llms.txt