us/crw

Fast, lightweight Firecrawl/Tavily alternative in Rust. Web scraper, crawler & search API with MCP server for AI agents. Drop-in Firecrawl-compatible API (/scrape, /crawl, /search). 2.3x faster than Tavily, 1.5x faster than Firecrawl in 1K-URL benchmarks. 6 MB RAM, single binary. Self-host or use managed cloud.

解决的问题

fastCRW 提供了一个高性能引擎,可将网页内容转换为干净的 Markdown 或结构化 JSON,解决了从 URL 中提取高质量、AI 就绪数据的难题。它取代了以往需要使用多个独立工具来搜索、抓取、爬取和提取网页数据的需求。

工作原理

它以基于 Rust 的二进制文件运行,可以在本地运行或通过托管 API 访问。该引擎支持五个主要操作:

  • Scrape:将单个 URL 转换为 Markdown、HTML、屏幕截图或 JSON。
  • Crawl:执行有边界的网站爬取以收集页面。
  • Map:发现站点内的 URL,而无需抓取每个页面。
  • Search:搜索网络并可选择抓取结果。
  • Extract:从一个或多个 URL 生成结构化字段。

它通过模型上下文协议 (MCP) 与 AI 编程工具(如 Cursor、Windsurf 和 Claude Code)集成,允许代理将其作为一项技能使用。

适用人群

正在构建 AI 代理、RAG 管道或数据提取工具,且需要快速、低内存占用引擎来获取和清理网页内容的开发者。

亮点

  • 高效率:空闲时仅占用约 14 MB 内存。
  • 高准确度:在真实召回率和答案准确度基准测试中,表现优于 Firecrawl 和 Crawl4AI 等竞争对手。
  • 灵活部署:可作为托管 API、本地 Rust 二进制文件或自托管使用。
  • 代理就绪:原生支持 MCP 服务器,可与 AI 编程助手无缝集成。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目