1broseidon/ketch

Fast, stateless CLI for web search and scrape. Built for AI agents.

해결하는 문제

Ketch는 인간과 AI 에이전트 모두를 위한 연구 데이터 수집 과정을 단순화하기 위해 설계된 상태 없는 CLI 도구입니다. 여러 제공자 SDK, 인증 키, 다양한 응답 형식을 관리할 필요 없이 웹 검색, 코드 검색, 라이브러리 문서, 웹 스크래핑을 하나의 바이너리로 통합합니다.

작동 방식

Ketch는 다양한 연구 표면에 대한 통합 인터페이스로 작동합니다:

  • 웹 검색: Brave, DuckDuckGo, SearXNG, Exa, Firecrawl, Keenable, Tavily, Parallel, SerpBase 등의 제공자와 통합됩니다.
  • 코드 검색: Grep, Sourcegraph, 또는 GitHub Code Search를 통해 오픈소스 소프트웨어(OSS) 소스 코드를 검색합니다.
  • 라이브러리 문서: Context7을 통해 버전 인식 가능한 커스터마이징된 문서에 접근합니다.
  • 스크래핑/크롤링: HTML 페이지와 텍스트 기반 PDF를 깨끗한 Markdown으로 변환합니다. 순수 Go로 작성된 내장 PDF 파서를 포함하며, JS 렌더링된 페이지를 위해 헤드리스 Chrome을 지원합니다.

구조화된 JSON 출력(--json)과 문서화된 종료 코드를 제공하여 스크립트 제어 흐름과 AI 에이전트 통합에 매우 예측 가능합니다. 또한 반복 요청을 빠르게 처리하기 위한 로컬 페이지 캐시 기능도 제공합니다.

대상 사용자

  • AI 에이전트 개발자: 각 제공자별 글루 코드를 작성하지 않고도 에이전트에 연구 기능을 제공할 수 있는 단일 도구를 원하는 사람.
  • 연구자 및 개발자: 웹에서 깨끗한 콘텐츠를 추출하거나 코드를 검색할 때 빠른 터미널 기반 도구를 선호하는 사람.

주요 특징

  • 통합 인터페이스: 검색, 코드, 문서를 위한 하나의 바이너리.
  • 에이전트 호환: 구조화된 JSON 출력, 안정적인 종료 코드, Claude Code와 같은 에이전트와 직접 통합 가능한 MCP 서버 구현.
  • JS 렌더링 대체: 자동으로 JS 셸 페이지를 감지하고 헤드리스 Chrome을 사용해 재요청합니다.
  • 랭크 융합 검색: --multi 플래그를 사용하면 여러 백엔드에서 연합 검색이 가능하며, Reciprocal Rank Fusion을 통해 중복 제거 및 결과 순위 매기기 가능.
  • PDF 추출: 외부 OCR 변환기와 호환되는 내장 텍스트 추출 기능.
  • 쿠키 지원: Netscape cookies.txt 파일을 사용해 동의 창을 우회하거나 인증된 콘텐츠에 접근할 수 있습니다.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트