ClawBio/ClawBio

🦖 ClawBio - The first bioinformatics-native AI agent skill library. Local-first. Reproducible. Open. Free.

What it solves

ClawBio는 AI 에이전트를 사용해 생물정보학 워크플로우를 실행하는 표준화되고 재현 가능한 방법을 제공합니다. LLM이 오래된 가이드라인이나 잘못된 유전 분류를 "환각"하는 "확률적" AI 생성 코드 문제를, 버전 관리된 사양 제약 "스킬" 라이브러리로 교체함으로써 해결합니다. 이를 통해 도메인 전문 지식이 정확하고 재현 가능하게 실행됩니다.

How it works

ClawBio는 "사양 우선" 아키텍처를 구현합니다. LLM이 파이프라인을 즉흥적으로 구성하는 대신, 자체 포함된 스킬 라이브러리를 사용합니다. 각 스킬은 선언적 사양(SKILL.md), 검증된 Python 코드, 데모 데이터로 구성됩니다. 에이전트(Claude 또는 ChatGPT 등)가 스킬을 호출하면 학습 데이터에서 즉흥적으로 생성하는 것이 아니라 전문가가 정의한 계약을 따릅니다. 과학적 엄밀성을 보장하기 위해 프로젝트에는 실제 벤치마크, 오프라인 테스트용 모크 API 서버, 실행마다 재현성 번들(명령어, 환경 스냅샷, 체크섬 포함)을 제공하는 검증 인프라가 포함됩니다.

Who it’s for

복잡한 유전체 분석(예: 약물유전체 프로파일링, GWAS 조회, 변이 주석)을 수행하고 결과가 재현 가능하며 최신 과학 가이드라인에 기반함을 보장해야 하는 생물정보학자, 유전 연구자, 임상의를 위해 설계되었습니다.

Highlights

  • Extensive Skill Library: 개인 유전체(예: PharmGx Reporter), 집단 유전학(예: GWAS Lookup, Ancestry PCA), 임상 보고서를 포함한 94개의 스킬을 제공.
  • Local-first Privacy: 유전체 데이터는 기본적으로 사용자의 로컬 머신에서 분석되어 프라이버시를 유지합니다.
  • Reproducibility Bundles: 셸 명령어와 환경 스냅샷을 포함한 재생 메타데이터를 내보내어 원본 AI 세션 없이도 실행을 재검증할 수 있습니다.
  • Agent-Agnostic: 로직이 모델 가중치와 분리되어 있어 Claude, ChatGPT, Ollama 등 다양한 LLM에서 작동합니다.
  • Integrated Benchmarking: 알츠하이머병 등 질병에 대한 실제 데이터를 사용한 체계적인 검증 스위트를 제공하여 유전자 회수율과 정밀도를 평가합니다.