ClawBio/ClawBio

🦖 ClawBio - The first bioinformatics-native AI agent skill library. Local-first. Reproducible. Open. Free.

What it solves

ClawBio 提供一种标准化、可重现的方式,使用 AI 代理执行生物信息学工作流。它解决了“随机”AI 生成代码的问题——LLM 可能会产生过时的指南或错误的基因分类——通过将即兴代码生成替换为“技能”库:版本化、规范约束的合约,确保领域专业知识被准确且可重现地执行。

How it works

ClawBio 实现了“规范优先”架构。系统不依赖 LLM 即兴构建管道,而是使用一套自包含的技能库。每个技能由声明式规范 (SKILL.md)、已验证的 Python 代码和示例数据组成。当代理(如 Claude 或 ChatGPT)调用技能时,会遵循专家定义的合约,而不是从训练数据即兴生成。为确保科学严谨,项目提供验证基础设施,包括真实基准、离线测试的 mock API 服务器,以及每次运行的可重现性捆绑(包含命令、环境快照和校验和)。

Who it’s for

它面向生物信息学家、遗传研究者和临床医生,他们需要执行复杂的基因组分析——如药物基因组分析、GWAS 查询和变异注释——并保证结果可重现且基于最新的科学指南。

Highlights

  • Extensive Skill Library: 包含 94 项技能,覆盖个人基因组(例如 PharmGx Reporter)、群体遗传学(例如 GWAS Lookup、Ancestry PCA)和临床报告。
  • Local-first Privacy: 基因数据默认在用户本地机器上分析,以维护隐私。
  • Reproducibility Bundles: 导出重放元数据,包括 shell 命令和环境快照,使运行能够在没有原始 AI 会话的情况下重新验证。
  • Agent-Agnostic: 可跨不同 LLM(Claude、ChatGPT、Ollama)使用,因为逻辑与模型权重解耦。
  • Integrated Benchmarking: 提供系统化验证套件,使用阿尔茨海默症等疾病的真实数据评分基因恢复率和精确度。