astrio-labs/forall

一款AI驱动的形式化验证工具,通过自动化生成规格和证明,提供软件正确性的机器可验证证据。

drmingler/smart-llm-loader

一个 Python 包,利用 OCR 和 LLM 驱动的语义分块,将文档和扫描图像转换为干净、结构化的 markdown 块,用于 RAG 系统。

vostride/agent-qa

一种代理型 QA 测试框架,允许用户使用自然语言编写 Web 和移动端测试,并利用自我修复 AI 代理来适应 UI 变化。

beenuar/AiSOC

一个开源、可自托管的 AI SOC,通过完全透明且可重现的 AI 代理决策审计追踪,实现安全事件分类与调查的自动化。

clawplays/ospec

一个以规范驱动、代理式的工作流框架,可将需求、计划和验证证据直接持久化到项目仓库中。

emiliaprotocol/emilia-protocol

一种安全协议与强制网关,确保自主 AI 代理在有限且经验证的使命范围内运行,以防止未经授权的重大操作。

pathwaycom/pathway

Pathway 是一个以 Python 为第一语言、Rust 为后端的框架,用于构建批处理或流式数据管道。它提供多种数据源连接器、状态化操作符、持久化能力,以及专为 LLM 设计的工具包(包装器、解析器、向量索引),可轻松通过 Docker 或 Kubernetes 实现实时 RAG 及其他 LLM 应用的编写与部署。

SigmanticAI/apex-inference-chip

一个完全开源、以验证为先的 LLM 推理硬件单元,将 KV 缓存压缩直接集成到数据通路中,以优化边缘推理。

colinlikescode/NanoGPT-Speedrun-Winner

一种优化的 GPT-2 训练实现,利用内存和权重平均技术为 modded-nanogpt 挑战创下新的速度记录。

drmingler/docling-api

一个使用 FastAPI 和 Celery 构建的 API,通过 IBM 的 Docling 将 PDF、DOCX 等多种文档格式转换为 Markdown 的可扩展后端服务器。

pathwaycom/arc-task-gen

一个任务生成器,通过创建与公开数据集分布一致的新型 ARC-AGI-1 风格任务,在未知问题上评估 AI 模型并防止基准测试污染。

Jwuthri/Tracely-ai

面向 AI 代理的原生追踪 CI/CD 平台,将生产故障自动转化为回归测试,以阻止含 bug 的发布。

yudaprasetya007/routeVSCODE

一个 VSCode 扩展和代理,允许用户在不重新加载编辑器的情况下,即时切换 GitHub Copilot Chat 中的 AI 模型。

yureii1996/cek-probe-model

一组Python脚本,用于测试OpenAI兼容的模型端点,以验证所提供的模型是否与其标签匹配。

martian56/redcell

REDCELL是一个开源、自托管的平台,使用LLM驱动的代理来执行完整的渗透测试(真实的Kali工具、浏览器自动化、反向Shell)并生成精美的报告,全部通过实时React控制台控制。

halofyai/halofy

一个为 AI agent 提供开放式访问和治理层的开源项目,可在整个组织内提供统一的身份、策略执行和可审计的上下文管理。

tigerless-labs/cost-xray

一款用于 AI 编码代理的本地 API 流量捕获工具,可将令牌成本精确归因于系统提示、工具模式等特定请求组件。

shinthink/blitzstrike

一个实现结构化渗透测试方法论(侦察、分析、验证)的 MCP 服务器,提供带有实时验证的 LLM 驱动安全审计。

EvoMap/AutoResearch

一个用于 AI/ML 研究的开源代理工作流,可自动化构思与实验执行,产出可直接用于论文的证据。

cortex-docs/cortex

Cortex 从单一配置将 API 规范和 Markdown 转换为类型化 SDK、交互式文档和 AI 代理的 MCP 服务器。

ukanwat/selfstarter

一种用于在 Unreal Engine 5 中通过简报驱动方式而非聊天界面,让自主 AI 代理执行长期工程任务的框架。

LibreChat-AI/rag-api

一个基于 FastAPI 的异步 RAG API,支持使用 pgvector 或 MongoDB 进行基于 ID 的文档索引和检索,具备严格的基于所有权的访问控制。