astrio-labs/forall
一款AI驱动的形式化验证工具,通过自动化生成规格和证明,提供软件正确性的机器可验证证据。
drmingler/smart-llm-loader
一个 Python 包,利用 OCR 和 LLM 驱动的语义分块,将文档和扫描图像转换为干净、结构化的 markdown 块,用于 RAG 系统。
vostride/agent-qa
一种代理型 QA 测试框架,允许用户使用自然语言编写 Web 和移动端测试,并利用自我修复 AI 代理来适应 UI 变化。
beenuar/AiSOC
一个开源、可自托管的 AI SOC,通过完全透明且可重现的 AI 代理决策审计追踪,实现安全事件分类与调查的自动化。
clawplays/ospec
一个以规范驱动、代理式的工作流框架,可将需求、计划和验证证据直接持久化到项目仓库中。
emiliaprotocol/emilia-protocol
一种安全协议与强制网关,确保自主 AI 代理在有限且经验证的使命范围内运行,以防止未经授权的重大操作。
pathwaycom/pathway
Pathway 是一个以 Python 为第一语言、Rust 为后端的框架,用于构建批处理或流式数据管道。它提供多种数据源连接器、状态化操作符、持久化能力,以及专为 LLM 设计的工具包(包装器、解析器、向量索引),可轻松通过 Docker 或 Kubernetes 实现实时 RAG 及其他 LLM 应用的编写与部署。
SigmanticAI/apex-inference-chip
一个完全开源、以验证为先的 LLM 推理硬件单元,将 KV 缓存压缩直接集成到数据通路中,以优化边缘推理。
colinlikescode/NanoGPT-Speedrun-Winner
一种优化的 GPT-2 训练实现,利用内存和权重平均技术为 modded-nanogpt 挑战创下新的速度记录。
drmingler/docling-api
一个使用 FastAPI 和 Celery 构建的 API,通过 IBM 的 Docling 将 PDF、DOCX 等多种文档格式转换为 Markdown 的可扩展后端服务器。
pathwaycom/arc-task-gen
一个任务生成器,通过创建与公开数据集分布一致的新型 ARC-AGI-1 风格任务,在未知问题上评估 AI 模型并防止基准测试污染。
Jwuthri/Tracely-ai
面向 AI 代理的原生追踪 CI/CD 平台,将生产故障自动转化为回归测试,以阻止含 bug 的发布。
yudaprasetya007/routeVSCODE
一个 VSCode 扩展和代理,允许用户在不重新加载编辑器的情况下,即时切换 GitHub Copilot Chat 中的 AI 模型。
yureii1996/cek-probe-model
一组Python脚本,用于测试OpenAI兼容的模型端点,以验证所提供的模型是否与其标签匹配。
martian56/redcell
REDCELL是一个开源、自托管的平台,使用LLM驱动的代理来执行完整的渗透测试(真实的Kali工具、浏览器自动化、反向Shell)并生成精美的报告,全部通过实时React控制台控制。
halofyai/halofy
一个为 AI agent 提供开放式访问和治理层的开源项目,可在整个组织内提供统一的身份、策略执行和可审计的上下文管理。
tigerless-labs/cost-xray
一款用于 AI 编码代理的本地 API 流量捕获工具,可将令牌成本精确归因于系统提示、工具模式等特定请求组件。
shinthink/blitzstrike
一个实现结构化渗透测试方法论(侦察、分析、验证)的 MCP 服务器,提供带有实时验证的 LLM 驱动安全审计。
EvoMap/AutoResearch
一个用于 AI/ML 研究的开源代理工作流,可自动化构思与实验执行,产出可直接用于论文的证据。
cortex-docs/cortex
Cortex 从单一配置将 API 规范和 Markdown 转换为类型化 SDK、交互式文档和 AI 代理的 MCP 服务器。
ukanwat/selfstarter
一种用于在 Unreal Engine 5 中通过简报驱动方式而非聊天界面,让自主 AI 代理执行长期工程任务的框架。
LibreChat-AI/rag-api
一个基于 FastAPI 的异步 RAG API,支持使用 pgvector 或 MongoDB 进行基于 ID 的文档索引和检索,具备严格的基于所有权的访问控制。