modiqo/skillspec

散文形式で記述された AI エージェントのスキルを構造化された契約に変換し、エージェントが安全ルールを遵守し、完了の検証可能な証拠を提供できるようにするツール。

keslr/keslr_connect

Keslr ネットワークと統合するためのTypeScriptパッケージのセット。信頼グラフ認証とプライベートネットワークアドレス指定により、アプリケーションへのアクセスを検証済みの人間のみに制限します。

ThinkfleetAI/memmesh

ホストされたベクトルデータベースを必要とせず、単一のRustバイナリで実行される、耐久性があり、型付きで検索可能なローカル優先のメモリストア。AIエージェントのための持続的でプライベートな記憶を提供。

modiqo/waggle

30バイトのトークンに置き換えることで、重いコンテキストの引き継ぎを効率化し、検証可能なテレメトリとカスタムデータ投影を提供するマルチエージェントシステムの参照レイヤー

astrio-labs/forall

AIを活用した形式的検証ツールで、仕様と証明の自動生成により、ソフトウェアの正しさを機械検証可能な証拠として提供します。

drmingler/smart-llm-loader

OCR と LLM 駆動のセマンティック チャンキング を使用して、ドキュメントとスキャン画像をクリーンで構造化された Markdown チャンクに変換する Python パッケージ。RAG システム向け。

vostride/agent-qa

自然言語でウェブおよびモバイルテストを記述でき、自己修復AIエージェントを使用してUIの変更に適応するエージェント型QAハーネス。

beenuar/AiSOC

AIエージェントの意思決定プロセスを完全に透明化し、再現可能な監査証跡を備えた、オープンソースかつセルフホスト可能なAI SOC。

clawplays/ospec

要件、計画、検証証拠をプロジェクトリポジトリに直接永続化する仕様駆動型、エージェント指向のワークフロー枠組み。

emiliaprotocol/emilia-protocol

自律型 AI エージェントが不正な重大な行動を起こさないよう、有限で検証可能な使命内で動作することを保証するセキュリティプロトコルと強制ゲートです。

pathwaycom/pathway

Pathwayは、バッチまたはストリームデータパイプラインを構築するためのPython第一、Rustバックエンドのフレームワークです。多数のデータソースへのコネクタ、ステートフルなオペレータ、永続化、および専用のLLMツールキット(ラッパー、パーサー、ベクターインデックス)を備えており、DockerまたはKubernetesでリアルタイムRAGやその他のLLMアプリケーションを簡単に作成・デプロイできます。

SigmanticAI/apex-inference-chip

エッジ推論を最適化する、完全にオープンで検証最優先のLLM推論ハードウェアタイル。データパスに直接KVキャッシュ圧縮を統合しています。

colinlikescode/NanoGPT-Speedrun-Winner

メモリと重みの平均化技術を用いた最適化された GPT-2 学習実装により、modded-nanogpt チャレンジの速度記録を更新します。

drmingler/docling-api

FastAPI と Celery をベースにした API を使用して、PDF や DOCX などのさまざまな文書形式を Markdown に変換するスケーラブルなバックエンドサーバー。IBM の Docling を活用。

pathwaycom/arc-task-gen

AIモデルを未知の問題で評価し、ベンチマークの汚染を防ぐために、公開データセットの分布に一致した新しいARC-AGI-1スタイルのタスクを生成するタスクジェネレーター。

Jwuthri/Tracely-ai

AIエージェント向けのトレースネイティブCI/CDプラットフォームで、プロダクション障害を自動化されたレグレッションテストに変換し、バグのあるリリースをブロックします。

yudaprasetya007/routeVSCODE

VSCode 拡張機能とプロキシで、エディタの再読み込みなしに GitHub Copilot Chat で AI モデルを即座に切り替えられるようにします。

yureii1996/cek-probe-model

OpenAI互換のモデルエンドポイントをテストして、提供されているモデルがそのラベルと一致するかを検証するPythonスクリプトのコレクション。

martian56/redcell

REDCELLは、LLM駆動のエージェントを使用して完全なペネトレーションテスト(実際のKaliツール、ブラウザ自動化、リバースシェル)を実行し、洗練されたレポートを生成するオープンソースの自己ホスト型プラットフォームです。すべてライブのReactコンソールを通じて制御されます。

halofyai/halofy

組織全体にわたって、統一されたアイデンティティ、ポリシーの適用、および監査可能なコンテキスト管理を提供する、AIエージェントのためのオープンなアクセスおよびガバナンスレイヤー。

tigerless-labs/cost-xray

AIコーディングエージェント向けのローカルAPIトラフィックキャプチャツールで、システムプロンプトやツールスキーマなどの特定リクエストコンポーネントにトークンコストを正確に割り当てます。

shinthink/blitzstrike

構造化されたペネトレーションテスト手法(偵察、分析、検証)を実装し、ライブ検証を伴うLLM駆動のセキュリティ監査を提供するMCPサーバー。

EvoMap/AutoResearch

AI/ML研究のためのオープンソース・エージェント・ワークフロー。アイデア生成から実験実行までを自動化し、論文執筆に耐えうる証拠を生成します。

cortex-docs/cortex

CortexはAPI仕様とMarkdownを1つの設定から型付きSDK、インタラクティブなドキュメント、AIエージェント用MCPサーバーに変換します。

ukanwat/selfstarter

簡潔な要件に基づくアプローチを用いて、Unreal Engine 5で長期にわたるエンジニアリングタスクを自律型AIエージェントが実行するためのハーネス。チャットインターフェースではなく、要件ベースの管理スタイルを採用。

LibreChat-AI/rag-api

pgvectorまたはMongoDBを使用したIDベースのドキュメントインデックス作成と検索を可能にする非同期FastAPIベースのRAG API。ユーザー所有権に基づく厳格なアクセス制御を実装。