Iamshankhadeep/ccseva

リアルタイムで Claude Code のトークン消費量、コスト、およびサーバー側の使用制限を追跡できる、ネイティブ Swift macOS メニューバー アプリ。

wildminder/AI-windows-whl

Windows 上でインストールが困難な AI/ML ライブラリ用の、事前コンパイル済みの Python wheels の厳選されたコレクションです。ソースコードからのビルドを不要にします。

gavamedia/deltafin

Deltafinは、Rustで構築されたネイティブバイナリで、コンシューマーハードウェア(macOS arm64またはLinux x86_64/aarch64)上で2.8TパラメータのKimi K3 Mixture-of-Expertsモデルを完全に実行します。16のエキスパートすべてを保持し、フルダウンロードとオンデマンドストリーミングの両方のインストールをサポート。オプションのQwenドラフトモデルによる加速、CLIによるチャット/コンプリーション、OpenAI互換サーバーも提供。プロジェクトはMITライセンス、モデル重みは元のライセンスの下で提供。

mmschlk/shapiq

機械学習モデルの予測における特徴の連携を説明するための、任意の順序のシャープリー相互作用を近似する Python パッケージ。

automateyournetwork/netclaw

数百のスキルとMCP統合を使用して、マルチベンダーネットワーク全体の監視、トラブルシューティング、設定を自動化するCCIEレベルのAIネットワークエンジニアリングエージェント。

NadirRouter/NadirClaw

ローカルLLMルーティングプロキシで、プロンプトを最も安価な実行可能なモデルにルーティングし、必要な場合にのみプレミアムモデルにエスカレーションすることで、APIコストを40〜70%削減します。

FlashML-org/flashlib

Triton と CuteDSL を基盤とした GPU ライブラリで、k-means、PCA、ANN 検索などの古典的機械学習演算子の高性能実装を提供します。

google-deepmind/simply

LLMの迅速な反復と、人間およびAIエージェントによる自動化されたAI研究のために設計された、最小限かつスケーラブルなJAXベースの研究用コードベース。

ROCm/aiter

AMD ROCm 向けの高性能 AI オペレーターライブラリで、AI 推論およびトレーニングワークロード向けに最適化された GPU カーネルを提供します。

apple/foundation-models-utilities

Apple Foundation Modelsフレームワーク用のユーティリティパッケージで、チャットコンプリーションクライアント、コンテキストウィンドウ管理、LLM向け動的スキル活性化を提供します。

pipecat-ai/voice-ui-kit

Pipecat AI音声アプリケーション用のユーザーインターフェースを素早く構築・デプロイできる、ReactベースのUIキットです。

microsoft/RAMPART

エージェント型AIアプリケーションのセキュリティと安全性を評価するための、pytestに統合された赤チーム作業用フレームワーク。

stevibe/BenchLocal

Bench Packs と呼ばれるさまざまなベンチマークセットに対して、ローカルまたはリモートモデルで LLM のパフォーマンスを実行・比較できるローカル優先のデスクトップアプリです。

vgvassilev/clad

C++ 向けの Clang コンパイラプラグインで、ソースコードを変換して導関数、勾配、ヘッセ行列を計算する関数を生成することで自動微分を提供します。

scverse/rapids-singlecell

大規模なデータセットでの計算を高速化するNVIDIA RAPIDSを活用した、単細胞解析向けのGPUアクセラレーテッドライブラリ。scverseエコシステムと統合されています。

dorjeduck/llm.mojo

アンドレイ・カルパティの llm.c をMojo言語に移植したもので、低レベルのLLMトレーニングにおいてC言語と同等のパフォーマンスを達成できることを示しています。

WeZZard/jlens-qwen36

Apple Silicon上のQwen3.6-27B用のビジュアルデバッガーで、ヤコビアンレンズを使用してモデルの内部潜在表現を可視化・編集します。

AlexsJones/llmserve

推論バックエンドとローカルモデルファイルを自動検出してLLMの提供を簡素化する、TUIベースのモデルマネージャー兼サーバーランチャー。

tuchg/Lucarne

ローカルAIエージェントをTelegramとWeChatに接続する軽量なバックグラウンドデーモンで、ユーザーがモバイル通知を通じてリモートでエージェントを監視・制御できるようにします。

NVIDIA-NeMo/Evaluator

ベンチマーク環境、トラフィック管理用のプラグイン式インターセプタープロキシ、およびモデル性能分析用のマルチフォーマットレポート機能を備えたLLM評価フレームワーク。

flagos-ai/FlagTree

FlagTreeは、複数のAIチップ向けの統合オープンソースコンパイラであり、さまざまなTritonベースのバックエンドを統合することで、「一度開発すればどこでも実行可能」なワークフローを実現します。

unslothai/unsloth-zoo

Unsloth用のユーティリティライブラリであり、VRAM要件を大幅に削減しながら、LLM、ビジョン、およびTTSモデルのより高速でメモリ効率の高いファインチューニングを可能にします。

standardagents/composer-api

macOSローカルサーバーで、Composer 2.5やGrok 4.6などのCursorの第一-partyモデルを、OpenAI互換APIエンドポイントとして公開します。

kubeshark/kubeshark

eBPFを使用してトラフィックをインデックスし、MCP統合を通じてAI駆動のトラブルシューティングを提供するKubernetes向けネットワークオブザーバビリティツール。

maxritter/pilot-shell

Claude Code と Codex をラップするプロフェッショナルなコンテキストおよびハーネスエンジニアリングシステムで、プロダクションレベルのソフトウェアに必要な持続可能なコンテキスト、品質ゲート、実行時検証を提供します。

Agent-Field/pr-af

動的パイプラインとエビデンスに基づく検証を使用して深いアーキテクチャ監査を実行し、システム全体の脆弱性を発見するオープンソースのエージェント型コードレビュアー。

NVIDIA/cuvs

ベクトル類似度検索とクラスタリングのためのGPUアクセラレーションライブラリ。AIやデータマイニング向けに、近似最近傍アルゴリズムの高性能実装を提供します。

codelibs/fess

OpenSearch をベースにしたエンタープライズ検索サーバーで、ウェブサイト、ファイルシステム、クラウドデータストアからのドキュメントをクロール・インデックス化し、一元的な全文検索を実現します。

syncable-dev/memtrace-public

AIコーディングエージェント向けの構造的記憶システム。コードベースをローカルで、二時相の知識グラフに変換し、高速で低コストなアーキテクチャクエリを可能にする。

JuliaDynamics/Agents.jl

エージェントが環境や互いに反応するシミュレーションを可能にする、高性能な Julia フレームワークです。

Haervwe/open-webui-tools

Open WebUI 用の 20 以上のツール、関数パイプ、フィルターを包括的に収集したもので、学術研究、マルチモーダル生成、自律型エージェント機能を追加します。

kiwifs/kiwifs

AIエージェントと人間の両方にとって書き込み可能で検索可能、バージョン管理可能なMarkdownファイルシステム。ネイティブなMCPサポートとGitベースの監査ログを備えています。

agentic-in/inferoa

ループエンジニアリング向けに設計された、推論ネイティブなエージェント。トークン使用とキャッシュ再利用を最適化し、効率的で長期的な再帰 AI ワークフローを維持します。

leyten/shard

VRAMと計算能力を分散型GPUから集約し、オープンインターネット上で巨大AIモデルを実行するためのプロトコルとエンジン。

9tigerio/db2rest

データベース向けに安全なエンドポイントを自動作成し、AI やデータ駆動型アプリケーションの開発を高速化する、ローコード REST API プラットフォームです。

bghira/SimpleTuner

画像、動画、音声生成モデルのファインチューニング向け包括的なトレーニングフレームワーク。使いやすいWeb UIと企業向けオーケストレーションを備えています。

lucienhuangfu/eLLM

CPU サーバー向けの LLM 推論フレームワークで、メモリ使用量を最適化し、長期間・マルチターン推論および超長コンテキストタスクにおいて GPU を上回る性能を実現します。

jjang-ai/mlxstudio

Apple Silicon 上で MLX フレームワークを使用してローカルに LLM、VLM、画像生成モデルを実行するためのネイティブ macOS デスクトップアプリ。

openvinotoolkit/model_server

OpenVINO Model Server (OVMS) は、OpenAI互換のRESTまたはKServe gRPC APIを介してLLM、ビジョン・ランゲージモデル、および古典的なディープラーニングモデルを提供するC++推論サーバーです。Intel CPU、GPU、NPUに最適化されており、継続的バッチ処理、ストリーミング、モデルバージョニング、ホットリロード、Prometheusメトリクスなどの機能を提供します。Docker、バーマルバイナリ、Kubernetes経由でデプロイ可能で、TensorFlow、ONNX、OpenVINO IR、GGUFなど多くのモデルフォーマットをサポートし、標準的なクライアントライブラリと統合可能です。

john-rocky/CoreML-Models

iOSおよびmacOSでデバイス上でのAIを実装するための、事前に変換されたCore MLモデルとサンプルアプリの包括的なコレクション。

weslynn/AlphaTree-graphic-deep-neural-network

論文、コード、ディープラーニングモデルの図をリンクさせた、開発者が AI アプリケーションエンジニアリングへ移行するための構造化されたビジュアルロードマップとリソースコレクションです。

Nixtla/neuralforecast

時系列予測における高いパフォーマンス、使いやすさ、および効率性を実現するために設計された、30種類以上の最先端のニューラル予測モデルのライブラリ。

plurai-ai/intellagent

会話型 AI エージェントを何千もの現実的なエッジケース対話でストレステストし、失敗ポイントを発見してパフォーマンスを最適化するマルチエージェントフレームワーク。

GoogleCloudPlatform/agent-starter-pack

Google Cloud 上で GenAI エージェントを構築するための、プロダクション対応テンプレートとインフラ自動化を提供する Python パッケージです。プロトタイプから本番環境への移行をシンプルにします。

lumina-ai-inc/chunkr

レイアウト分析とOCRを使用して、PDF、PPT、Wordドキュメント、画像を構造化されたRAG対応チャンクに変換するオープンソースのドキュメントインテリジェンスAPIです。

automl/auto-sklearn

scikit-learn推定器のドロップインリプレースとして機能する自動機械学習ツールキットで、モデル選択とハイパーパラメータチューニングを自動化します。

auto-differentiation/xad

パフォーマンスが求められるシステム向けに、低実行時オーバーヘッドで前向きおよび逆向きモードの自動微分を提供する高性能 C++ ライブラリ。

mcpware/cross-code-organizer

AIコーディングツール用のクロスハーネス設定オーガナイザーで、メモリ、スキル、MCPサーバーを管理する統合ダッシュボードを提供し、トークン使用量を最適化し、ツールポイズニングを検出します。