CopilotKit/channels-sdk

AIエージェントをSlack、Microsoft Teams、Discordに接続し、ネイティブなインタラクティブUIとヒューマン・イン・ザ・ループ(人間による承認)を可能にするSDK。

allenai/molmoact2

MolmoAct2は、現実世界のロボット制御および操作に向けた、視覚言語バックボーンと連続的フローマッチングアクションエキスパートを接続するアクション推論モデルのファミリーです。

Gracker/SmartPerfetto

自然言語による質問で、ジャングルやANRなどのパフォーマンスボトルネックを、根拠に基づいた推論で特定するAI駆動のAndroid Perfettoトレース分析ツール。

boldsoftware/shelley

マルチモデルおよびマルチモーダル対応の、モバイルフレンドリーな Web ベースのコーディング・エージェントです。開発者のコード作成・管理を助けます。

volcano-sh/kthena

Kubernetes-native な LLM 推論プラットフォーム。モジュール式に制御・データ平面を分離し、スケーラブルでコスト効率の高いモデルサービングを提供します。

nicolasvonluetzow/GaussianGPT

GaussianGPTは、次トークン予測を用いて3Dガウスシーンを生成するトランスフォーマー基盤のモデルであり、制御可能な3Dシーン生成、補完、アウトペインティングをサポートしています。

nobodywho-ooo/nobodywho

GGUFフォーマットのLLMを、複数のプラットフォームと言語でローカルかつオフラインで実行できる、オンデバイスAI推論エンジンです。

manankharwar/fusioncore

IMU、ホイールエンコーダ、GPS、視覚SLAMを融合する23状態の非線形カルマンフィルタ(UKF)で、屋外ロボットの安定したローカライゼーションを提供。内部診断機能により、静かなるドリフトを防止。

aqm857886159/Nomi

オープンソースでローカル優先のデスクトップワークベンチで、AI動画制作に複数の生成ソースとローカルのComfyUIを組み合わせ、制作コストを削減します。

legeling/PromptHub

プロンプト、スキル、AIプログラミング資産を管理するためのローカルファーストなワークベンチ。複数のAIコーディングツールへのワンクリック配布が可能で、バージョン管理機能も内蔵されています。

AGenUI/AGenUI

iOS、Android、HarmonyOS上でネイティブな生成UI体験を構築する高パフォーマンスなA2UI SDK。大規模言語モデル(LLM)がリアルタイムでインタラクティブなコンポーネントをレンダリングできるようにします。

enricoros/big-AGI

専門家向けのマルチモデルAIワークスペース。ユーザーが独自のAPIキーを提供して、数百のモデルにアクセス可能。マルチモデル検証ツールにより、AIの誤り(ハリューシネーション)を低減する。

undertheseanlp/underthesea

オープンソースのエージェント型 AI ツールキットおよびベトナム語 NLP ライブラリ。複数プロバイダーの LLM 対応と、ベトナム語向けに特化したテキスト処理ツールを提供します。

AnswerDotAI/llms-txt

AIエージェントがウェブサイトのクリーンなコンテンツと要約を簡潔に取得できるようにするため、/llms.txt ファイルの使用を標準化する提案。

Mochocyang/QMAI

長編小説向けの記憶中心のAI執筆デスクトップシステム。構造化メモリインジェストとハイブリッドリトリーバルにより、プロットの穴やキャラクターの漂移を防止します。

naqashafzal/AI-Content-Studio

長編YouTube動画をバズるショート動画に変換し、テキストプロンプトからAI駆動ポッドキャストを生成する自動化AI動画・ポッドキャスト生成ツール。

facebook/ThreatExchange

類似性マッチング用の画像および動画ハッシュアルゴリズムを備えた、コンテンツモデレーションおよびセキュリティ脅威インテリジェンスのためのツールおよびAPIのコレクション。

OctoMap/octomap

オクツリーに基づく確率的3Dマッピングフレームワークで、ロボットが3D環境における占有領域、空領域、未知領域を効率的に表現・追跡できるようにします。

strnad/CrewAI-Studio

CrewAI Studioは、Conda、仮想環境、Docker、またはワンクリックデプロイで簡単にインストールできる、StreamlitベースのGUIです。CrewAIフレームワークで構築されたマルチエージェントAIクルーを設計・実行・エクスポートでき、複数のLLMプロバイダーとカスタムツールをサポートしています。

huggingface/AnyLanguageModel

AnyLanguageModelは、AppleのFoundationModelsインポートを置き換えるSwiftパッケージで、Apple、Core ML、MLX、llama.cpp、Ollama、OpenAI、Anthropic、Geminiなど、多数のLLMプロバイダーに対して統一されたAPIを提供します。`LanguageModelSession`によるプロンプト処理、`@Generable/@Guide`によるSwift構造体のガイド付き生成、デリゲートフックによるツール呼び出しサポート、オプションの画像入力、バイナリサイズを小さく保つためのトレイトベースの依存関係選択を備えています。インストールはSwiftPM経由。バックエンドはトレイト(`CoreML`、`MLX`、`Llama`)で有効化。セキュリティガイドラインでは、APIキーをハードコードしないよう警告し、Keychainにユーザー提供キーを保存するか、プロキシサーバーを推奨。対象はSwift 6.1+、iOS 17/macOS 14+、オンデバイスおよびクラウドAPIの両方に対応。

elara-labs/code-context-engine

フルファイル読み込みをターゲットを絞ったセマンティック検索と取得に置き換えることで、AIコーディングアシスタントのコストを削減するローカルコードベースインデックスエンジン。

NoKV-Lab/NoKV

一時的な AI エージェントサンドボックス向けの耐久的でバージョン管理されたワークスペースプロバイダ。アーティファクトのラインレージと状態の生存を、アトミックなメタデータ制御で保証します。

Topdu/OpenOCR

統合テキスト、数式、表認識およびドキュメント解析を可能にする、軽量モデルを備えたオープンソースのOCRツールキット。

unslothai/unsloth-zoo

Unsloth用のユーティリティライブラリであり、VRAM要件を大幅に削減しながら、LLM、ビジョン、およびTTSモデルのより高速でメモリ効率の高いファインチューニングを可能にします。

open-edge-platform/geti

エッジハードウェアに最適化された、コンピュータビジョンモデルの迅速な構築、アノテーション、トレーニング、デプロイを可能にするエンドツーエンドのビジョンAIアプリケーションおよびライブラリ。

edouard-claude/snip

宣言的なYAMLパイプラインを使用して、AIコーディングアシスタントに到達する前に冗長なシェル出力をフィルタリングするCLIプロキシ。トークン使用量を60〜90%削減可能。

allweonedev/presentation-ai

オープンソースの AI 搭載プレゼンテーションジェネレーターで、トピックからアウトライン優先のワークフローでカスタマイズ可能なスライドを作成します。

rsxdalv/TTS-WebUI

多種多様なオープンソースのテキスト読み上げ、音声生成、および音声変換AIモデルのための、統合されたウェブインターフェースおよびマネージャー。

opengeos/segment-geospatial

Segment Anything Model (SAM) を地理空間データ向けに適応させた Python パッケージで、テキスト、ポイント、またはボックスを使って衛星画像を簡単にセグメントできます。

bashtage/arch

ボラティリティモデリング(ARCH/GARCH)、単位根検定、共統計分析に特化した金融経済統計学用のPythonライブラリ。

toki-plus/video-mover

ファイル監視とAI生成字幕から、ブラウザ自動化によるマルチプラットフォームアップロードまでを一貫して自動化する動画配信パイプライン。

zjunlp/SkillNet

SkillNetは、AIエージェント機能を再利用可能で検索可能なソフトウェア資産として扱うオープンソースインフラです。パブリックスキルライブラリ、Python SDK/CLI、パブリックREST APIを提供し、これらのスキルの検索、ダウンロード、作成、評価、分析、オーケストレーションが可能です。エージェントは既存の機能(例:PDF解析、ウェブスクレイピング)を再発明せずに再利用でき、品質スコアを提供し、スキル関係グラフを構築し、下流LLMエージェント向けのシーン固有プロンプトを生成できます。インストールは`pip install skillnet-ai`だけで完了。検索やパブリックダウンロードにはAPIキー不要ですが、作成/評価/オーケストレーションにはLLM APIキーが必要です。Webエクスプローラー、MCPサーバー、Claude、OpenAI、OpenClaw、JiuwenClawとの統合、ALFWorld、WebShop、ScienceWorld向けベンチマークスクリプトも含まれます。

rpng/MINS

IMU、ホイールエンコーダ、カメラ、GNSS、LiDAR を柔軟に統合する、ロボットの堅牢な局所化とオンラインセンサーキャリブレーションを実現するマルチセンサー補助慣性航法システム。

clidey/whodb

オプションのAIによる自然言語インターフェースを備えた、データの探索、編集、およびクエリを実行するための軽量でセルフホスト可能なデータベースワークスペース。

atong01/conditional-flow-matching

画像、表形式データ、生物学的ダイナミクスの高速生成モデリングを可能にする、シミュレーションフリーな学習を提供する PyTorch ライブラリ。

anliyuan/Ultralight-Digital-Human

短い動画からパーソナライズドトレーニングを行うことで、モバイルデバイス上でリアルタイムに話す頭部を生成するための軽量なデジタル人間モデル。

agentuniverse-ai/agentUniverse

agentUniverse は、Apache-2.0 ライセンスの Python フレームワークで、LLM駆動のマルチエージェントアプリケーションの構築とオーケストレーションを可能にします。即時利用可能な協働パターン(PEER、DOE)、数十のLLMプロバイダー対応、ドメイン知識の注入ツール、OpenTelemetryによる監視性、視覚的ワークフローUIを提供します。アントグループの実際の金融製品で使用されており、GitHub/Discordに広範なドキュメント、サンプルアプリ、コミュニティが存在します。

ouguangjun/Leg-KILO

高動的運動に対応するリアルタイムLiDARベースのSLAMシステム。四足歩行ロボットやその他の移動プラットフォーム向けに、堅牢なオドメトリと地図作成を提供します。

huangjunsen0406/py-xiaozhi

py‑xiaozhi は、音声、視覚、ハードウェア制御が可能なマルチモーダル AI アシスタントを構築するための、非同期優先の Python フレームワークです。

embeddings-benchmark/mteb

埋め込み(embeddings)と検索システムの評価のためのマルチモーダル・ツールボックス。標準化されたベンチマークとリーダーボードを提供し、モデルの性能比較を可能にします。

rapidaai/voice-ai

代理店および企業向けに、ベンダー依存を避けながらスケーラブルでリアルタイムな音声エージェントを構築・デプロイできるオープンソースの音声AIオーケストレーションプラットフォームです。

KdaiP/EchoBot

感情的なコンパニオンとしての役割と技術的な生産性を分離するAIアシスタント。Live2Dアニメアバターを搭載し、没入型ロールプレイとバックグラウンドでの生産的タスクを両立します。

google-github-actions/run-gemini-cli

GitHub Action で Gemini AI を開発ワークフローに統合し、PR レビュー、イシューのトリアージ、および GitHub 内で会話型 AI アシスタンスを自動化する

lucasjinreal/Crane

Craneはcandleに基づくRustベースの推論フレームワークで、CPU、CUDA、Metal、および実験的ROCm上でLLM、ビジョン言語モデル、OCR、ASR、TTS、音楽変換を高速に実行します。GGUFチェックポイントを直接読み込み、クリーンなRust APIとOpenAI互換HTTPサーバーを提供し、チャット、画像チャット、OCR、音声など、即時利用可能なデモバイナリを同梱しています。

opencv/opencv_contrib

OpenCVの公式コア配布版に統合される前の、実験的な機能やコミュニティ提供の追加モジュールをテストするためのリポジトリです。

kaixxx/noScribe

データプライバシーを確保するために研究者やジャーナリスト向けに設計された、ローカル音声文字起こしと話者識別を行うための無料のオープンソースアプリケーション。

specstoryai/getspecstory

さまざまなIDEおよびCLIツールでのAIコーディングアシスタントとのすべての相互作用をキャプチャ、インデックス化し、検索可能な履歴とエージェントスキルとして提供するローカルファーストの知識管理システム。

modelscope/ms-agent

知識駆動型スキルシステムを用いて、深層的な調査、コード生成、マルチモーダルタスクを実行できる自律的エージェントを構築するための軽量なフレームワークです。