CopilotKit/channels-sdk
AIエージェントをSlack、Microsoft Teams、Discordに接続し、ネイティブなインタラクティブUIとヒューマン・イン・ザ・ループ(人間による承認)を可能にするSDK。
allenai/molmoact2
MolmoAct2は、現実世界のロボット制御および操作に向けた、視覚言語バックボーンと連続的フローマッチングアクションエキスパートを接続するアクション推論モデルのファミリーです。
Gracker/SmartPerfetto
自然言語による質問で、ジャングルやANRなどのパフォーマンスボトルネックを、根拠に基づいた推論で特定するAI駆動のAndroid Perfettoトレース分析ツール。
boldsoftware/shelley
マルチモデルおよびマルチモーダル対応の、モバイルフレンドリーな Web ベースのコーディング・エージェントです。開発者のコード作成・管理を助けます。
volcano-sh/kthena
Kubernetes-native な LLM 推論プラットフォーム。モジュール式に制御・データ平面を分離し、スケーラブルでコスト効率の高いモデルサービングを提供します。
nicolasvonluetzow/GaussianGPT
GaussianGPTは、次トークン予測を用いて3Dガウスシーンを生成するトランスフォーマー基盤のモデルであり、制御可能な3Dシーン生成、補完、アウトペインティングをサポートしています。
nobodywho-ooo/nobodywho
GGUFフォーマットのLLMを、複数のプラットフォームと言語でローカルかつオフラインで実行できる、オンデバイスAI推論エンジンです。
manankharwar/fusioncore
IMU、ホイールエンコーダ、GPS、視覚SLAMを融合する23状態の非線形カルマンフィルタ(UKF)で、屋外ロボットの安定したローカライゼーションを提供。内部診断機能により、静かなるドリフトを防止。
aqm857886159/Nomi
オープンソースでローカル優先のデスクトップワークベンチで、AI動画制作に複数の生成ソースとローカルのComfyUIを組み合わせ、制作コストを削減します。
legeling/PromptHub
プロンプト、スキル、AIプログラミング資産を管理するためのローカルファーストなワークベンチ。複数のAIコーディングツールへのワンクリック配布が可能で、バージョン管理機能も内蔵されています。
AGenUI/AGenUI
iOS、Android、HarmonyOS上でネイティブな生成UI体験を構築する高パフォーマンスなA2UI SDK。大規模言語モデル(LLM)がリアルタイムでインタラクティブなコンポーネントをレンダリングできるようにします。
enricoros/big-AGI
専門家向けのマルチモデルAIワークスペース。ユーザーが独自のAPIキーを提供して、数百のモデルにアクセス可能。マルチモデル検証ツールにより、AIの誤り(ハリューシネーション)を低減する。
undertheseanlp/underthesea
オープンソースのエージェント型 AI ツールキットおよびベトナム語 NLP ライブラリ。複数プロバイダーの LLM 対応と、ベトナム語向けに特化したテキスト処理ツールを提供します。
AnswerDotAI/llms-txt
AIエージェントがウェブサイトのクリーンなコンテンツと要約を簡潔に取得できるようにするため、/llms.txt ファイルの使用を標準化する提案。
Mochocyang/QMAI
長編小説向けの記憶中心のAI執筆デスクトップシステム。構造化メモリインジェストとハイブリッドリトリーバルにより、プロットの穴やキャラクターの漂移を防止します。
naqashafzal/AI-Content-Studio
長編YouTube動画をバズるショート動画に変換し、テキストプロンプトからAI駆動ポッドキャストを生成する自動化AI動画・ポッドキャスト生成ツール。
facebook/ThreatExchange
類似性マッチング用の画像および動画ハッシュアルゴリズムを備えた、コンテンツモデレーションおよびセキュリティ脅威インテリジェンスのためのツールおよびAPIのコレクション。
OctoMap/octomap
オクツリーに基づく確率的3Dマッピングフレームワークで、ロボットが3D環境における占有領域、空領域、未知領域を効率的に表現・追跡できるようにします。
strnad/CrewAI-Studio
CrewAI Studioは、Conda、仮想環境、Docker、またはワンクリックデプロイで簡単にインストールできる、StreamlitベースのGUIです。CrewAIフレームワークで構築されたマルチエージェントAIクルーを設計・実行・エクスポートでき、複数のLLMプロバイダーとカスタムツールをサポートしています。
huggingface/AnyLanguageModel
AnyLanguageModelは、AppleのFoundationModelsインポートを置き換えるSwiftパッケージで、Apple、Core ML、MLX、llama.cpp、Ollama、OpenAI、Anthropic、Geminiなど、多数のLLMプロバイダーに対して統一されたAPIを提供します。`LanguageModelSession`によるプロンプト処理、`@Generable/@Guide`によるSwift構造体のガイド付き生成、デリゲートフックによるツール呼び出しサポート、オプションの画像入力、バイナリサイズを小さく保つためのトレイトベースの依存関係選択を備えています。インストールはSwiftPM経由。バックエンドはトレイト(`CoreML`、`MLX`、`Llama`)で有効化。セキュリティガイドラインでは、APIキーをハードコードしないよう警告し、Keychainにユーザー提供キーを保存するか、プロキシサーバーを推奨。対象はSwift 6.1+、iOS 17/macOS 14+、オンデバイスおよびクラウドAPIの両方に対応。
elara-labs/code-context-engine
フルファイル読み込みをターゲットを絞ったセマンティック検索と取得に置き換えることで、AIコーディングアシスタントのコストを削減するローカルコードベースインデックスエンジン。
NoKV-Lab/NoKV
一時的な AI エージェントサンドボックス向けの耐久的でバージョン管理されたワークスペースプロバイダ。アーティファクトのラインレージと状態の生存を、アトミックなメタデータ制御で保証します。
Topdu/OpenOCR
統合テキスト、数式、表認識およびドキュメント解析を可能にする、軽量モデルを備えたオープンソースのOCRツールキット。
unslothai/unsloth-zoo
Unsloth用のユーティリティライブラリであり、VRAM要件を大幅に削減しながら、LLM、ビジョン、およびTTSモデルのより高速でメモリ効率の高いファインチューニングを可能にします。
open-edge-platform/geti
エッジハードウェアに最適化された、コンピュータビジョンモデルの迅速な構築、アノテーション、トレーニング、デプロイを可能にするエンドツーエンドのビジョンAIアプリケーションおよびライブラリ。
edouard-claude/snip
宣言的なYAMLパイプラインを使用して、AIコーディングアシスタントに到達する前に冗長なシェル出力をフィルタリングするCLIプロキシ。トークン使用量を60〜90%削減可能。
allweonedev/presentation-ai
オープンソースの AI 搭載プレゼンテーションジェネレーターで、トピックからアウトライン優先のワークフローでカスタマイズ可能なスライドを作成します。
rsxdalv/TTS-WebUI
多種多様なオープンソースのテキスト読み上げ、音声生成、および音声変換AIモデルのための、統合されたウェブインターフェースおよびマネージャー。
opengeos/segment-geospatial
Segment Anything Model (SAM) を地理空間データ向けに適応させた Python パッケージで、テキスト、ポイント、またはボックスを使って衛星画像を簡単にセグメントできます。
bashtage/arch
ボラティリティモデリング(ARCH/GARCH)、単位根検定、共統計分析に特化した金融経済統計学用のPythonライブラリ。
toki-plus/video-mover
ファイル監視とAI生成字幕から、ブラウザ自動化によるマルチプラットフォームアップロードまでを一貫して自動化する動画配信パイプライン。
zjunlp/SkillNet
SkillNetは、AIエージェント機能を再利用可能で検索可能なソフトウェア資産として扱うオープンソースインフラです。パブリックスキルライブラリ、Python SDK/CLI、パブリックREST APIを提供し、これらのスキルの検索、ダウンロード、作成、評価、分析、オーケストレーションが可能です。エージェントは既存の機能(例:PDF解析、ウェブスクレイピング)を再発明せずに再利用でき、品質スコアを提供し、スキル関係グラフを構築し、下流LLMエージェント向けのシーン固有プロンプトを生成できます。インストールは`pip install skillnet-ai`だけで完了。検索やパブリックダウンロードにはAPIキー不要ですが、作成/評価/オーケストレーションにはLLM APIキーが必要です。Webエクスプローラー、MCPサーバー、Claude、OpenAI、OpenClaw、JiuwenClawとの統合、ALFWorld、WebShop、ScienceWorld向けベンチマークスクリプトも含まれます。
rpng/MINS
IMU、ホイールエンコーダ、カメラ、GNSS、LiDAR を柔軟に統合する、ロボットの堅牢な局所化とオンラインセンサーキャリブレーションを実現するマルチセンサー補助慣性航法システム。
clidey/whodb
オプションのAIによる自然言語インターフェースを備えた、データの探索、編集、およびクエリを実行するための軽量でセルフホスト可能なデータベースワークスペース。
atong01/conditional-flow-matching
画像、表形式データ、生物学的ダイナミクスの高速生成モデリングを可能にする、シミュレーションフリーな学習を提供する PyTorch ライブラリ。
anliyuan/Ultralight-Digital-Human
短い動画からパーソナライズドトレーニングを行うことで、モバイルデバイス上でリアルタイムに話す頭部を生成するための軽量なデジタル人間モデル。
agentuniverse-ai/agentUniverse
agentUniverse は、Apache-2.0 ライセンスの Python フレームワークで、LLM駆動のマルチエージェントアプリケーションの構築とオーケストレーションを可能にします。即時利用可能な協働パターン(PEER、DOE)、数十のLLMプロバイダー対応、ドメイン知識の注入ツール、OpenTelemetryによる監視性、視覚的ワークフローUIを提供します。アントグループの実際の金融製品で使用されており、GitHub/Discordに広範なドキュメント、サンプルアプリ、コミュニティが存在します。
ouguangjun/Leg-KILO
高動的運動に対応するリアルタイムLiDARベースのSLAMシステム。四足歩行ロボットやその他の移動プラットフォーム向けに、堅牢なオドメトリと地図作成を提供します。
huangjunsen0406/py-xiaozhi
py‑xiaozhi は、音声、視覚、ハードウェア制御が可能なマルチモーダル AI アシスタントを構築するための、非同期優先の Python フレームワークです。
embeddings-benchmark/mteb
埋め込み(embeddings)と検索システムの評価のためのマルチモーダル・ツールボックス。標準化されたベンチマークとリーダーボードを提供し、モデルの性能比較を可能にします。
rapidaai/voice-ai
代理店および企業向けに、ベンダー依存を避けながらスケーラブルでリアルタイムな音声エージェントを構築・デプロイできるオープンソースの音声AIオーケストレーションプラットフォームです。
KdaiP/EchoBot
感情的なコンパニオンとしての役割と技術的な生産性を分離するAIアシスタント。Live2Dアニメアバターを搭載し、没入型ロールプレイとバックグラウンドでの生産的タスクを両立します。
google-github-actions/run-gemini-cli
GitHub Action で Gemini AI を開発ワークフローに統合し、PR レビュー、イシューのトリアージ、および GitHub 内で会話型 AI アシスタンスを自動化する
lucasjinreal/Crane
Craneはcandleに基づくRustベースの推論フレームワークで、CPU、CUDA、Metal、および実験的ROCm上でLLM、ビジョン言語モデル、OCR、ASR、TTS、音楽変換を高速に実行します。GGUFチェックポイントを直接読み込み、クリーンなRust APIとOpenAI互換HTTPサーバーを提供し、チャット、画像チャット、OCR、音声など、即時利用可能なデモバイナリを同梱しています。
opencv/opencv_contrib
OpenCVの公式コア配布版に統合される前の、実験的な機能やコミュニティ提供の追加モジュールをテストするためのリポジトリです。
kaixxx/noScribe
データプライバシーを確保するために研究者やジャーナリスト向けに設計された、ローカル音声文字起こしと話者識別を行うための無料のオープンソースアプリケーション。
specstoryai/getspecstory
さまざまなIDEおよびCLIツールでのAIコーディングアシスタントとのすべての相互作用をキャプチャ、インデックス化し、検索可能な履歴とエージェントスキルとして提供するローカルファーストの知識管理システム。
modelscope/ms-agent
知識駆動型スキルシステムを用いて、深層的な調査、コード生成、マルチモーダルタスクを実行できる自律的エージェントを構築するための軽量なフレームワークです。