sjtuyinjie/Ultra-Fusion
ホイール、脚立、空中ロボットのいずれに対しても、センサーの劣化や校正エラーが発生しても正確な位置推定を維持する、頑健で密結合型のマルチセンサーSLAMフレームワークです。
InternRobotics/NavDP
NavDPは、拡散方策を用いたエンドツーエンドのマップレスナビゲーションモデルであり、シミュレーションから現実への転送(シミュレーションから現実への転送)を実現し、異なるロボットエムボディメント間でリアルタイムの経路計画と障害物回避を可能にします。
JordyZomer/lemmalog
Lemmalogは、LLMから抽出された三項式を、検証可能で段階的更新可能なメモリストアに変換するRustベースのDatalogエンジンです。信頼度付き事実、時間的有効性、エンティティ標準化、証明木生成、ハイブリッドBM25+エンティティ検索レイヤーをサポートします。CLI、REPL、またはJSON-RPC MCPサーバー経由で統合され、Claude Code/Kimiエージェントを駆動し、MemEvalスタイルのベンチマークで競争力あるスコアを達成しながら、フルコンテキストベースラインよりもはるかに少ないトークンを使用します。
EmergenceAI/Emergence-World
独自の個性と記憶を持つ自律AIエージェントが、持続的でシミュレートされた世界で社会を築き、自らを統治し、時間とともに進化する様子を研究する世界。
aardio/ImTip
カーソル隣接の入力方法状態インジケータと、翻訳および生産性を向上させるプログラム可能なAI駆動ホットキーを提供するWindowsデスクトップアシスタント。
bytedance/agentkit-samples
AgentKit(Volcengineが提供する企業向けAIエージェントプラットフォーム)のチュートリアルおよびリファレンス実装のコレクション。基本的な対話から複雑なマルチエージェントシステム、RAGまで、すべてをカバー。
zs1083339604/FaceWinUnlock-Tauri
OpenCVとカスタム認証プロバイダーを使用して、ネイティブなWindows Helloハードウェアがないデバイスでも顔認識によるロック解除を可能にするWindows用ツール。
ibm-granite/granite-tsfm
IBMのGranite時系列基礎モデルを用いた予測に役立つユーティリティ、ノートブック、およびサービングコンポーネントのコレクション。
isaac-sim/IsaacLab-Arena
Isaac Lab‑Arena は、NVIDIA Isaac Lab のアルファ版オープンソース拡張で、再利用可能な *シーン*、*エン bodiment*、*タスク* プリミティブを組み合わせてロボットシミュレーション環境を構築できる。実行時にこれらをアセンブルし、シーケンシャルタスクチェーン、自然言語によるオブジェクト配置、大規模並列評価をサポート。一般化ロボットポリシーのベンチマークやトレーニングを容易にする。インストールは `uv` Pythonマネージャーまたは提供されたDockerイメージで可能。Linux専用で、NVIDIA GPUとIsaac Simが必要。プロジェクトはApache 2.0(独自のIsaac Simコンポーネントを含む)で、プロダクションではなく研究目的に向けられている。
microsoft/SwiftStreamingMarkdown
LLMストリーミングに最適化された iOS および macOS 用 Markdown レンダラー。スムーズな遷移、LaTeX サポート、インライン引用 UI を提供。
mavlink/mavlink
軽量でヘッダーオンリーのメッセージマーシャリングライブラリ。ドローンと地上制御ステーション間の効率的な通信に最適です。
cvg/GeoCalib
GeoCalibは、深層ネットワークと幾何最適化を組み合わせた研究用Pythonライブラリで、1枚の画像からカメラの内部パラメータとシーン内の重力方向を予測します。複数のレンズモデル、部分的な事前知識、バッチ処理および複数カメラリグのキャリブレーションをサポートし、インストールが簡単な推論コード、Gradioウェブデモ、Colabノートブック、ライブウェブカメラデモを同梱しています。事前学習済みモデルはOpenPanoデータセット(HDRパノラマから抽出された約37kの透視投影画像)で訓練され、LaMAR、MegaDepth、TartanAir、Stanford2D3Dなどのベンチマークで最先端の結果を達成しています。
prathoshap/vagdhenu
平坦な読み上げではなく、伝統的な旋律による詠唱を生成する、プロダクショングレードのサンスクリット語詠唱テキスト読み上げシステム。
qodo-ai/qodo-cover
コードカバレッジを向上させるために、ユニットテストを自動生成する AI 駆動のツールです。複数のプログラミング言語と様々な LLM プロバイダーをサポートしています。
GetStream/Vision-Agents
リアルタイムのビデオストリーミングと LLM、コンピュータビジョンモデルを組み合わせ、インタラクティブなビジュアル体験を実現する低遅延・マルチモーダル AI エージェント構築用フレームワーク。
NativeSensors/EyeGestures
高価な専用ハードウェアではなく、標準のWebカメラやスマートフォンカメラを使用して、眼制御インターフェースを実装できるオープンソースの眼追跡ライブラリ。
steineggerlab/foldseek
GPU加速を備えた、大規模なタンパク質構造セットの比較およびクラスタリングに適した高速で感度の高いツール。モノマーおよびマルチマー検索をサポート。
GPTomics/bioSkills
bioSkills は、配列I/Oからシングルセル、バリアントコール、構造生物学、ケモインフォマティクス、ワークフロー管理まで、生物情報学解析を実行するための準備済みコードテンプレート(「スキル」)のライブラリです。Claude Code、Codex、Gemini/Antigravity、OpenCode、OpenClaw に対応する軽量スクリプトでインストール可能で、ベストプラクティスのコマンドラインフラグ、例題スクリプト、使用ガイドを提供し、AI生成生物情報学コードの正確性を向上させます。
meta-pytorch/botorch
BoTorch は、確率的モデルと獲得関数を組み合わせるためのモジュール型フレームワークを提供する PyTorch ベースのライブラリです。
google-ai-edge/litert-torch
PyTorchモデルを`.tflite`形式に変換するPythonライブラリで、Android、iOS、IoTデバイス上で高性能なオンデバイス実行を可能にします。
NVIDIA-NeMo/Skills
ローカルワークステーションと大規模GPUクラスタの両方で、合成データ生成、トレーニング、評価をスムーズに行うためのパイプラインのコレクション。
samvallad33/vestige
Vestige は、LLMコーディングエージェント向けのオープンソースでローカル実行可能なメモリレイヤーです。決定を「記憶」として記録し、重複を統合、矛盾を警告し、バグからその原因となった以前の決定まで遡って修正(バックフィル)できます。すべてのデータは開発者のマシン上(SQLite)に留まり、有料Proティアで暗号化同期が可能。インストールは1つのnpmコマンドで完了。ツールは25MBのRustバイナリとして提供され、一度だけ埋め込みモデルと再ランク化モデルをダウンロード後、オフラインで動作します。ベンチマークでは、単純なベクトル検索RAGよりも、正解への収束がはるかに信頼性が高いことが示されています。AGPL-3.0ライセンス。
bybren-llc/safe-agentic-workflow
ClaudeやGeminiなどの様々なAIプロバイダーにわたるマルチエージェントチームを調整するために、SAFe手法を実装した、本番環境でのテスト済みのAIエージェントハーネス。
maxritter/pilot-shell
Claude Code と Codex をラップするプロフェッショナルなコンテキストおよびハーネスエンジニアリングシステムで、プロダクションレベルのソフトウェアに必要な持続可能なコンテキスト、品質ゲート、実行時検証を提供します。
om-ai-lab/VLM-R1
VLM-R1 は、GRPO を使用して R1 スタイルの大規模ビジョン・言語モデルを訓練し、視覚的グラウンディング、数学、物体検出などのタスクにおける推論と汎化を向上させるフレームワークです。
johannesjo/parallel-code
git worktreeを使用して、各タスクを個別のブランチとディレクトリに隔離し、複数のAIコーディングエージェントを並列でディスパッチするためのGUIです。
lmstudio-ai/lmstudio-js
The official JavaScript/TypeScript SDK for LM Studio, enabling developers to integrate local LLMs into applications with advanced memory and hardware controls.
kha-white/manga-ocr
日本の漫画に特化して最適化された OCR ツールで、複数行テキスト、振り仮名、縦書き・横書きのレイアウトを認識できます。
OpenVGLab/OmniLottie
OmniLottie は、事前学習済みのビジョン‑ラングエッジモデルを使用して、テキスト、画像、または動画入力から複雑なベクター Lottie アニメーションを生成するマルチモーダル AI ジェネレーターです。
pyro-ppl/pyro
PyTorch 上に構築された深層確率プログラミングライブラリで、ユーザーが大規模データセット向けに汎用的な確率モデルを作成・スケールさせることができます。
DannyMac180/skills
動的ワークフロー、Claude Codeプラグイン開発、パーソナライズされた学習のためのツールにより、エージェントの機能を拡張するパブリックなAIエージェントスキルコレクション。
vercel-labs/workflow-builder-template
実行可能な TypeScript コードを生成するビジュアルドラッグ&ドロップ式のビルダーを備えた、AI 駆動型ワークフロー自動化プラットフォーム構築用のテンプレートです。
pycaret/pycaret
AutoMLエンジン、実験管理用のコントロールプレーン、そして訓練からデプロイまでの完全なワークフローを実現するWeb UIを組み合わせた、オープンソースのセルフホスト型MLプラットフォーム。
landing-ai/ade-cli
根拠のあるMarkdownと検証可能な証拠(ページとボックス座標)を伴う構造化データに変換する、エージェント型ドキュメント抽出のためのコマンドラインツール。
pocketpaw/pocketpaw
自宅のマシン上でローカルに実行されるセルフホスト型AIエージェントで、ネイティブデスクトップアプリとDiscordやSlackなどの複数のメッセージングプラットフォームとの統合を提供します。
m1ckc3s/claude-status-bar
Claude CodeのAIが作業中、考え中、またはユーザーの許可を待っているかをリアルタイムで示すmacOSメニュー バー アプリ。
openxla/stablehlo
異なるMLフレームワークとMLコンパイラ間の相互運用性を可能にする、MLモデル向けのポータビリティレイヤーおよびオペレーションセット。
drawthingsai/draw-things-community
Draw Thingsアプリのコア画像生成、サンプリング、トレーニングコードを提供するコミュニティリポジトリ。リモート推論用の自己ホスティングgRPCサーバーも含む。
MoonInTheRiver/DiffSinger
歌詞、MIDI、および音高データから高品質な歌声合成およびテキスト読み上げ生成を行うための、拡散モデルベースのフレームワーク。
FalkorDB/GraphRAG-SDK
GraphRAG‑SDK は、ドキュメントから FalkorDB に知識グラフを構築し、そのグラフをたどって質問に回答する Python SDK です。出典エッジ、マルチホップ検索、オプションの拒否機能を追加することで、LLM の幻覚を大幅に削減し、標準的なベクトル RAG を上回るベンチマーク性能を実現しています。pip でインストールし、FalkorDB コンテナを起動し、テキスト(または PDF/Markdown)をインジェスト、`finalize()` を呼び出し、`completion()` でクエリを実行します。スキーマ対応、インクリメンタル更新、カスタムプロバイダをサポートし、Apache‑2.0 ライセンスで提供されています。
Phyzicalorg/Phyzical_org
Vision-Language-Action (VLA) モデルおよび模倣学習ポリシーの訓練のため、人間のデモンストレーションデータをクラウドソーシングするブラウザベースのロボット遠隔操作プラットフォームです。
jdevalk/specification.website
断片化されたWeb標準を1つの参照に統合する、プラットフォーム非依存のWebサイト仕様であり、AIエージェントが読み取れるようにするツールも含む。
alan345/AI-Fullstack-SaaS-Boilerplate
Fastify、React、tRPCを使用したフルスタックSaaSブートストラップで、OpenAI統合によりAI対応のウェブアプリケーションを構築するための事前構成された基盤を提供します。
KINGSTON-115/llm-pid-tuner
ハードウェアまたはシミュレーションからのシステム応答を分析し、最適な制御パラメータを自動的に提案・適用する、LLM支援のPID調整ユーティリティです。
RUC-NLPIR/FlashRAG
FlashRAGは、モジュール式フレームワーク、ベンチマークデータセット、23の最先端検索拡張生成(RAG)手法(推論ベースおよびマルチモーダルアプローチを含む)を提供するPythonライブラリです。密度型、スパース型、ニューラルスパース検索をサポートし、vLLMによる高速LLM推論を実現。また、簡単な設定と評価が可能なWeb UIも提供しています。
woheller69/whisperIME
Whisper エンジンに基づいた Android 用のオフライン音声認識入力メソッド。プライバシーを重視した音声からテキストへの変換および翻訳機能を提供します。
PaddlePaddle/PaddleX
PaddlePaddleを基盤とする低コードAI開発ツール。多様なハードウェア上で迅速なトレーニング、推論、デプロイを実現する事前学習済みモデルパイプラインを提供。
huggingface/optimum
Hugging Face エコシステムの拡張で、対象ハードウェアアクセラレータ上で AI モデルを最大効率で訓練・実行するための最適化ツールを提供します。