inclusionAI/LLaDA2.X

100Bパラメータまでスケールアップされた一連の離散拡散大規模言語モデルであり、テキスト生成のための高速な並列デコーディングを提供します。

OpenDriveLab/WorldEngine

WorldEngine は、実際のログから稀で安全上重要なシナリオを自動的に発見し、写実的な3Dガウススプラッティングで再構築し、生成されたシミュレーション結果上で強化学習(RL)を用いてドライブモデルを微調整するオープンソースのトレーニング後処理プラットフォームです。SimEngine(クローズドループシミュレーション)とAlgEngine(トレーニング/評価)の2つのサブシステムを備え、稀なケースベンチマークで大幅な向上を達成し、実世界でのデプロイではゼロのエンゲージメントを実現しています。

databrickslabs/dbldatagen

DatabricksでSparkを使用してスケーラブルな合成データを生成するためのPythonライブラリ。テスト、ベンチマーク、デモ用に設計されています。

peterdsharpe/NeuralFoil

設計最適化において、XFoil よりもはるかに高速かつ信頼性が高い、物理情報に基づく機械学習を用いた翼型空力解析ツール。

scaleapi/scale-agentex

単純なチャットボットから完全自律システムまでスケーラブルに拡張できるAIエージェントの構築・デプロイを可能にするフレームワーク。同期および非同期の両方のワークフローをサポート。

jkawamoto/mcp-youtube-transcript

長時間の動画に対応するページネーションを備えた、AIエージェントがYouTube動画の字幕とメタデータを取得できるMCPサーバー

tiktoken-go/tokenizer

OpenAIのモデルと互換性のあるトークンにテキストをエンコード・デコードできる、純粋なGoによるOpenAIトークナイザーの実装。

gordonmurray/firnflow

オブジェクトストレージを主なバックエンドとして使用し、レイテンシの低い取得を実現するための階層型 RAM/NVMe キャッシュを備えたマルチテナントベクターおよびフルテキスト検索エンジンです。

SoarGroup/Soar

Soarは、知的な行動を示すシステムを開発するための認知アーキテクチャであり、推論と問題解決のためのフレームワークを提供します。

pykt-team/pykt-toolkit

標準化されたデータ前処理と複数のモデル実装を備えた、ディープラーニングによる知識追跡モデルのトレーニングおよびベンチマークのためのPyTorchベースのライブラリ。

pipecat-ai/voice-ui-kit

Pipecat AI音声アプリケーション用のユーザーインターフェースを素早く構築・デプロイできる、ReactベースのUIキットです。

pzqpzq/LSF_MDia

MDia は、LLM の中間推論を再利用可能な「方言カード」(LSF)として形式化する Python ライブラリであり、生成・進化・プロファイリング・ルーティング・監査を実施する決定論的8段階パイプライン(collect → create → evolve → profile → select → run → validate-rules → report)を提供します。ブラックボックス LLM API をサポートし、複数のルーティング計画を備え、100ルールのバンクを含み、テスト評価前に意思決定を固定することで再現性を保証します。リポジトリには API キー不要のトゥイオフラインデモ、豊富なドキュメント、MITライセンス、ICML 2026ポスターおよびarXiv論文への引用が含まれます。

clearbluejar/pyghidra-mcp

Ghidraの逆向エンジニアリング・スイートをLLMエージェントと統合し、自動反コンパイル、意味論的コード検索、およびバイナリ解析を可能にするMCPサーバーです。

yehonathanlitman/Lift4D

Lift4D は、各フレームの3D推定を変形可能なモデルに統合することで、単一視点の「リアル世界」動画から時間的に一貫した4Dアセットを再構成します。

agent-network-protocol/anp

Agent Network Protocol (ANP) の多言語 SDK および参考実装で、AI エージェントが標準化されたインターフェースを通じて、発見・認証・安全な通信を行うことを可能にします。

martin-rizzo/ComfyUI-ZImagePowerNodes

Z-Image Turboモデルに最適化されたComfyUIカスタムノードのコレクション。強化されたスタイル制御、低ステップでの一貫性、および構図の多様性を提供します。

Quantatirsk/qwen3-asr

Qwen3‑ASR は、Qwen3‑ASR モデル(0.6 B および 1.7 B)をラップした自己ホスト型音声認識サーバーです。GPU‑vLLMバックエンドまたはCPU‑Rustバックエンドを自動選択し、OpenAIおよびAlibaba互換のHTTP/WebSocket APIを提供。話者ダイアライゼーション、VADベースのセグメンテーション、バッチ推論をサポート。Docker、カスタムGPUイメージ、オフラインtarボールでデプロイ可能。MITライセンス。

aws/mcp-proxy-for-aws

AWSホストのMCPサーバーにAIアプリケーションやエージェントが接続できるブリッジで、AWS IAM(SigV4)認証を自動的に処理します。

IBM/LNN

LNN は、論理式を重み付きニューラルネットワークとして表現する Python ライブラリであり、矛盾や不完全な知識があっても、解釈可能で微分可能な推論と学習を可能にします。

llt22/talkio

ローカルファーストで、マルチモデル対応の AI チャットクライアント。カスタムキャラクターと MCP ツールサポートにより、異なる AI モデル間でグループ会話が可能。

Lamatic/AgentKit

AgentKitは、70の完成済み「キット」(完全なアプリ、パイプライン、またはテンプレート)を提供するオープンソースSDKです。これらのキットはシンプルな設定ファイルで定義され、視覚的なフロースタジオで編集可能で、サーバーレスで動作するNext.jsアプリとして配布されます。サポートトリアージ、コードレビュー、RAGチャット、採用アシスタント、法務・医療ボットなど、多数のビジネス指向のエージェントをカバーしており、信頼性の高いエンタープライズグレードAIエージェントを即時構築できるプラットフォームです。

Ammaar-Alam/minebench

MineBenchは、『中世の城』のようなプロンプトに対してボクセル座標を出力させる仕組みで、LLMの3次元空間推論能力を評価するウェブベースのベンチマークです。生成物を可視化し、人間による直接比較を可能にし、ブレイディ・テリー法でモデルをランク付けします。プラットフォームには、ペアワイズ投票用のArena、カスタム構築用のSandbox、コミュニティプロンプトのGallery、およびGLB、STL、.vox、.schem形式でのエクスポート機能を備えています。主要なLLMプロバイダーをサポートし、Node.js、pnpm、Dockerでローカル実行も可能です。

yejy53/GenClaw

GenClawは、最終的なレンダリングの前に、実行可能な視覚的スケッチ (SVG, HTML/CSS) を制御可能なキャンバスとして使用する、コード駆動型のエージェンティック・フレームワークです。

redis/agent-memory-server

AIエージェント向けの管理されたメモリレイヤーで、セッションと長期記憶の2層モデルを使用して、セッションをまたいで事実と好みを永続的に保存します。

ammaarreshi/RedAlert2-Mac-iOS-iPad

iOSおよびiPadOS向けに、カスタムRTSタッチコントロールと再構築されたスキーム戦AIを搭載した、Command & Conquer: Red Alert 2およびYuri's Revengeのネイティブ感覚の移植版。

freestylefly/wesight-obsidian

ローカル AI エージェント(Claude Code、Codex、OpenCode)と、ソーシャルメディアおよびプロフェッショナルドキュメント向けのマルチプラットフォーム配信ワークベンチを統合する Obsidian プラグイン。

Entrpi/ds4-on-spark

NVIDIA DGX Spark上でDeepSeek-V4-Flashを高速にサービングするための高性能スタック。連続バッチ処理、予測デコード、大規模コンテキストウィンドウ向けメモリガバナーを搭載。

cvs-health/uqlm

さまざまな不確実性定量化手法を使用して、モデルの出力に信頼度スコアを割り当てる、LLMハルシネーション検出用のPythonライブラリ。

agentscope-ai/Trinity-RFT

探索、トレーニング、データバッファリングを分離することで、多様なRLアルゴリズムとエージェントワークフローをサポートする、LLMの強化学習微調整向けの汎用フレームワークです。

vvvvvjdy/D-OPSD

D-OPSDは、ステップ蒸留拡散モデルが高速推論能力を維持しながら、新しいスタイルや概念を継続的にチューニングできるようにする、オンポリシー自己蒸留フレームワークです。

modelstudioai/cli

Aliyun Model Studio CLI (bailian‑cli) は、Alibaba Cloud の AI プラットフォーム用のターミナルツールで、テキスト、画像、動画、音声のマルチモーダル生成、アセット理解、マネージドエージェントオーケストレーション、データセット検証、ファインチューニング、デプロイ、アカウント管理を実行するためのコマンドを提供します。npm またはワンラインスクリプトでインストールでき、API キーまたは OAuth で認証後、`bl …` コマンドを実行するか、AI エージェントに自然言語プロンプトを翻訳して CLI 呼び出しに変換してもらうことができます。

physiclaw/PhysiClaw

PhysiClawは、ロボットアームとカメラを使用してスマートフォンを物理的に操作するAIエージェントであり、APIやソフトウェアのインストールなしに、あらゆるアプリでのタスクを自動化できます。

mit-acl/mighty

MIGHTYは、UAV、マルチUAVスウォーム、および地上ロボット向けに、エルミートスプラインを使用して高速かつ滑らかな軌道を計画するROS 2ライブラリです。GazeboやRVizなどのシミュレーション、または実機上で動作し、Docker、ネイティブUbuntu、Jetsonのインストールオプションが用意されています。IEEE RA-Lの論文でも紹介されています。

aerostack2/aerostack2

モジュール性とスワーム(群れ)機能に焦点を当てた、自律型マルチエアリアルロボットシステムを構築するための ROS 2 フレームワーク。

visose/Robots

Rhino 8およびGrasshopper用のプラグインで、さまざまな産業用ロボット向けのメーカー固有のコードを作成、シミュレーション、生成できます。

vmayoral/robot_hacking_manual

ロボットのサイバーセキュリティに関する包括的な入門シリーズおよびマニュアル。脆弱性を浮き彫りにし、セキュリティ第一のロボット開発を促進するためのケーススタディとチュートリアルを提供します。

OpenLegged/URDF-Studio

URDF Studio は、URDF/MJCF/USDモデルを編集し、複数のロボットをアセンブリし、多くのフォーマットにエクスポートし、AIアシスタントによる生成と検査が可能なブラウザベースのロボット作成ワークステーションです。React、Three.js、TypeScript、Zustandで構築され、再利用可能な `@urdf-studio/react-robot-canvas` コンポーネントも同梱されています。Apache-2.0 ライセンス。

gazebosim/ros_gz

ROS と Gazebo シミュレータを橋渡しする統合パッケージスイートで、ロボットシミュレーションにおける双方向通信とセンサーデータの転送を可能にします。

real-stanford/umi-on-legs

人間のデモンストレーションとシミュレーションで訓練された全身制御器を組み合わせ、アーム付き四足歩行ロボットに移動操作スキルを実現するためのフレームワーク。

nasa/ogma

NASAのCore Flight SystemやROSなどのシステムに安全な実行時モニタを統合し、リアルタイムC99グルーコードの生成を自動化するツール。

Teddy-Liao/walk-these-ways-go2

Unitree Go2 四足歩行ロボット用の Sim-to-Real 移動制御スターターキット。walk-these-ways フレームワークを unitree_sdk2 アーキテクチャに適応させています。

NVIDIA-ISAAC-ROS/isaac_ros_nvblox

nvblox用のROS 2統合により、視覚ベースの障害物回避を実現するリアルタイム3Dシーン再構築と2Dコストマップ生成が可能になります。

abizovnuralem/go2_omniverse

Nvidia Isaac SimにおけるUnitree Go2およびG1ロボット用の高忠実度デジタルツインプロジェクトで、物理ロボットとその仮想コピー間のリアルタイム同期を実現します。

SJTU-ViSYS/M2DGR

M2DGRは、地上走行型ロボット向けの、豊富なセンサーデータと挑戦的な実世界シナリオを含む大規模・多モーダルSLAMデータセットです。ナビゲーションアルゴリズムのベンチマークとして利用可能です。

RoboVerseOrg/RoboVerse

複数のシミュレーションフレームワークとデータセットを単一のインターフェースに統合する、スケーラブルなロボット学習のための統一プラットフォームおよびベンチマーク。

NetManAIOps/ChatTS

ChatTS は、多変量時系列データをネイティブに理解し、推論できるマルチモーダル LLM であり、ユーザーが数値データに対して対話形式の質問応答を実行できるようにします。

FrigadeHQ/yap

macOS用の軽量でデバイス内音声入力ツール。Appleのネイティブ音声APIを使用して、プライバシーを守りながら、任意のアクティブなアプリケーションに転写されたテキストを貼り付けます。

jamsch/expo-speech-recognition

iOS、Android、Web で一貫した API を提供する、React Native および Expo 向けのクロスプラットフォームライブラリです。