timwuhaotian/the-pair

Mentorエージェントがレビューし、Executorエージェントがコードを書くことで、相互検証により幻覚を低減するオープンソースAIペアプログラミングアプリ

langchain-ai/langconnect

FastAPI と LangChain を使用して構築された RAG サービスで、PostgreSQL と pgvector を使ってドキュメントコレクションの管理と意味的検索を実行する REST API を提供します。

SomeB1oody/RustyML

C/C++ 依存なしの完全な Rust ベースの機械学習・ディープラーニングライブラリ。データ前処理からモデル評価まで、一連のワークフローを提供します。

SciML/SciMLBenchmarks.jl

科学機械学習と方程式ソルバーのための包括的なベンチマークスイートで、さまざまな数値手法にわたる作業精度効率を測定します。

Weistrass/DyRef

動的報酬最適化を使用して、画像生成モデルが異なる種類の複数の参照画像を正確に組み合わせることを可能にする二段階トレーニングフレームワーク。

ussoewwin/ComfyUI-QwenImageLoraLoader

Nunchaku Qwen‑Image、Z‑Image‑Turbo、Krea2 ControlNetモデル用のLoRA重みをロード・スタックするComfyUIカスタムノードのセット。UIコントロール、実験的AWQ調整層サポート、DiffSynth ControlNet統合を備える。

ascorbic/am-i-vibing

Node.js アプリケーションが AI エージェントや AI 駆動のコーディング環境によって実行されているかどうかを検出し、出力を適応させるためのライブラリおよび CLI ツール。

tianclll/Ace-Translate

プライバシーに焦点を当てたオフラインのドキュメント翻訳ツール。ローカル LLM と OCR を使用し、元のレイアウトを保持したまま多様なファイル形式を翻訳します。

jiaxiaogang/HE

he4oは、Helixエントロピー低減理論に基づくAGIシステムであり、事前に設計されたルールと動的学習を組み合わせることで、身体的知能と生涯学習を実現します。

SciML/DiffEqGPU.jl

微分方程式ソルバー向けの GPU アクセラレーションライブラリであり、多数のパラメータと初期条件にわたる並列求解を可能にします。

scottvr/wtffmpeg

自然言語で動画や音声処理タスクを記述すると、LLM を使って実行可能な ffmpeg コマンドに変換するコマンドラインツールです。

stereolabs/zed-ros2-wrapper

Stereolabs ZED 深度カメラ用の公式 ROS 2 ラッパー。画像、深度、ポイントクラウド、SLAM、物体検出、ボディトラッキング、GNSS フュージョン、シミュレーション対応。Ubuntu に ZED SDK と CUDA をインストールし、`ros2 launch zed_wrapper zed_camera.launch.py` で起動可能。

virgo777/buddyme

複数の LLM プロバイダーにわたる複雑なタスクの分解と実行を自動化し、組み込みのスケジューリングと永続メモリを備えた Python ベースの AI エージェントフレームワーク。

openclimatefix/graph_weather

GenCastやAuroraなどのモデルを含む、気象予測とデータ同化のためのさまざまなグラフニューラルネットワークを実装するPyTorchライブラリ。

netdur/llama_cpp_dart

Flutter アプリで iOS および Android 上で LLM、ビジョン、音声モデルをローカルに実行できる、Dart FFI バインディング。

javifalces/HFTFramework

JavaとPythonで構築された高頻度取引フレームワーク。統一されたコードベースにより、L2ティックデータのバックテストとライブ市場実行を可能にします。

microsoft/onnxconverter-common

さまざまなフレームワークからONNX形式にAIモデルを変換するためのコンバーターで使用される一般的なユーティリティおよび関数のコレクションです。

FradSer/mcp-server-mas-sequential-thinking

LLMクライアントにマルチエージェントシステムによる逐次思考を提供するMCPサーバー。専門特化したAIエージェントのチームを通じて各思考を処理し、多次元的な分析を行います。

alesaccoia/VoiceStreamAI

WebSockets、音声活動検知(VAD)、および Faster Whisper を使用した、ニアリアルタイムのオーディオストリーミングと文字起こしのための Python および JavaScript ソリューション。

liangnjupt/VisTouch

ロボットのスライド接触から得られる映像、音声、触覚力データの大型同期データセット。素材認識とクロスモーダル学習に使用される。

RoboDK/RoboDK-API

産業用ロボットのシミュレーションとオフラインプログラミングのための多言語API。開発者はベンダー固有の言語ではなく、汎用言語を使用してあらゆる産業用ロボットアームをプログラミングできます。

graspnet/graspnetAPI

GraspNet-1Billion データセット用の Python API。ロボットの把持研究のための把持ラベルと点群データをロード、処理、検証するためのツールを提供します。

google-research/language-table

オープンボキャブラリーの視覚言語運動学習のための、人間が収集したデータセット群とベンチマーク。ロボットが多種多様な自然言語の指示を実行できるようにします。

ClemensElflein/xESC

ロボット工学向けに特別設計された、FOCおよび複数の制御モードをサポートする、ブラシレスDCモーター用のオープンソース・低コスト電子速度コントローラー(ESC)。

PeterFWS/Structure-PLP-SLAM

単眼、RGB-D、ステレオカメラに対応する、点、線、平面を用いた効率的なスパースマッピングとローカライゼーションを実現する視覚SLAMシステム。

livekit/rust-sdks

LiveKit の Rust クライアント SDK。デスクトップおよびモバイルプラットフォーム全体で、リアルタイムのビデオ/オーディオ/データストリーミング、ルーム管理、およびハードウェア加速エンコーディングを可能にします。

cyberbotics/webots_ros2

ROS2のメッセージ、サービス、およびアクションを使用して、Webots 3Dシミュレータ内のロボットをシミュレートするためのインターフェースを提供するパッケージ。

vikashplus/robohive

OpenAI-Gym API を介して公開される MuJoCo シミュレート環境とタスクのコレクションを提供する、ロボット学習のための統一されたフレームワーク。

Firmament-Autopilot/FMT-Firmware

モデルベース設計を用いて迅速な制御システム開発と自動コード生成を可能にする、自律走行車両向けの高性能組み込み自動運転システム。

UM-ARM-Lab/pytorch_kinematics

PyTorch向けの並列化・微分可能なロボット運動学ライブラリ。高速な順運動学、逆運動学、およびヤコビ行列の計算を提供します。

rsasaki0109/lidar_slam_ros2

センサバグをAutoware互換のマップバンドル(点群と自動生成されたlanelet2ファイル)に変換するROS 2 LiDAR SLAMシステム。

snape/RVO2

C++ライブラリで、数千の独立したロボットやエージェントが通信なしに共有空間を衝突せずに移動できるようにする最適相互衝突回避(ORCA)を実装しています。

Phylliade/ikpy

URDFおよびMuJoCo MJCFのインポートをサポートし、加速されたJAXバックエンドを備えた純粋なPythonによるロボットの逆運動学計算ライブラリ。

IDEA-CCNL/Fengshenbang-LM

中国語の事前学習済み基盤モデルのオープンソース・エコシステム、および自然言語理解、生成、マルチモーダル・タスクをサポートするフレームワーク。

gokayfem/ComfyUI_VLM_nodes

ビジョン・ランゲージ・モデル向けの本番向けComfyUIノードスイート。構造化された検出・セグメンテーション・適応型動画推論をVRAM最適化で提供。

jim60105/docker-whisperX

WhisperX用の最適化されたDockerイメージのコレクション。単語レベルのタイムスタンプと話者分離を提供するASRモデルを事前にバンドルし、高速かつ効率的な音声認識(音声→テキスト変換)を実現します。

TalAter/annyang

音声認識を使用して、音声コマンドでウェブサイトを操作できるようにする軽量なJavaScriptライブラリ。

MatteoFasulo/Whisper-TikTok

OpenAI-WhisperとEdge TTSを使用して、自然なナレーション付きの字幕入りTikTok動画を自動生成するAIツール。

wildminder/ComfyUI-VoxCPM

VoxCPM(トークナイザー不要のTTSシステム)のComfyUIカスタムノード統合。表現力豊かな音声生成、自然言語による音声設計、高度なボイスクローニングを可能にします。

thiswillbeyourgithub/AnkiAIUtils

AIが自動的にAnkiのフラッシュカードに画像、記憶術、説明を生成して学習効率を向上させるAIツールのセット。

microsoft/ai-dev-gallery

Windows開発者がローカルAIモデルを探索し、それらをC# Visual Studioプロジェクトとしてエクスポートできる、インタラクティブなAIサンプルギャラリー。

MochiDiffusion/MochiDiffusion

Apple Silicon上でStable DiffusionとFLUX.2 Kleinをローカルで実行するためのmacOSネイティブアプリケーション。Core MLにより、高いパフォーマンスと低メモリ使用量を実現。

1ay1/agentty

C++26を搭載した超高速のターミナルコーディングエージェントで、ローカルRAGとマルチモデルオーケストレーターを使用して、Claude Codeに代わる軽量でベンダーに依存しない代替手段を提供します。

sb-ai-lab/RePlay

データの前処理から本番環境へのデプロイまで、レコメンデーションシステムの開発と評価のためのフルパイプラインをカバーする高度なフレームワーク。

Extraltodeus/ComfyUI-AutomaticCFG

CFGを自動的に再スケールすることで画像アーティファクトと過度な彩度を防ぎ、生成速度を加速させるツールを提供するComfyUI拡張機能。

Faceplugin-ltd/FaceRecognition-Android

Android向けのオンデバイス顔認識およびライブネス検出SDKで、プライバシー保護されたオフラインバイオメトリクスID検証と属性分析を可能にします。

yixuantt/MultiHop-RAG

RAG パイプラインが複数の文書とメタデータを横断して取得・推論する能力を評価するための QA データセットとベンチマークツールです。

aayoawoyemi/Ori-Mnemos

AIエージェント向けのオープンソースの永続メモリインフラストラクチャ。Markdownファイルのナレッジグラフを使用して、認知的忘却と再帰的検索を実装します。