timwuhaotian/the-pair
Mentorエージェントがレビューし、Executorエージェントがコードを書くことで、相互検証により幻覚を低減するオープンソースAIペアプログラミングアプリ
langchain-ai/langconnect
FastAPI と LangChain を使用して構築された RAG サービスで、PostgreSQL と pgvector を使ってドキュメントコレクションの管理と意味的検索を実行する REST API を提供します。
SomeB1oody/RustyML
C/C++ 依存なしの完全な Rust ベースの機械学習・ディープラーニングライブラリ。データ前処理からモデル評価まで、一連のワークフローを提供します。
SciML/SciMLBenchmarks.jl
科学機械学習と方程式ソルバーのための包括的なベンチマークスイートで、さまざまな数値手法にわたる作業精度効率を測定します。
Weistrass/DyRef
動的報酬最適化を使用して、画像生成モデルが異なる種類の複数の参照画像を正確に組み合わせることを可能にする二段階トレーニングフレームワーク。
ussoewwin/ComfyUI-QwenImageLoraLoader
Nunchaku Qwen‑Image、Z‑Image‑Turbo、Krea2 ControlNetモデル用のLoRA重みをロード・スタックするComfyUIカスタムノードのセット。UIコントロール、実験的AWQ調整層サポート、DiffSynth ControlNet統合を備える。
ascorbic/am-i-vibing
Node.js アプリケーションが AI エージェントや AI 駆動のコーディング環境によって実行されているかどうかを検出し、出力を適応させるためのライブラリおよび CLI ツール。
tianclll/Ace-Translate
プライバシーに焦点を当てたオフラインのドキュメント翻訳ツール。ローカル LLM と OCR を使用し、元のレイアウトを保持したまま多様なファイル形式を翻訳します。
jiaxiaogang/HE
he4oは、Helixエントロピー低減理論に基づくAGIシステムであり、事前に設計されたルールと動的学習を組み合わせることで、身体的知能と生涯学習を実現します。
SciML/DiffEqGPU.jl
微分方程式ソルバー向けの GPU アクセラレーションライブラリであり、多数のパラメータと初期条件にわたる並列求解を可能にします。
scottvr/wtffmpeg
自然言語で動画や音声処理タスクを記述すると、LLM を使って実行可能な ffmpeg コマンドに変換するコマンドラインツールです。
stereolabs/zed-ros2-wrapper
Stereolabs ZED 深度カメラ用の公式 ROS 2 ラッパー。画像、深度、ポイントクラウド、SLAM、物体検出、ボディトラッキング、GNSS フュージョン、シミュレーション対応。Ubuntu に ZED SDK と CUDA をインストールし、`ros2 launch zed_wrapper zed_camera.launch.py` で起動可能。
virgo777/buddyme
複数の LLM プロバイダーにわたる複雑なタスクの分解と実行を自動化し、組み込みのスケジューリングと永続メモリを備えた Python ベースの AI エージェントフレームワーク。
openclimatefix/graph_weather
GenCastやAuroraなどのモデルを含む、気象予測とデータ同化のためのさまざまなグラフニューラルネットワークを実装するPyTorchライブラリ。
netdur/llama_cpp_dart
Flutter アプリで iOS および Android 上で LLM、ビジョン、音声モデルをローカルに実行できる、Dart FFI バインディング。
javifalces/HFTFramework
JavaとPythonで構築された高頻度取引フレームワーク。統一されたコードベースにより、L2ティックデータのバックテストとライブ市場実行を可能にします。
microsoft/onnxconverter-common
さまざまなフレームワークからONNX形式にAIモデルを変換するためのコンバーターで使用される一般的なユーティリティおよび関数のコレクションです。
FradSer/mcp-server-mas-sequential-thinking
LLMクライアントにマルチエージェントシステムによる逐次思考を提供するMCPサーバー。専門特化したAIエージェントのチームを通じて各思考を処理し、多次元的な分析を行います。
alesaccoia/VoiceStreamAI
WebSockets、音声活動検知(VAD)、および Faster Whisper を使用した、ニアリアルタイムのオーディオストリーミングと文字起こしのための Python および JavaScript ソリューション。
liangnjupt/VisTouch
ロボットのスライド接触から得られる映像、音声、触覚力データの大型同期データセット。素材認識とクロスモーダル学習に使用される。
RoboDK/RoboDK-API
産業用ロボットのシミュレーションとオフラインプログラミングのための多言語API。開発者はベンダー固有の言語ではなく、汎用言語を使用してあらゆる産業用ロボットアームをプログラミングできます。
graspnet/graspnetAPI
GraspNet-1Billion データセット用の Python API。ロボットの把持研究のための把持ラベルと点群データをロード、処理、検証するためのツールを提供します。
google-research/language-table
オープンボキャブラリーの視覚言語運動学習のための、人間が収集したデータセット群とベンチマーク。ロボットが多種多様な自然言語の指示を実行できるようにします。
ClemensElflein/xESC
ロボット工学向けに特別設計された、FOCおよび複数の制御モードをサポートする、ブラシレスDCモーター用のオープンソース・低コスト電子速度コントローラー(ESC)。
PeterFWS/Structure-PLP-SLAM
単眼、RGB-D、ステレオカメラに対応する、点、線、平面を用いた効率的なスパースマッピングとローカライゼーションを実現する視覚SLAMシステム。
livekit/rust-sdks
LiveKit の Rust クライアント SDK。デスクトップおよびモバイルプラットフォーム全体で、リアルタイムのビデオ/オーディオ/データストリーミング、ルーム管理、およびハードウェア加速エンコーディングを可能にします。
cyberbotics/webots_ros2
ROS2のメッセージ、サービス、およびアクションを使用して、Webots 3Dシミュレータ内のロボットをシミュレートするためのインターフェースを提供するパッケージ。
vikashplus/robohive
OpenAI-Gym API を介して公開される MuJoCo シミュレート環境とタスクのコレクションを提供する、ロボット学習のための統一されたフレームワーク。
Firmament-Autopilot/FMT-Firmware
モデルベース設計を用いて迅速な制御システム開発と自動コード生成を可能にする、自律走行車両向けの高性能組み込み自動運転システム。
UM-ARM-Lab/pytorch_kinematics
PyTorch向けの並列化・微分可能なロボット運動学ライブラリ。高速な順運動学、逆運動学、およびヤコビ行列の計算を提供します。
rsasaki0109/lidar_slam_ros2
センサバグをAutoware互換のマップバンドル(点群と自動生成されたlanelet2ファイル)に変換するROS 2 LiDAR SLAMシステム。
snape/RVO2
C++ライブラリで、数千の独立したロボットやエージェントが通信なしに共有空間を衝突せずに移動できるようにする最適相互衝突回避(ORCA)を実装しています。
Phylliade/ikpy
URDFおよびMuJoCo MJCFのインポートをサポートし、加速されたJAXバックエンドを備えた純粋なPythonによるロボットの逆運動学計算ライブラリ。
IDEA-CCNL/Fengshenbang-LM
中国語の事前学習済み基盤モデルのオープンソース・エコシステム、および自然言語理解、生成、マルチモーダル・タスクをサポートするフレームワーク。
gokayfem/ComfyUI_VLM_nodes
ビジョン・ランゲージ・モデル向けの本番向けComfyUIノードスイート。構造化された検出・セグメンテーション・適応型動画推論をVRAM最適化で提供。
jim60105/docker-whisperX
WhisperX用の最適化されたDockerイメージのコレクション。単語レベルのタイムスタンプと話者分離を提供するASRモデルを事前にバンドルし、高速かつ効率的な音声認識(音声→テキスト変換)を実現します。
TalAter/annyang
音声認識を使用して、音声コマンドでウェブサイトを操作できるようにする軽量なJavaScriptライブラリ。
MatteoFasulo/Whisper-TikTok
OpenAI-WhisperとEdge TTSを使用して、自然なナレーション付きの字幕入りTikTok動画を自動生成するAIツール。
wildminder/ComfyUI-VoxCPM
VoxCPM(トークナイザー不要のTTSシステム)のComfyUIカスタムノード統合。表現力豊かな音声生成、自然言語による音声設計、高度なボイスクローニングを可能にします。
thiswillbeyourgithub/AnkiAIUtils
AIが自動的にAnkiのフラッシュカードに画像、記憶術、説明を生成して学習効率を向上させるAIツールのセット。
microsoft/ai-dev-gallery
Windows開発者がローカルAIモデルを探索し、それらをC# Visual Studioプロジェクトとしてエクスポートできる、インタラクティブなAIサンプルギャラリー。
MochiDiffusion/MochiDiffusion
Apple Silicon上でStable DiffusionとFLUX.2 Kleinをローカルで実行するためのmacOSネイティブアプリケーション。Core MLにより、高いパフォーマンスと低メモリ使用量を実現。
1ay1/agentty
C++26を搭載した超高速のターミナルコーディングエージェントで、ローカルRAGとマルチモデルオーケストレーターを使用して、Claude Codeに代わる軽量でベンダーに依存しない代替手段を提供します。
sb-ai-lab/RePlay
データの前処理から本番環境へのデプロイまで、レコメンデーションシステムの開発と評価のためのフルパイプラインをカバーする高度なフレームワーク。
Extraltodeus/ComfyUI-AutomaticCFG
CFGを自動的に再スケールすることで画像アーティファクトと過度な彩度を防ぎ、生成速度を加速させるツールを提供するComfyUI拡張機能。
Faceplugin-ltd/FaceRecognition-Android
Android向けのオンデバイス顔認識およびライブネス検出SDKで、プライバシー保護されたオフラインバイオメトリクスID検証と属性分析を可能にします。
yixuantt/MultiHop-RAG
RAG パイプラインが複数の文書とメタデータを横断して取得・推論する能力を評価するための QA データセットとベンチマークツールです。
aayoawoyemi/Ori-Mnemos
AIエージェント向けのオープンソースの永続メモリインフラストラクチャ。Markdownファイルのナレッジグラフを使用して、認知的忘却と再帰的検索を実装します。