MooreThreads/torch_musa
torch_musa は、Moore Threads GPU用の **MUSA** バックエンドを追加する PyTorch 拡張です。標準の PyTorch API を模倣しており、`cuda` を `musa` に置き換えるだけで利用可能です。C/C++ 拡張のビルドツール、**mccl** バックエンドによる分散トレーニング、および簡単なセットアップ用の Docker イメージを含んでいます。また、torchvision、torchaudio、およびその他の人気 PyTorch ライブラリの MUSA 対応ビルドも提供しています。事前ビルドされた wheel からインストールするか、MUSA SDK をインストール後にソースからビルドできます。プロジェクトは BSD ライセンスです。
lucidrains/rectified-flow-pytorch
ノイズとデータの間の経路を直線化することで、より効率的な生成モデリングを実現するRectified Flowおよびその変種のPyTorch実装。
Vasco0x4/AIDA
AIDAは、任意のLLM(Claude、Gemini、OpenAIなど)をDockerベースのセキュリティテスト環境を制御するオープンソースの自律的ペネトレーションテストプラットフォームです。エージェントはリコンナイサンス、スキャン、カスタムPythonエクスプロイト、生HTTP操作を実行し、すべてのコマンドと出力を永続的なノートブックに記録します。発見はCVSS 4.0で自動スコア付けされ、PDFレポートとしてエクスポート可能です。プロジェクトにはWebダッシュボード、JWT認証、通知フックが含まれており、組み込みの`aida-pentest`コンテナをより大きなExegolイメージに交換することも可能です。AIDAが発見した実際のCVEがリストアップされており、実用的な影響を示しています。AGPL-v3ライセンスで提供されています。
browser-use/bux
自前の VPS に常時稼働する Claude Code エージェントを、実際のブラウザで実行するためのデプロイメントフレームワーク。Telegram で制御可能。
ARM-software/CMSIS-NN
Arm Cortex-M プロセッサ向けに最適化されたニューラルネットワークカーネルのライブラリ。デバイス内 AI のパフォーマンスを最大化し、メモリ使用量を最小限に抑える。
GalaxyGeneralRobotics/Humanoid-GPT
Unitree G1のようなヒューマノイドロボット向けに、20億フレームで事前学習されたGPTスタイルの人体運動Transformerで、ゼロショット全体運動追跡を実現。
Community-Access/accessibility-agents
複数のプラットフォームにまたがる79の専門的なAIエージェントを提供するコミュニティ主導のプロジェクト。コードおよびドキュメントにおけるアクセシビリティ監査を自動化し、WCAG AA基準を強制します。
glebis/claude-skills
開発、研究、メディア生成、個人分析の分野で複雑なワークフローを自動化する、Claude Code向けの約100の専門的スキルのコレクションです。
Farama-Foundation/MAgent2
多数のエージェントが競争的なシナリオで相互作用するピクセルベースのグリッドワールド環境を作成するためのライブラリ。集団知能の研究に役立ちます。
tuchg/Lucarne
ローカルAIエージェントをTelegramとWeChatに接続する軽量なバックグラウンドデーモンで、ユーザーがモバイル通知を通じてリモートでエージェントを監視・制御できるようにします。
volcengine/veadk-python
Volcengine機能を統合したオープンソースのエージェント開発キットで、AIエージェントの構築、デプロイ、管理を簡素化します。
benchflow-ai/benchflow
AI エージェントをタスク環境に対して実行し、標準化された契約を通じて評価するためのユニバーサル環境フレームワーク。ベンチマークを「凍結された環境」として扱う。
tableau/tableau-mcp
Model Context Protocol (MCP) を使用した開発者用プリミティブのセット。Tableauのデータと分析機能をAIアプリケーションに統合するためのもの。
timoncool/ACE-Step-Studio
ACE-Step 1.5 XLモデルを使用して、ボーカル、歌詞、音楽ビデオを含む完全な楽曲をローカルで生成するAI音楽制作スタジオ。
MoonInTheRiver/DiffSinger
歌詞、MIDI、および音高データから高品質な歌声合成およびテキスト読み上げ生成を行うための、拡散モデルベースのフレームワーク。
mock-server/mockserver-monorepo
API 依存関係をシミュレートし、トラフィックを記録し、AI/LLM チャット補完 API 向けの専門的なモック機能を提供する、テスト用の HTTP(S) モックサーバーおよびプロキシ。
stereolabs/zed-sdk
ZED カメラ向けのクロスプラットフォーム空間知覚 SDK。リアルタイムの深度センシング、物体検知、および位置トラッキングを提供します。
sktime/pytorch-forecasting
Temporal Fusion Transformers や N-BEATS などの最先端のディープラーニングアーキテクチャを備えた、PyTorchベースの時系列予測用ライブラリです。
foxglove/foxglove-sdk
ストリーミングまたは MCAP ファイルを介してマルチモーダルロボティクスデータをログ記録・可視化するためのライブラリ群。Python、C++、Rust、ROS をサポート。
richhickson/claudecodeusage
軽量な macOS メニューバー アプリで、Claude Code の使用制限を追跡し、AI エージェントのセッションがユーザーの注意を必要とするときに通知を提供します。
open-rmf/rmf
Open-RMFは、異なるベンダーのロボットが同じ環境で協調し、連携して動作できるマルチファミリーのロボット管理プラットフォームです。
dheera/rosboard
ROS1 および ROS2 用の軽量なウェブベースの可視化ツールで、任意のデバイスのブラウザからロボットのトピックとデータを監視できます。
postmanlabs/postman-mcp-server
AIエージェントとコーディングアシスタントをPostmanのワークスペース、コレクション、仕様に接続するMCPサーバー。APIテストの自動化とクライアントコードの生成を実現します。
jakobdylanc/llmcord
Discordの返信チェーンを使って会話履歴を管理するデータベース不要の共同型LLMフロントエンドにサーバーを変換するDiscordボット
AlphaAvatar/AlphaAvatar
長期記憶、ペルソナ追跡、自律的計画を備えた、能動的でマルチモーダルな個人用AIアシスタントを構築するための自己ホスト可能なフレームワークです。
microsoft/DCVC
チャンクベースの符号化フレームワークを使用して、高い圧縮効率と高速なエンコード/デコード速度を実現する超高速ニューラルビデオコーデック。
wuwukaka/ComfyUI-WanAnimatePlus
ComfyUIのWanVideoパイプラインにおける拡張機能で、シームレスな動画への接続とマルチリファレンス画像の注入により、AI動画生成の整合性を向上させます。
MatthewCYM/VoiceBench
VoiceBench は、LLMベースの音声アシスタントを評価するためのベンチマークスイートです。音声駆動型 QA および指示追従タスクを備えた Hugging Face データセットを提供し、モデルを実行し、音声応答を収集して自動スコアリングする(GPT-4o-mini を使用)コマンドラインツールキットも提供します。結果は公開リーダーボードに掲載され、リポジトリには最近の音声アシスタント関連論文のリストも含まれています。
alexhernandezgarcia/gflownet
科学的発見における応用を主な目的として、多様で高報酬のオブジェクトをサンプリングするための生成的フローネット(GFlowNets)を訓練するためのPyTorchベースのライブラリです。
knoxgraeme/skillfish
Claude Code、Cursor、Copilot などのツール間でポータブルなプロンプトパッケージをインストール、更新、同期できる、AI コーディングエージェント用の CLI スキルマネージャー。
astroautomata/SymTorch
PySRを使用してモデルコンポーネントを記号方程式で近似し、解釈性を向上させるための、ディープニューラルネットワークの記号蒸留用フレームワーク。
pensarai/apex
ターミナルから直接、自律的なエージェントを使用してブラックボックスおよびホワイトボックスのセキュリティ監査を実行するAI駆動のペネトレーションテストツール。
tesseract-robotics/tesseract
ロボット工学向けの軽量でROS非依存の計画フレームワーク。運動学、衝突検出、環境管理のツールを提供します。
nasa/ogma
NASAのCore Flight SystemやROSなどのシステムに安全な実行時モニタを統合し、リアルタイムC99グルーコードの生成を自動化するツール。
IBM/mcp
AIエージェントがIBM製品およびエンタープライズリソースと安全にやり取りできるようにするModel Context Protocol (MCP) サーバーとツールのコレクションです。
jihe520/mindpocket
Web、モバイル、ブラウザ拡張機能で動作する、サーバーレスでAI駆動の個人用ブックマークシステム。RAGを活用して、自動要約とタグ付けを実現。
zdk/lowfat
CLI 出力をフィルタリングし、AI エージェントに届く前にファイル内容を圧縮することで、AI トークンコストを削減する軽量 CLI ツールです。
DougTrajano/pydantic-ai-skills
Pydantic AIの補完ライブラリで、エージェントがローカルまたはリモートのレジストリからモジュール化されたスキルを読み込み、バンドルされたスクリプトを実行し、段階的公開によりリソースを管理できるようにします。
yo-WASSUP/Good-GYM
RTMPose を使用したリアルタイム姿勢検出と、ウェブカメラによる自動エクササイズ回数カウントを実現する AI フィットネスアシスタント。
chrisryugj/Docufinder
AnythingはWindows/macOS用デスクトップアプリで、HWP、DOCX、PDF、画像などドキュメントをローカルにインデックスし、コンテンツ、ファイル名、または自然言語クエスチョンで検索できます。オプションでGeminiやOpenAI互換エンドポイントを用いたAI Q&Aおよび要約が可能。それ以外は完全にオフラインで動作。高速なフルテキスト検索、リアルタイムフォルダ監視、オリジナルレイアウトでのプレビュー、OCR、Markdownエクスポート、ファイル比較、およびオフライン環境向けの「Lite」ビルドを備えています。フロントエンドはReact/Tauri、バックエンドはRustベースのパーサー/インデクサーで構築され、Business Source Licenseでリリースされています。
oxylabs/oxylabs-ai-studio-py
Oxylabs AI Studio用のPython SDK。自然言語プロンプトを使用して構造化データを抽出するための、AIを活用したウェブスクレイピング、クローリング、およびブラウジングエージェントを提供します。
mir-group/nequip
グラフニューラルネットワークを用いて E(3) 同変な原子間ポテンシャルを構築するオープンソースのフレームワーク。原子エネルギーと力の正確な予測を実現します。
OHF-Voice/speech-to-phrase
Home Assistant 用に設計された高速・ローカルの音声認識システムで、一般的な音声ではなく、特定の既知フレーズやデバイス名を認識します。
facebookresearch/stable_signature
生成 AI モデルの LDM デコーダに不可視ウォーターマークを直接埋め込むシステムで、AI 生成画像を自動的に識別します。
baidu/ERNIE-Image
Baidu が提供するオープンウェイト 8B Diffusion Transformer テキスト‑ツー‑イメージモデルで、テキスト描画、複雑な指示の実行、構造化されたビジュアル構成に優れています。
Alibaba-NLP/VRAG
テキスト、画像、動画を横断して VLM が推論・情報取得できるように、エージェント強化学習を用いたマルチターンマルチモーダル RAG フレームワークです。
imagej/ImageJ
ImageJは、Javaを使用して複数のプラットフォーム上で動作するように設計された、科学画像を処理・分析するためのパブリックドメインソフトウェアです。
pengzhangzhi/Open-dLLM
拡散ベースの大規模言語モデル向けの完全オープンソースフレームワークで、事前学習・データセットから評価・推論までの全パイプラインを提供します。