ai-dynamo/nixl
NVIDIA Inference Xfer Library (NIXL) は、AI推論フレームワークにおけるCPU、GPU、およびさまざまなストレージバックエンド間のポイントツーポイントデータ転送を高速化する高性能通信ライブラリです。
laravel/ai
Laravel向けの統合AI SDKで、エージェント、画像、音声の操作に使える一貫したAPIを提供するOpenAI、Anthropic、Geminiなどのプロバイダーに対応しています。
ageerle/ruoyi-ai
マルチエージェント協調、ビジュアルワークフローのオーケストレーション、および高度なRAG技術をサポートする、エンタープライズグレードのフルスタックAIアシスタントプラットフォームです。
Horace-Maxwell/horosa-skill
AIエージェントに106のプロフェッショナルな占星術および神秘学技術を提供するローカルファーストMCPサーバーとCLI。決定論的計算と追跡可能な解釈を保証します。
criptogus/HermesOffice
Microsoft Office形式およびPDFのネイティブでバイト保存型の編集を可能にする、AIを搭載したオープンソースのオフィススイート。統合されたAIエージェントにより、ドキュメントワークフローに直接AI編集を提供。
supabitapp/supacode
macOS のネイティブなコマンドセンターで、各 AI コーディングエージェントに個別の git worktree と永続的なターミナルを提供し、複数のエージェントを並列で実行できるようにします。
kdcokenny/ocx
OpenCode 用の構成とコンポーネント管理ツールで、ユーザーがポータブルで SHA 検証済みのプロファイルとコンポーネントを異なるリポジトリ間で適用できるようにします。
zhimaAi/chatwiki
ChatWikiは、Dockerベースのオープンソースプラットフォームで、WeChat公式アカウントをAIアシスタントに変換します。視覚的なワークフロー編集、自動返信(テキスト、音声、画像、ミニプログラムカード)、スクレイピングまたはアップロードされたドキュメントからの知識ベース作成、ハイブリッドベクトル・グラフ検索、人間への引き継ぎを提供します。バックエンドはGoとPython、フロントエンドはVue.js、PostgreSQL 16とpgvectorで埋め込みを実装。20以上のLLMプロバイダー(例:OpenAI、Claude、DeepSeek)に対応し、Webアプリ、デスクトップクライアント、または他のサービスに埋め込む形でデプロイ可能。個人利用は無料。商用利用には有料ライセンスが必要です。
autonomous-ai/autonomous-os
エージェント推論エンジンとモジュール式スキルシステムを統合し、真の物理的自律性を実現するカスタマイズ可能なロボット向けオペレーティングシステム。
google-deepmind/concordia
物理的、社会的、またはデジタルな環境における実体間の接地された相互作用をシミュレートする、生成的なエージェントベースモデルを構築するためのライブラリ。
google/sam
自律型AIエージェントが分散環境間で安全に発見・通信できるようにする、分散型・ゼロトラストのP2Pネットワークレイヤー。データおよびアイデンティティの完全な主権を維持します。
tsinghua-fib-lab/AgentSociety
都市環境や社会科学の研究ワークフローにおいて、人間の行動を研究するためにLLMベースのエージェント・シミュレーションを構築するためのフレームワーク。
RefoundAI/lenny-skills
Lennyのポッドキャストとニュースレターに基づいた、76の製品管理およびエンジニアリングスキルのマークダウンファイルからなるライブラリ。AIエージェントに専門的な知識とワークフローを提供します。
sktime/sktime
予測、分類、異常検知を含む時系列分析のための統一されたインターフェースを提供する、scikit-learnエコシステムと互換性のあるPythonライブラリ。
jd-opensource/JoyAI-Video-Edit
フレームが到着するたびに、自己回帰拡散を用いてライブ動画ストリームまたはアップロードされた動画をリアルタイムで編集するシステム。
zhongkaifu/TensorSharp
TensorSharpは、CUDA、Vulkan、Metal、Apple-MLX、または純粋なC# CPU上でGGUFフォーマットのLLM、拡散ベースの画像/動画生成、マルチモーダルモデルを実行するネイティブ .NET エンジンです。llama.cppと同等またはそれを上回る性能を発揮し、連続バッチ処理、ページ化KVキャッシュ、テンソル並列、予測的デコード、ツール呼び出し/エージェントスキルをサポート。Ollama/OpenAI互換APIとWeb UIを提供します。
nexu-io/codex-slides
Codexコーディングエージェント向けのオープンソースAIスライドスタジオ。プロンプト、リポジトリ、またはファイルを、制御可能でライブ編集可能なワークフローを通じてプロフェッショナルなプレゼンテーションに変換します。
PhiloLabs/fable51-worlds
テキスト、画像、または動画から検証可能で歩行可能な3D世界を生成するAIエージェントスウォームを用いたシステム。Three.jsアプリとしてコードベースでレンダリングされる。
mkturkcan/DART
TensorRTの最適化と蒸留されたバックボーンを使用して、SAM3をリアルタイムのマルチクラス・オープンボキャブラリー検出器に変換する、トレーニング不要のフレームワーク。
product-on-purpose/pm-skills
AIエージェントがプロンプトの試行錯誤を排除し、高品質なPM出力を標準化するための、68個のプロフェッショナルなプロダクトマネジメントスキル、テンプレート、およびワークフローの厳選されたライブラリ。
ros2/ros2
Robot Operating System (ROS) は、ロボットアプリケーションの開発を支援するためのオープンソースのソフトウェアライブラリおよびツールのセットです。
compozy/compozy
ACP互換エージェントCLIのための、永続セッション、自動化、メモリを管理するデーモンベースのランタイムを提供するAIエージェント用オペレーティングシステム。
vibe-motion/skills
AIエージェントが、3Dレンダリングからブランドプロモーション動画まで、プロフェッショナルな視覚資産を生成できる専門的なアニメーションおよびモーショングラフィックススキルのコレクションです。
PacktPublishing/LLM-Engineers-Handbook
トレーニング、RAG、AWS でのデプロイを網羅した、エンドツーエンド LLM システム構築のための、プロダクションレディなフレームワークとコードベースです。
OSU-NLP-Group/HippoRAG
人間の長期記憶機能を模倣することで、マルチホップ検索と複雑なコンテキストの統合を改善する、LLMのためのメモリフレームワーク。
tuya/TuyaOpen
Tuya Cloud を介して、組み込みデバイス、マルチモーダル AI、および主要な LLM を統合する AI-agent ハードウェア構築のための、クロスプラットフォーム C/C++ SDK およびフレームワーク。
colliery-io/graphqlite
SQLite にグラフデータベース機能と Cypher クエリ言語のサポートを追加する拡張機能で、埋め込みグラフデータの格納と照会を可能にします。
FujiwaraChoki/supoclip
長編動画をバズりやすい縦型クリップに自動変換するオープンソースでAI駆動の動画クリッピングツール。顔クロップ、字幕、バズ性スコアリングを自動で実行。
PetoiCamp/OpenCatEsp32-Quadruped-Robot
OpenCatESP32は、Petoiのオープンソース四足ロボット(Bittle X、Nybble Q、および近日発売予定のQuaddle)をESP32ベースのBiBoard上で動作させるファームウェアです。リアルタイムのガイト制御、モーション記録「パペットモード」、ビジョンや強化学習実験に十分な処理能力を備え、Arduino IDEからプログラミング可能です。
hanlinwenyuan/hlwy-ai-checker
公式APIのベースラインと比較して統計的出力フィンガープリントを照合することで、サードパーティのAI APIプロバイダーが本物のモデルを使用しているかを検証するツール。
owl234/ARL-Next
AIエージェントを使用して資産発見と脅威インテリジェンス収集を自動化する、AIネイティブの資産偵察および脆弱性監視プラットフォーム。
thinking-machines-lab/tinker-cookbook
Tinker APIを介した言語モデルのファインチューニングのための抽象化とレシピのライブラリ。SFT、RL、マルチモーダルトレーニングをサポート。
chen0416ccc-cpu/codex-windows-fast-patch-skill
Windows Codex Desktopでソフトウェア更新後に破損する機能(Fast Mode、Computer Use、プラグインマーケットなど)を修復するスクリプトとエージェントスキルのコレクションです。
su-kaka/gcli2api
Google OAuth資格情報の高度な自動ローテーションと管理機能を備えた、GeminiCLI と Antigravity を OpenAI、Gemini、Claude 互換インターフェースに変換するAPIゲートウェイです。
JuneYaooo/gpt-image2-ppt-skills
gpt-image2-ppt-skills は、OpenAIの gpt‑image‑2 モデルを使用して高品質な 16:9 スライド画像を生成し、それを .pptx ファイルにパッケージ化する Python スキルです。ビジュアル優先モードと、オプションの編集可能モード(ネイティブPowerPointオブジェクトに再構築)をサポートします。ユーザーは自然言語プロンプトで新しいデッキを作成、既存の .pptx テンプレートをクローン、または特定のスライド要素を編集できます。インストールは、対応エージェントにスキルをインストールするか、提供されたスクリプトを実行することで行います。OpenAI APIキーとローカルのPowerPoint/Keynote/LibreOfficeレンダラーが必要です。プロジェクトは Apache‑2.0 ライセンスです。
fxy2311-youyou/expression-trainer
オフライン音声認識とAIを活用したローカルデスクトップアプリ。フィラー語や曖昧な表現を特定し、口頭表現の正確性向上を支援する。
SWivid/F5-TTS
F5-TTSは、Diffusion Transformerとフローマッチングを用いた高性能なテキストから音声への変換システムであり、高速なトレーニングと推論を実現しながら、滑らかで忠実な音声を生成します。
bytedance/flowgram.ai
視覚的なキャンバスと変数管理を備えた、カスタムAIワークフロー プラットフォームを構築するためのコンポーザブルなワークフロー開発フレームワークとツールキット。
Zafer-Liu/Data-Analysis-Agent
自然言語による質問をSQLクエリ、可視化、およびビジネスインサイトに変換する、ビジネスデータ分析用の対話型AIエージェント。
Gsync/jobsync
JobSyncは、Dockerベースの自己ホスト型ウェブアプリで、求人応募、履歴書、タスク、面接質問を管理し、ツールコールをサポートするLLM(ローカルのOllamaまたはクラウドプロバイダー)を活用してAI機能(履歴書レビュー、求人マッチスコア、カバーレター生成、自動求人発見)を提供します。また、外部AIエージェントが直接求人や面接質問を追加できるMCPサーバーも公開しています。
kennss/SiliconScope
sudo 不要の Apple Silicon システムモニター。AI およびメディアワークロードに対して、Neural Engine、Media Engine、メモリ帯域幅の深い可視性を提供します。
microsoft/agent-framework-go
グラフベースのオーケストレーションにより、本番環境向けAIエージェントおよびマルチエージェントワークフローを構築するためのGo実装のMicrosoft Agent Framework。
Anionex/agent-vision-toolkit
画像Q&AおよびGUI自動化のためのタスクに特化した視覚ツールと、シームレスなプロキシ統合を通じて、テキストのみのLLMエージェントに視覚能力を付与するツールキット。
fufankeji/deepseek-harness-studio
DeepSeek Harness用のゼロコードデスクトップアプリで、AIエージェント、プラグイン、ローカルモデル推論を管理するためのビジュアルインターフェースを提供します。
TNTwise/REAL-Video-Enhancer
複数の GPU バックエンドをサポートし、さまざまな専門的なモデルを搭載した、AI ベースの動画フレーム補間および拡大に対応するクロスプラットフォーム GUI アプリケーション。
OpenPetsHQ/openpets
AIコードエージェントがペットの反応や状態を制御できる、アニメーション付きデスクトップペットを提供するプラットフォーム。プラグインSDKとMCP統合を備えています。
only-cli/oc
AIエージェントがウェブを閲覧する際に、過度なトークン消費を防ぐため、ウェブサイトをコンパクトで番号付きの形式に変換するCLIツール。
facebookresearch/map-anything
単一のTransformerモデルを使用して、さまざまな入力の組み合わせから複数の3Dタスクを処理する、ユニバーサルなメトリック3D再構成のためのオープンソース研究フレームワーク。