Nagi-ovo/voyager

Gemini、Claude、ChatGPT の各AIインターフェースにフォルダ構成、プロンプトライブラリ、高度なナビゲーションツールを追加するブラウザ拡張機能。

web-infra-dev/midscene

自然言語の指示を使用して、Web、モバイル、デスクトップのUIを自動化・検証できるビジョン駆動のGUIエージェント。

Kiterlin/anti-defensive-writing

学術的および専門的な文章における防御的な書き方や過度な回避表現を排除し、より権威ある直接的な表現にするための、オープンなエージェントスキルとプロンプト標準。

mnemosyne-oss/mnemosyne

Mnemosyne は、ローカルファーストでSQLiteをバックエンドに持つAIエージェント向けのメモリレイヤーです。3段階のアーキテクチャ(作業メモリ、エピソードメモリ、時間的知識グラフ)により、セッション間で持続的なメモリを提供し、意味的/キーワードハイブリッド検索、高度なベクトル圧縮、Python SDK、CLI、組み込みMCPサーバーを備えています。プライバシーに重点を置き、テレメトリなし、デフォルトでローカル、クライアント側暗号化同期をオプションで提供しています。

letta-ai/letta

長期記憶を持つ状態保持型AIエージェントを構築するためのフレームワーク。時間とともに学習し、パフォーマンスを向上させることが可能。

janhq/jan

プライバシーを重視したオープンソースの ChatGPT 代替品で、ユーザーが自宅のハードウェア上でLLMをローカルに実行するか、統一されたデスクトップインターフェースを介してクラウドAIサービスに接続できます。

milvus-io/milvus

Milvus は、膨大な非構造化データの効率的な検索と整理が必要な AI アプリケーション向けに構築された、高性能で分散型のベクトルデータベースです。

wiltodelta/remove-ai-watermarks

AI生成画像や動画から可視ラベル、不可視ピクセル透かし、AI出所メタデータを除去するライブラリおよびCLIツール。

EverMind-AI/Raven

Ravenは、長期記憶、プロアクティブ性、ローカルトレーシングを統合したオープンソースで自己改善可能なエージェントハーネスであり、長時間実行されるAIエージェントワークフローに適しています。

nicobailon/pi-subagents

Pi用のデリゲーションフレームワークで、親セッションがコードレビュー、調査、並列実装などのタスク用に専門的な子エージェントを生成できるようにします。

unclebob/swarm-forge

AIエージェントを隔離されたgit worktreeとtmuxセッションで管理し、作業を交換するための耐久的ハンドオフプロトコルを使用する協調フレームワーク

aipoch/open-science

AIエージェント、Python/R実行、すべての研究アーティファクトの追跡可能なプロヴァンスを組み合わせることで、再現可能な科学を実現するオープンソースでローカル優先のAI研究ワークベンチです。

Kilo-Org/kilocode

VS Code、JetBrains、およびCLI向けのオープンソースAIコーディングエージェント。コード生成、デバッグ、自律的なCI/CD操作のために500以上のモデルへのアクセスを提供します。

remotion-dev/skills

Remotionで動画を作成するためのAIコーディングアシスタントに最適な実践法と専門的なコマンドを提供するエージェントスキルのコレクションです。

GangTailorUpgrade/undress-service

Dress AI Serviceは、オープンソースで自己ホスト可能なFastAPIアプリケーションで、衣類の写真をアップロードし、CLIPで自動タグ付け、ルールベースの論理とオプションのLLM推論でコーデを提案、Stable Diffusion/FLUXでビジュアル化します。DockerまたはローカルPython環境で動作し、SQLite/PostgreSQLにデータを保存。天候対応スタイリング、分析機能、軽量なHTML/Tailwind UIを備えています。

rajudandigam/agent-inspect

TypeScript AIエージェントのための、実行トレースを読みやすいツリー形式に変換し、CIでの決定論的な軌跡チェックを実現する、ローカルファーストのオブザーバビリティおよびデバッグツール。

microsoft/agent-lightning

既存のエージェントハーネスに変更を加えることなく、強化学習でAIエージェントを訓練できる軽量なエージェント型RLフレームワークです。

google-antigravity/antigravity-cli

コードベースを理解し、マルチファイル編集とコマンド実行を行うターミナルベースのAIコーディングエージェント。速度とリモートSSH効率に重点を置いている。

vllm-project/vllm-omni

vLLMを拡張して、テキスト、画像、音声、ビデオ、およびアクション出力を様々なハードウェアバックエンドにわたって提供する、オムニモダリティモデル向けの高性能サービングフレームワーク。

docwriter-org/plain-writing-skill

AIエージェントが明確で簡潔なスタイルで文章を書くことを可能にする、プレーンテキスト形式のルールと指示のセット。

huggingface/tau

読みやすく、ターミナルベースのコーディングエージェントで、コードの編集とコマンドの実行が可能。機能的なツールとしてだけでなく、エージェントシステムの構築を学ぶための教育的例としても設計されています。

anysearch-ai/anysearch-skill

一般ウェブ検索、垂直分野検索、および完全なページコンテンツ抽出をサポートする、AIエージェント向けの統合型リアルタイム検索エンジンスキル。

RizRiyz/luvus

永続ワークスペース、エージェント状態の追跡、ワークフローのオーケストレーションを提供する、AI コーディングエージェント向けのターミナルベースのミッションコントロール。

Ariescar/anyCreature

テキスト記述を、マルチステージの設計と検証プロセスを経て、ゲーム用に最適化されたアニメーション付き3Dクリーチャー(GLB形式)に変換するAI駆動のパイプライン。

Aisland-SJL/dsh-worktable

DeepSeek Harness 用のエージェントプロジェクトワークベンチで、ドッキング可能なマルチウィンドウワークスペースと、AIプロジェクトをリアルタイムで監視できるコントロールルームを提供します。

bytedance/UI-TARS-desktop

視覚認識と精密なGUI操作を通じて、デスクトップアプリケーションやウェブブラウザの自然言語制御を可能にするマルチモーダルAIエージェントスタック。

roboflow/supervision

データロード、可視化、およびデータセット管理のためのモデルに依存しないビルディングブロックを提供する、コンピュータビジョンツールキットです。ビジョン・アプリケーションの開発を加速させます。

gpustack/gpustack

スケーラブルなAIモデルサービングのためのオープンソースGPUクラスタマネージャー。推論エンジンをオーケストレーションし、GPUインスタンスをプロビジョニングします。

getmaxun/maxun

Maxunは、スクレイピング、クロール、および情報抽出(PDFや画像を含む)を行い、AIに即座に利用可能なクリーンな形式で出力する、オープンソースのノーコード・ウェブ・データ・プラットフォームです。ビジュアル・ロボット、LLM駆動の抽出モード、CLI/SDK、およびセルフホストが可能であり、LLMアプリケーションのためのデータセットとAPIを構築するための実用的なツールです。

SimoneAvogadro/android-reverse-engineering-skill

R8でオブフスケートされたバイナリからHTTP APIを抽出し、元のKotlinクラス名を回復するためのClaude Codeスキル。

Dryxio/reagent

Ghidra と LLM を使用して、自律的なパイプラインを通じてコンパイル済みバイナリから C/C++ 関数を再構成および検証する AI パワードのリバースエンジニアリングエージェント。

onlook-dev/onlook

Next.js と TailwindCSS のための、ブラウザ上で UI を視覚的にデザインし、AI を使用して変更をコードベースに直接同期できるオープンソースのビジュアルファーストなコードエディタです。

Forget-C/Jellyfish

脚本の分解からアセットの一貫性管理、動画生成に至るまで、ショートドラマの全パイプラインを管理するエンドツーエンドのAI制作ワークスペース。

ant-research/4DAnyone

4DAnyoneは、人物の単一カメラ映像を、数十の同期的かつ視点一貫性のある動画(6〜24〜48視点)に変換する研究用ニューラルモデルで、下流の4Dガウススプラッティング再構成に使用できます。コンシューマーグラフィックスカード(最大24GB VRAM)で動作し、高速なディスティル版Turboモデル(5.6倍高速化)を提供。推論スクリプトとnerfstudio統合も用意されています。

palmier-io/palmier-pro

タイムライン上でAIエージェントがコンテンツの作成と編集を直接行えるようにする、組み込み型生成AIとMCP対応のmacOS用ビデオエディタ。

Open-LLM-VTuber/Open-LLM-VTuber

オープンソースの音声インタラクティブ AI コンパニオンで、Live2D アバターと視覚認識を備え、完全にオフラインで動作し、プライベートなリアルタイム会話が可能です。

alchaincyf/darwin-skill

9次元の評価基準とラチェット機構を使用して、エージェントスキルを段階的に最適化するフレームワーク。品質の向上のみを保証する。

hang-jin/editaplot

人間が関与するデータ確認を通じて科学的正確性を保証する、Originで編集可能な科学図表を作成するAIガイド付きワークフロー。

junhoyeo/tokscale

複数のAIコーディングエージェントにおけるトークン使用量とコストを追跡するための高性能CLIツールと可視化ダッシュボード。

keslr/keslr_connect

Keslr ネットワークと統合するためのTypeScriptパッケージのセット。信頼グラフ認証とプライベートネットワークアドレス指定により、アプリケーションへのアクセスを検証済みの人間のみに制限します。

tsunehimatoi/psd2live

レイヤー付きPSDファイルを完全にリグgedされたLive2Dモデルに変換する自動化パイプラインとデスクトップアプリ。適応的メッシュ生成、自動デフォーマー設定、AIエージェント統合を備える。

chatboxai/chatbox

ChatGPT、Claude、およびその他のLLMのための、統一されたインターフェースとプライバシー向上のためのローカルデータストレージを提供するクロスプラットフォームのデスクトップおよびモバイルクライアント。

ChenShuo2004/cs-board

cs-board は、中国語のテキスト、参照音声、およびオプションのスタイル/キャラクター画像を入力すると、完全にレンダリングされたホワイトボードスタイルのMP4に変換するローカル実行型AI動画制作ワークステーションです。音声クローン(IndexTTS経由)、スクリプト分割、AI生成イラスト、手書きアニメーション、字幕、音声・映像同期を処理し、12種類のビジュアルテンプレート、カスタムキャラクター/スタイル対応、動的インフォグラフィック、LANベースの協働キューを提供します。

1CatAI/1Cat-vLLM

NVIDIA Tesla V100 GPU向けに高性能なLLM推論を復元する最適化されたvLLMフォーク。アテンションデータフローの再構築と予測デコードの追加により、性能を回復。

RapidAI/RapidOCR

PaddleOCRモデルをONNX形式に変換し、複数のプラットフォームと言語で高速でリソース消費が少ないオフラインデプロイメントを実現するオープンソースOCRツール。

ArcReel/ArcReel

構造化された生成パイプラインを介して、脚本や小説を一貫性のあるショートビデオに変換する、オープンソースのセルフホスト型AIビデオ制作ワークベンチ。

verl-project/verl-omni

マルチモーダル生成モデルのための汎用的なRLトレーニングフレームワークであり、拡散モデルおよびオムニモーダルモデルに対して高速なロールアウトと安定したポストトレーニングを提供します。

strelov1/freehire

企業の採用ページから直接数百万件の求人情報を取得し、AI駆動の履歴書最適化ツールと応募管理機能を提供するオープンソースのIT求人集約ツール。