OpenVDN/vdn-minimax-h3

VDN‑Minimax‑H3(VDN‑H3)は、MiniMax H3 をベースにしたハイブリッドアテンション動画拡散モデルです。軽量な線形アテンションブランチと LoRA アダプタを追加することで、768pの高解像度動画をニアリアルタイムで生成可能(例:単一B200 GPUで14秒のクリップを約11秒で生成)。リポジトリには4段階の学習レシピと、FP8およびFlashAttention‑4を活用した最適化された推論コード、詳細なセットアップ手順、性能表が含まれています。

shengjidaguai-china/BossHunter

すべての申請に手動確認を必要としながら、複数の採用プラットフォームで求人収集、AIスコアリング、パーソナライズされたアウトリーチを自動化するAI駆動の求職エージェント。

ace-trump-tech/DeltaForce-OBS-Locker

YOLOv14を用いたリアルタイムオブジェクト検出とターゲットロックシステム。環境の誤検出をフィルタリングし、Delta Forceゲーム内のキャラクターを識別する。

basketikun/chatgpt2api

ChatGPTのウェブ機能をリバースエンジニアリングし、組み込みのアカウントプール管理機能とともに画像生成および編集サービスを提供する、OpenAI互換のAPIプロキシ。

e2b-dev/E2B

AIが生成したコードを実行し、仮想デスクトップとやり取りするための、安全で隔離されたクラウドサンドボックスを提供するオープンソースのインフラストラクチャ。

soumatheusgomes/vibe-coding-toolkit

Claude Code / Codex を disciplined なコーディングチームメイトとして活用できる、ドキュメント化されたワークフローとツールセット(プラグイン、プロンプト、Lintルール、サブエージェントオーケストレーション、メモリ管理)。「スーパーパワーズ」規律、並列サブエージェント、品質ゲート付きESLint設定、完全なオンボーディングPlaybookを含む。

nexu-io/html-anything

allow-scripts allow-same-origin

mukul975/cve-mcp-server

28のセキュリティツールと24のAPIを統合し、AIアシスタントをセキュリティアナリストに変えるMCPサーバー。CVEのトリアージとリスクスコアリングを自動化。

apify/mcpc

Model Context Protocol (MCP) 用のユニバーサルCLIクライアントで、AIエージェントや開発者が標準シェルコマンドでMCPサーバーとやり取りできるようにします。

chenhg5/cc-connect

ローカルマシンで実行中の AI エージェントを、Telegram、Slack、Discord などのインスタントメッセージングプラットフォームに接続してリモート制御するためのブリッジ。

getagentseal/codeburn

CodeBurnは、無料・オープンソースのNode.jsユーティリティで、多数のAIコーディングツール(Claude、Cursor、Codex、Geminiなど)のセッションログをローカルで読み取り、各モデル、プロジェクト、タスクが消費したトークン数と金額を正確に表示します。ターミナルUI、Webダッシュボード、メニューバー/トレイアプリを提供し、無駄なパターン(再読み込み、読み取りと編集の比率の低さ、未使用エージェントなど)を検出し、修正を提案・適用し、予算上限を強制し、モデル効率を比較し、支出をgitコミットと関連付けることもできます。すべての処理はマシン上で行われ、APIキーやデータが外部に送信されることはありません。

shengjidaguai-china/goutoujunshi

多分野の知識ベースを用いてチャットログと関係性のダイナミクスを分析し、感情的なサポートと実行可能なデートアドバイスを提供するAI関係コンサルタントです。

NanmiCoder/cc-haha

マルチエージェントチーム、動的ワークフロー、モデル統合を管理するための視覚的インターフェースを提供するAIコーディング用デスクトップワークベンチ。

Soju06/codex-lb

複数のアカウントをプールしてレート制限を管理し、ダッシュボードで使用状況を追跡するChatGPTアカウント用のロードバランサーおよびAPIプロキシ。

OpenMOSS/MOSS-Transcribe-Diarize

1回の処理で長時間のマルチスプーカー音声の音声認識とスプーカー・ダイアライゼーションを同時に行うエンドツーエンド音声理解モデル。

roboflow/rf-detr

RF‑DETR は、DINOv2 バックボーンに基づくリアルタイムトランスフォーマー基盤のビジョンモデルセット(検出、セグメンテーション、キーポイント)です。`rfdetr` Python パッケージとして提供され、Nano‑2XL の複数サイズバリアントを備え、コア部分は Apache‑2.0、XL/2XL は PML 1.0 ライセンスで利用可能です。COCO および RF100‑VL における最先端の精度‑レイテンシトレードオフを示すベンチマークテーブルを含みます。インストールは `pip install rfdetr` で行い、`model.predict(...)` 1 行で使用可能。`supervision` ライブラリでオプションの可視化も可能。Roboflow プラットフォームではカスタムアーキテクチャ探索用の NAS パイプラインも提供されています。

momozi1996/momo-code

リアルタイムのプロンプトインジェクションと長期的なファインチューニングを組み合わせた、二段階の自己進化システムを備えた AI ベースのコーディングエージェント。

nocobase/nocobase

オープンソースの AI 搭載ノーコードプラットフォームで、ビジネスシステム構築を支援します。ビジュアルインターフェースと AI コーディングエージェント、統合 AI 従業員を組み合わせています。

Yeachan-Heo/oh-my-claudecode

Claude Code 用のマルチエージェントオーケストレーションフレームワークで、専門的なエージェントと複数のAIプロバイダー間で自然言語によるタスク配分を可能にします。

bybit-exchange/svg-diagram

svg‑diagram は、AIコーディングエージェントが生成するSVG図の厳格な視覚スタイルを定義し、そのスタイルに準拠しているかを検証するコマンドラインリンター(`svg‑lint`)を提供するゼロ依存のNodeスキルです。

Project-HAMi/HAMi

複数のワークロード間でGPUやその他のAIアクセラレータリソースを共有・隔離できる、Kubernetesネイティブな仮想化ミドルウェアで、ハードウェア利用効率を向上させます。

ace-step/ACE-Step-1.5

ACE‑Step 1.5 は、言語モデルによる計画とDiffusion‑Transformer音声デコーダーを組み合わせたオープンソース音楽生成ファウンデーションモデルです。RTX 3090で10秒未満でフルソング(10秒〜10分)を生成でき、ベースモデルでは4GB未満のVRAMで動作し、数曲からのLoRA微調整が可能。リポジトリにはGradioとRESTインターフェース、主要OS用の起動スクリプト、複数のモデルサイズ(4 B XLバージョン含む)、歌詞・スタイル・テンポ・楽器構成の高度な制御が提供されています。

vercel/ai

プロバイダーに依存しない TypeScript ツールキットで、統一された API を通じて複数の LLM プロバイダーに対応し、AI 搭載アプリケーションやエージェントを構築でき、UI フックも統合されています。

Jia-Ethan/codex-keysmith

Codex AIプログラミングツールに、ソフトウェアを変更せずにカスタムで取り消し可能な指示を注入して、新しい会話での挙動をカスタマイズするためのツール。

chenxiachan/thoughtdag

グラフベースのインターフェースを使用して、ユーザーがLLMが見るものを明示的に制御・刈り込み、幻覚やトークンの無駄遣いを減らすことができる視覚的なコンテキスト管理ツール。

54yyyu/zotero-mcp

Zotero研究ライブラリをAIアシスタントに接続するMCPサーバー。概念検索、メタデータ取得、PDF注釈分析を可能にします。

dexmal/opendm

OpenDMは、オープンワールドにおけるロボット制御のためのビジョン・言語・アクション(VLA)モデルフレームワークであり、さまざまなロボットエムボディメントにおけるモデルのトレーニング、ファインチューニング、デプロイを支援するツールを提供します。

modem-dev/hunk

AIエージェントが作成した変更セット向けに設計されたレビュー最優先のターミナル diff ビューア。インタラクティブな UI、インライン AI 注釈、複数ファイルナビゲーションを備えています。

stickerdaniel/linkedin-mcp-server

ユーザー自身のログイン済みブラウザセッションを使って、AIアシスタントがLinkedInのプロフィールを読み取り、求人を検索し、メッセージを管理できるMCPサーバー。

vercel/eve

プロンプト、ツール、スケジュールをプロジェクトディレクトリ内のファイルとして管理する、ファイルシステム最優先のフレームワーク。

mattpocock/sandcastle

隔離されたサンドボックス内でAIコーディングエージェントをオーケストレーションし、サンドボックスのライフサイクルとgitブランチ管理を自動化するTypeScriptライブラリ。

PenglongHuang/chinese-novelist-skill

Claude Code向けの自動小説作成フレームワークで、ユーザーをインタラクティブな計画とマルチエージェント起草で導き、完成度の高い中国語小説を生成します。

Calix-L/DanKS

DanKS は、構造的候補検索とPPO強化学習を活用して、複雑な協力型カードゲーム『官丹』をマスターする最先端のAIです。

kyutai-labs/pocket-tts

GPU を必要とせず、CPU に最適化された軽量なテキスト to スピーチアプリケーションで、ローカルで高速な音声生成とボイスクラウンディングが可能。

ningzimu/image-to-editable-ppt-skill

テキスト、図形、およびアセットを再構成することで、画像、PDF、および画像ベースのスライドを編集可能なPowerPointプレゼンテーションに変換するマルチエージェントAIスキル。

huggingface/smolagents

サンドボックス実行サポートを備えた、モデル・ツール非依存の軽量ライブラリ。AIエージェントがPythonコードを書くことでタスクを実行できるようにします。

assistant-ui/assistant-ui

TypeScript/Reactライブラリで、複数のAIバックエンドをサポートする生産性の高いAIチャットインターフェースを、コンポーザブルなプリミティブで構築可能。

k2-fsa/sherpa-onnx

さまざまなハードウェアおよびオペレーティングシステム上で、音声認識、音声合成、その他のオーディオAI機能をローカルで実行できるポータブルなフレームワーク。

hacksider/Deep-Live-Cam

1枚のソース画像を使用して、動画やライブWebカメラ映像の顔をリアルタイムで交換するディープフェイクツールです。

ddalcu/mlx-serve

Apple Silicon 向けのネイティブ Zig ベースの推論サーバーで、LLM およびマルチモーダルモデルを OpenAI、Anthropic、Ollama API 互換で実行可能。

ys-ll/uniterm

SSH、RDP、データベースなど30以上のプロトコルをサポートする軽量なすべてを備えたターミナルで、自律的なAIエージェントがシェルコマンドの計画と実行を自動化します。

chuspeeism/dashi-taskboard

Codex AIエージェントに統合されるローカルファーストの課題ボードで、AIがプロジェクトタスクを自律的に追跡・更新できるようにします。

Emanuele-web04/synara

複数のAIランタイム、実行ツール、レビュー表面を1つのプロジェクト認識型環境に統合した、ローカル優先のデスクトップワークスペース。

wide-trace/open-higgsfield

32 の異なる AI モデルを統一されたプロンプトインターフェースとユーザー提供の API キーを通じて利用できる、オープンソースで自己ホスト可能なスタジオ。

Tencent/AI-Infra-Guard

AIインフラストラクチャ、エージェントスキル、LLMジェイルブレイク評価の自動セキュリティスキャンを提供するAIレッドチーミングプラットフォームで、脆弱性とリスクを特定します。

generalaction/emdash

Git worktree を使ってタスクを隔離し、プロジェクト管理ツールと連携する、複数の AI コーディングエージェントを並列で実行できるデスクトップアプリ。

lgse/strata

空間的なMillerカラムナビゲーションとファジー検索、および豊富なファイルプレビューを組み合わせた、Linuxデスクトップ向けの高速でキーボード優先のファイルマネージャー。

esengine/DeepSeek-Reasonix

長時間実行される開発タスク向けのローカルエンジンを提供する自律型コーディングエージェント。チェックポイント、サンドボックス、VS Code拡張など複数のインターフェースをサポート。