OpenVDN/vdn-minimax-h3
VDN‑Minimax‑H3(VDN‑H3)は、MiniMax H3 をベースにしたハイブリッドアテンション動画拡散モデルです。軽量な線形アテンションブランチと LoRA アダプタを追加することで、768pの高解像度動画をニアリアルタイムで生成可能(例:単一B200 GPUで14秒のクリップを約11秒で生成)。リポジトリには4段階の学習レシピと、FP8およびFlashAttention‑4を活用した最適化された推論コード、詳細なセットアップ手順、性能表が含まれています。
shengjidaguai-china/BossHunter
すべての申請に手動確認を必要としながら、複数の採用プラットフォームで求人収集、AIスコアリング、パーソナライズされたアウトリーチを自動化するAI駆動の求職エージェント。
ace-trump-tech/DeltaForce-OBS-Locker
YOLOv14を用いたリアルタイムオブジェクト検出とターゲットロックシステム。環境の誤検出をフィルタリングし、Delta Forceゲーム内のキャラクターを識別する。
basketikun/chatgpt2api
ChatGPTのウェブ機能をリバースエンジニアリングし、組み込みのアカウントプール管理機能とともに画像生成および編集サービスを提供する、OpenAI互換のAPIプロキシ。
e2b-dev/E2B
AIが生成したコードを実行し、仮想デスクトップとやり取りするための、安全で隔離されたクラウドサンドボックスを提供するオープンソースのインフラストラクチャ。
soumatheusgomes/vibe-coding-toolkit
Claude Code / Codex を disciplined なコーディングチームメイトとして活用できる、ドキュメント化されたワークフローとツールセット(プラグイン、プロンプト、Lintルール、サブエージェントオーケストレーション、メモリ管理)。「スーパーパワーズ」規律、並列サブエージェント、品質ゲート付きESLint設定、完全なオンボーディングPlaybookを含む。
nexu-io/html-anything
allow-scripts allow-same-origin
mukul975/cve-mcp-server
28のセキュリティツールと24のAPIを統合し、AIアシスタントをセキュリティアナリストに変えるMCPサーバー。CVEのトリアージとリスクスコアリングを自動化。
apify/mcpc
Model Context Protocol (MCP) 用のユニバーサルCLIクライアントで、AIエージェントや開発者が標準シェルコマンドでMCPサーバーとやり取りできるようにします。
chenhg5/cc-connect
ローカルマシンで実行中の AI エージェントを、Telegram、Slack、Discord などのインスタントメッセージングプラットフォームに接続してリモート制御するためのブリッジ。
getagentseal/codeburn
CodeBurnは、無料・オープンソースのNode.jsユーティリティで、多数のAIコーディングツール(Claude、Cursor、Codex、Geminiなど)のセッションログをローカルで読み取り、各モデル、プロジェクト、タスクが消費したトークン数と金額を正確に表示します。ターミナルUI、Webダッシュボード、メニューバー/トレイアプリを提供し、無駄なパターン(再読み込み、読み取りと編集の比率の低さ、未使用エージェントなど)を検出し、修正を提案・適用し、予算上限を強制し、モデル効率を比較し、支出をgitコミットと関連付けることもできます。すべての処理はマシン上で行われ、APIキーやデータが外部に送信されることはありません。
shengjidaguai-china/goutoujunshi
多分野の知識ベースを用いてチャットログと関係性のダイナミクスを分析し、感情的なサポートと実行可能なデートアドバイスを提供するAI関係コンサルタントです。
NanmiCoder/cc-haha
マルチエージェントチーム、動的ワークフロー、モデル統合を管理するための視覚的インターフェースを提供するAIコーディング用デスクトップワークベンチ。
Soju06/codex-lb
複数のアカウントをプールしてレート制限を管理し、ダッシュボードで使用状況を追跡するChatGPTアカウント用のロードバランサーおよびAPIプロキシ。
OpenMOSS/MOSS-Transcribe-Diarize
1回の処理で長時間のマルチスプーカー音声の音声認識とスプーカー・ダイアライゼーションを同時に行うエンドツーエンド音声理解モデル。
roboflow/rf-detr
RF‑DETR は、DINOv2 バックボーンに基づくリアルタイムトランスフォーマー基盤のビジョンモデルセット(検出、セグメンテーション、キーポイント)です。`rfdetr` Python パッケージとして提供され、Nano‑2XL の複数サイズバリアントを備え、コア部分は Apache‑2.0、XL/2XL は PML 1.0 ライセンスで利用可能です。COCO および RF100‑VL における最先端の精度‑レイテンシトレードオフを示すベンチマークテーブルを含みます。インストールは `pip install rfdetr` で行い、`model.predict(...)` 1 行で使用可能。`supervision` ライブラリでオプションの可視化も可能。Roboflow プラットフォームではカスタムアーキテクチャ探索用の NAS パイプラインも提供されています。
momozi1996/momo-code
リアルタイムのプロンプトインジェクションと長期的なファインチューニングを組み合わせた、二段階の自己進化システムを備えた AI ベースのコーディングエージェント。
nocobase/nocobase
オープンソースの AI 搭載ノーコードプラットフォームで、ビジネスシステム構築を支援します。ビジュアルインターフェースと AI コーディングエージェント、統合 AI 従業員を組み合わせています。
Yeachan-Heo/oh-my-claudecode
Claude Code 用のマルチエージェントオーケストレーションフレームワークで、専門的なエージェントと複数のAIプロバイダー間で自然言語によるタスク配分を可能にします。
bybit-exchange/svg-diagram
svg‑diagram は、AIコーディングエージェントが生成するSVG図の厳格な視覚スタイルを定義し、そのスタイルに準拠しているかを検証するコマンドラインリンター(`svg‑lint`)を提供するゼロ依存のNodeスキルです。
Project-HAMi/HAMi
複数のワークロード間でGPUやその他のAIアクセラレータリソースを共有・隔離できる、Kubernetesネイティブな仮想化ミドルウェアで、ハードウェア利用効率を向上させます。
ace-step/ACE-Step-1.5
ACE‑Step 1.5 は、言語モデルによる計画とDiffusion‑Transformer音声デコーダーを組み合わせたオープンソース音楽生成ファウンデーションモデルです。RTX 3090で10秒未満でフルソング(10秒〜10分)を生成でき、ベースモデルでは4GB未満のVRAMで動作し、数曲からのLoRA微調整が可能。リポジトリにはGradioとRESTインターフェース、主要OS用の起動スクリプト、複数のモデルサイズ(4 B XLバージョン含む)、歌詞・スタイル・テンポ・楽器構成の高度な制御が提供されています。
vercel/ai
プロバイダーに依存しない TypeScript ツールキットで、統一された API を通じて複数の LLM プロバイダーに対応し、AI 搭載アプリケーションやエージェントを構築でき、UI フックも統合されています。
Jia-Ethan/codex-keysmith
Codex AIプログラミングツールに、ソフトウェアを変更せずにカスタムで取り消し可能な指示を注入して、新しい会話での挙動をカスタマイズするためのツール。
chenxiachan/thoughtdag
グラフベースのインターフェースを使用して、ユーザーがLLMが見るものを明示的に制御・刈り込み、幻覚やトークンの無駄遣いを減らすことができる視覚的なコンテキスト管理ツール。
54yyyu/zotero-mcp
Zotero研究ライブラリをAIアシスタントに接続するMCPサーバー。概念検索、メタデータ取得、PDF注釈分析を可能にします。
dexmal/opendm
OpenDMは、オープンワールドにおけるロボット制御のためのビジョン・言語・アクション(VLA)モデルフレームワークであり、さまざまなロボットエムボディメントにおけるモデルのトレーニング、ファインチューニング、デプロイを支援するツールを提供します。
modem-dev/hunk
AIエージェントが作成した変更セット向けに設計されたレビュー最優先のターミナル diff ビューア。インタラクティブな UI、インライン AI 注釈、複数ファイルナビゲーションを備えています。
stickerdaniel/linkedin-mcp-server
ユーザー自身のログイン済みブラウザセッションを使って、AIアシスタントがLinkedInのプロフィールを読み取り、求人を検索し、メッセージを管理できるMCPサーバー。
vercel/eve
プロンプト、ツール、スケジュールをプロジェクトディレクトリ内のファイルとして管理する、ファイルシステム最優先のフレームワーク。
mattpocock/sandcastle
隔離されたサンドボックス内でAIコーディングエージェントをオーケストレーションし、サンドボックスのライフサイクルとgitブランチ管理を自動化するTypeScriptライブラリ。
PenglongHuang/chinese-novelist-skill
Claude Code向けの自動小説作成フレームワークで、ユーザーをインタラクティブな計画とマルチエージェント起草で導き、完成度の高い中国語小説を生成します。
Calix-L/DanKS
DanKS は、構造的候補検索とPPO強化学習を活用して、複雑な協力型カードゲーム『官丹』をマスターする最先端のAIです。
kyutai-labs/pocket-tts
GPU を必要とせず、CPU に最適化された軽量なテキスト to スピーチアプリケーションで、ローカルで高速な音声生成とボイスクラウンディングが可能。
ningzimu/image-to-editable-ppt-skill
テキスト、図形、およびアセットを再構成することで、画像、PDF、および画像ベースのスライドを編集可能なPowerPointプレゼンテーションに変換するマルチエージェントAIスキル。
huggingface/smolagents
サンドボックス実行サポートを備えた、モデル・ツール非依存の軽量ライブラリ。AIエージェントがPythonコードを書くことでタスクを実行できるようにします。
assistant-ui/assistant-ui
TypeScript/Reactライブラリで、複数のAIバックエンドをサポートする生産性の高いAIチャットインターフェースを、コンポーザブルなプリミティブで構築可能。
k2-fsa/sherpa-onnx
さまざまなハードウェアおよびオペレーティングシステム上で、音声認識、音声合成、その他のオーディオAI機能をローカルで実行できるポータブルなフレームワーク。
hacksider/Deep-Live-Cam
1枚のソース画像を使用して、動画やライブWebカメラ映像の顔をリアルタイムで交換するディープフェイクツールです。
ddalcu/mlx-serve
Apple Silicon 向けのネイティブ Zig ベースの推論サーバーで、LLM およびマルチモーダルモデルを OpenAI、Anthropic、Ollama API 互換で実行可能。
ys-ll/uniterm
SSH、RDP、データベースなど30以上のプロトコルをサポートする軽量なすべてを備えたターミナルで、自律的なAIエージェントがシェルコマンドの計画と実行を自動化します。
chuspeeism/dashi-taskboard
Codex AIエージェントに統合されるローカルファーストの課題ボードで、AIがプロジェクトタスクを自律的に追跡・更新できるようにします。
Emanuele-web04/synara
複数のAIランタイム、実行ツール、レビュー表面を1つのプロジェクト認識型環境に統合した、ローカル優先のデスクトップワークスペース。
wide-trace/open-higgsfield
32 の異なる AI モデルを統一されたプロンプトインターフェースとユーザー提供の API キーを通じて利用できる、オープンソースで自己ホスト可能なスタジオ。
Tencent/AI-Infra-Guard
AIインフラストラクチャ、エージェントスキル、LLMジェイルブレイク評価の自動セキュリティスキャンを提供するAIレッドチーミングプラットフォームで、脆弱性とリスクを特定します。
generalaction/emdash
Git worktree を使ってタスクを隔離し、プロジェクト管理ツールと連携する、複数の AI コーディングエージェントを並列で実行できるデスクトップアプリ。
lgse/strata
空間的なMillerカラムナビゲーションとファジー検索、および豊富なファイルプレビューを組み合わせた、Linuxデスクトップ向けの高速でキーボード優先のファイルマネージャー。
esengine/DeepSeek-Reasonix
長時間実行される開発タスク向けのローカルエンジンを提供する自律型コーディングエージェント。チェックポイント、サンドボックス、VS Code拡張など複数のインターフェースをサポート。