oisee/vibing-steampunk
Vibing Steampunk (vsp) は、Go CLIツールとしてSAPのADT API(RFCまたはHTTPS経由)をブリッジし、AIアシスタントや開発者がSAPサーバーに何もインストールせずにABAPコードとデータの読込・書込・デバッグ・分析が可能になります。完全なデバッグ(ブレークポイント、ステップ実行、変数の確認・変更)、AMDPデバッグ、ダンプ分析、ジョブ/スプール処理、ドキュメント抽出、SAPクラスタテーブルのデコードをサポートし、記録されたADTセッションを用いたオフラインテストも可能です。
mengke-wang/xiaohongshu-ai-workbench
Xiaohongshu(小紅書)運用のためのモジュール式AIワークフロー(Codexスキル)のコレクション。クリエイターがプロフィール、コンテンツ計画、コンバージョン経路を体系的に最適化するのを支援します。
NVIDIA-NeMo/Curator
AIトレーニング用に、大規模なテキスト、画像、動画、音声データセットをロード、フィルタリング、重複排除、変換するための、再現可能なパイプラインを構築するためのGPU加速データキュレーションフレームワーク。
josStorer/RWKV-Runner
OpenAI 互換の API と、チャット、補完、音楽作曲向けのユーザーフレンドリーなインターフェースを提供する、軽量で自動化された RWKV モデルランナー。
twinnydotdev/twinny
Twinnyは、AI駆動のコード補完、インタラクティブなチャットサイドバー、埋め込みによるワークスペース全体のコンテキスト、およびオプションのP2P推論共有機能を追加する無料のVS Code拡張機能です。多くのLLMプロバイダー(OpenAI, Anthropic, Mistralなど)と連携し、ローカルで実行することも可能で、カスタマイズ可能なプロンプトやdiff view、コミットメッセージ生成、オフライン動作などの機能を提供します。
oliver-kriska/claude-elixir-phoenix
Claude Codeおよびその他のAIアシスタント向けの専門的なプラグインで、26の専門エージェントと51のスキルを提供し、バグのないElixirおよびPhoenixアプリケーションの開発を支援します。
mishushakov/llm-scraper
LLM Scraper は、大規模言語モデルを使用して任意のウェブページから構造化データを抽出できる TypeScript ライブラリです。ブラウザ自動化とスキーマベースのプロンプトを組み合わせることで、生のウェブコンテンツを整理された JSON に変換し、複数の LLM プロバイダーとストリーミング出力をサポートします。
tile-ai/TileRT
NVIDIA B200 GPU 上で超低遅延 LLM 推論を実現し、巨大モデルの出力トークンあたりの時間を最小化するタイルベースのランタイムエンジン。
facebookresearch/AugLy
音声、画像、テキスト、動画のための100以上の変換を提供するマルチモーダルデータ拡張ライブラリ。リアルなインターネットデータに対するAIモデルの堅牢性を向上させます。
toki-plus/video-mover
ファイル監視とAI生成字幕から、ブラウザ自動化によるマルチプラットフォームアップロードまでを一貫して自動化する動画配信パイプライン。
NVIDIA-NeMo/Megatron-Bridge
Hugging Face と NVIDIA Megatron Core の間で双方向のチェックポイント変換と高性能トレーニングを可能にする PyTorch ネイティブなライブラリ。
plasma-ai/fractal
fractal は、各ノードが独自の Git worktree と tmux セッションで実行される自律型 LLM エージェントループのツリーを構築する Python ライブラリ/CLI です。ノードは子ノードを生成でき、複雑なタスクを解決するための再帰的自己組織化が可能です。実行履歴は SQLite で追跡され、ターミナル UI ダッシュボードが提供され、複数の LLM バックエンド(Claude、Codex、Grok、OpenCode、Oh My Pi)をサポートします。セキュリティ警告として、エージェントは権限の確認なしで実行されるため、信頼できるまたはサンドボックス環境でのみ使用してください。
ucam-eo/tessera
TESSERAは、雲によって破損した衛星時系列データを、地球の表現と分析のためのコンパクトな128次元の埋め込みに変換するオープンな地理空間基盤モデルです。
vllm-project/vime
Vimeは、大規模言語モデル(LLM)向けのオープンソースのRLポストトレーニングフレームワークです。slime/Megatron 分布式トレーニングスタックとvLLM推論(vllm-router経由)を組み合わせ、高スループットなロールアウトと柔軟なデータ生成パイプラインを提供します。サポートされるモデルには、Qwen、DeepSeek V3、LLaMA 3が含まれます。ユーザーはMegatron、vLLM、およびrouterの引数を設定することで、agentic RL、coding-agent RL、またはカスタムRLアルゴリズムを実行できます。リポジトリには、クイックスタートドキュメント、いくつかの準備された例、および開発者のための明確なコードリーディングパスが用意されています。
joey-zhou/xiaozhi-esp32-server-java
ESP32スマートハードウェア向けのエンタープライズグレードのJavaバックエンドおよび管理プラットフォーム。リアルタイムのAI音声対話、RAG、IoTデバイス管理を提供します。
huggingface/xet-core
Hugging Face Hub用のストレージシステムで、チャンクベースの重複削除を活用して、大規模なAIモデルやデータセットを効率的にアップロード・ダウンロードします。
finnvoor/yap
AppleのSpeech.frameworkを使用して、macOS上でファイル、リアルタイムのシステム音声、マイク入力をデバイス上で音声認識するCLIツール。
lquesada/ComfyUI-Inpaint-CropAndStitch
マスクされた領域をクロッピングし、ターゲット解像度で処理してから、元の画像にシームレスに再統合することで、インペイントの最適化を実現するComfyUI拡張です。
linuxhsj/openclaw-zero-token
有料APIトークンを使用せずに、公式Web UIを自動操作することで複数のプレミアムLLMへの無料アクセスを可能にするゲートウェイ。
deepinv/deepinv
DeepInverseは、モジュール式のオペレーターとアルゴリズムのフレームワークを通じて、ディープラーニングを用いたイメージング逆問題の解決を目的とした、オープンソースのPyTorchベースのライブラリです。
unit8co/darts
古典的な統計手法からディープニューラルネットワークに至るまでのモデルに対して統一されたAPIを提供する、ユーザーフレンドリーな時系列予測と異常検知のためのPythonライブラリ。
JungHoonGhae/tossinvest-cli
AI エージェントとユーザーを Toss Securities に接続する CLI および MCP サーバー。公式 API を完全にカバーし、取引および分析用に 58 の追加内部ウェブ機能を提供。
jjang-ai/vmlx
Apple Silicon 用のセルフホスト型推論サーバーで、OpenAI、Anthropic、Ollama 互換の API を提供し、ローカルで LLM、VLM、画像生成モデルを実行できます。
sybil-solutions/local-studio
Local Studio は、macOS/デスクトップ用のオープンソースアプリで、自社ホスト型のLLMバックエンド(vLLM、SGLang、llama.cpp、MLX)を実行・管理・チャットできます。Bun + Honoコントローラー(モデルライフサイクル、OpenAI互換プロキシ、GPUメトリクス)と、Next.js/Electron UI、統合されたPiコードエージェントを組み合わせています。UIはローカルで動作するか、リモートコントローラーに接続できます。補助的なモバイルアプリ(KittyLitter)は、同じセッションを再利用できます。リポジトリには、完全な開発環境セットアップスクリプト、プロダクションビルド手順、CI駆動のリリースパイプラインが含まれます。
superagent-ai/superagent
AIエージェントのセキュリティを守るオープンソースのSDK。プロンプトインジェクションをブロックし、機密データを削除し、AIを標的とした脅威をリポジトリでスキャンします。
overcuriousity/pdf2epub
インテリジェントなレイアウト検出とAI駆動のテキスト抽出を使用して、PDFファイルを構造化されたMarkdownおよびEPUB形式に変換するツール。
caidaoli/ccLoad
Claude Code、Codex、Gemini、OpenAI などのアップストリームに対し、スマートルーティング、自動フェイルオーバー、コスト制御を提供するAI APIゲートウェイ。
owainlewis/blueprint
設計、計画、レビューなどのプロフェッショナルなソフトウェアエンジニアリング実践をAIコードエージェントに導く、ポータブルなスキルファイルのコレクションです。
ROCm/rocm-libraries
ROCmライブラリの統合されたスーパーリポジトリで、複数のGPUアクセラレーテッド数学および計算ライブラリの開発、CI、統合を効率化します。
cbcoutinho/nextcloud-mcp-server
生産環境対応のMCPサーバーで、AIアシスタントとNextcloudを接続し、LLMが自然言語でノート、カレンダー、ファイルのCRUD操作を実行できるようにします。
koreainvestment/open-trading-api
Korea Investment & Securities Open API 用の包括的なサンプルコードライブラリとツールセット。LLM 最適化スニペット、ビジュアル戦略ビルダー、バックテストエンジンを搭載。
jacklandrin/OnlySwitch
AI による自然言語制御とカスタムスクリプティングを特徴とする、システムトグルと日常的なタスクを単一のスイッチハブに集約する macOS メニューバーユーティリティ。
homelab-00/TranscriptionSuite
プライバシーと高速性を確保するために、さまざまなAIモデルを使ってコンピュータ上で音声をテキストに変換する、無料でオープンソースのトランスクリプションアプリ。
tdrussell/diffusion-pipe
複数のGPUを使用して、大規模な画像およびビデオ拡散モデルのトレーニングを可能にするパイプライン並列トレーニングスクリプト。
grobidOrg/grobid
機械学習ライブラリで、PDF 形式の科学出版物を構造化された XML/TEI ドキュメントに変換し、大規模な書誌データ抽出を実現します。
google/adk-java
Google Cloudサービスとの緊密な統合を実現する、コード優先のJavaツールキット。AIエージェントの構築、評価、デプロイを柔軟なオーケストレーションで可能にします。
TheR1D/shell_gpt
LLM を使用してシェルコマンド、コードスニペット、ドキュメントをターミナル上で直接生成できるコマンドライン生産性ツールです。
bbycroft/llm-viz
GPTスタイルの大規模言語モデルのネットワークトポロジーと推論プロセスを表示する3Dインタラクティブ可視化ツール
shepherd-agents/shepherd
AIエージェント向けのランタイム基盤であり、安全なサンドボックス化、可逆的な実行トレース、すべてのファイルシステム変更に対するレビュー・承認ワークフローを提供します。
mobile-next/mobilewright
iOSおよびAndroid向けのモバイルデバイス自動化フレームワークで、PlaywrightのAPIと開発者体験をモバイルアプリにもたらし、E2EテストとAIエージェント制御の両方に特化して最適化されています。
anthropics/claude-code-base-action
GitHub Action として Claude Code を CI/CD ワークフローに統合し、PR レビュー、依存関係の更新などの自動化されたエージェントタスクを可能にする。
google-gemini/gemini-live-api-examples
Gemini Live APIの例のコレクション。マルチモーダル入力を備えた低遅延でリアルタイムの音声・動画AIエージェントの構築を可能にする。
WordPress/ai
ブロックエディタに AI によるコンテンツ作成、モデレーション、SEO ツールを直接統合するためのモジュール型フレームワークを提供する実験的な WordPress プラグイン。
thu-ml/Causal-Forcing
因果ODEまたは因果一貫性蒸留を用いて、効率的な少数ステップ自己回帰拡散による高品質なリアルタイムインタラクティブ動画生成を実現するフレームワーク
cellebrite-labs/ghidra-rpc
LLM が JSON ベースの CLI とバックグラウンドデーモンを通じて Ghidra にアクセスできるエージェントスキルであり、AI が自律的にリバースエンジニアリングタスクを実行できるようにします。
Vchitect/VBench
VBenchは、数十種類の品質ディメンション(技術的、美的、信頼性)にわたってビデオ生成モデルを自動的に評価するオープンソースのベンチマークスイートです。プロンプト集、メトリクスパイプライン、人間と一致するスコア、そしてT2V、I2V、長尺ビデオ、および本質的な忠実度の評価のための公開リーダーボードが含まれています。
open-gigaai/giga-brain-0
GigaBrain‑0.7 は、ロボット向けのオープンソースで大規模な視覚言語行動モデルです。37,000時間の多様な身体化データで事前学習されており、8種類のロボット身体化をサポート。トレーニングスクリプト、ベンチマークスイート(VLM‑Benchmark、RoboColiseum、RoboTwin 2.0、EBench)、ROSと統合可能な即時実行可能なインファレンスサーバーを同梱しています。
XiaoLuoLYG/GOD
リアルタイムでAIエージェントのシミュレーションを観察・一時停止・介入できる、言語エージェント社会のためのコントロールルームフレームワークです。