scribeocr/scribeocr
画像からテキストを認識し、高精度な校正を行い、完全にデジタル化されたebookスタイルのドキュメントを作成するブラウザベースのウェブアプリケーション。
omnimind-ai/OmniInfer
デスクトップ、モバイル、エッジデバイス上で LLM や VLM をローカルで実行するための、高性能でクロスプラットフォームな推論エンジンです。
Restream/reindexer
C++とGoで書かれた、組み込み可能なインメモリ・ドキュメントデータベース。ベクトル検索と全文検索をサポートし、Elasticsearchに代わる高性能な選択肢を提供します。
RichmondAlake/memorizz
永続的なエピソード記憶、意味記憶、手続き記憶を使用して、経験を記憶し、時間とともに新しいスキルを学習する記憶最優先のAIエージェントを構築するためのPythonフレームワークです。
mandiant/stringsifter
バイナリから抽出された文字列を自動的にランク付けする機械学習ツール。マルウェアアナリストが最も関連性の高い情報を迅速に特定できるように支援します。
mistralai/client-python
Mistral AIのクラウドAPI(チャット、埋め込み、音声、ファイル、エージェントなど)向けの公式Python SDK。`pip`/`uv`/`poetry`でインストールし、`MISTRAL_API_KEY`を設定後、`client.chat.complete(...)` を同期または `asyncio` で呼び出せます。AzureおよびGCPラッパー、ストリーミング、ページネーション、リトライなどもサポートしています。
RPG-fan/Cline-Recursive-Chain-of-Thought-System-CRCT-
Cline VS Code 拡張機能用のフレームワークで、再帰的でファイルベースの追跡システムとローカル LLM アシスト分析を用いて、大規模プロジェクトのコンテキストと依存関係を管理します。
iot-salzburg/gpu-jupyter
GPU‑Jupyterは、Python、PyTorch、TensorFlow、Julia、Rが事前にインストールされたDockerベースのGPU対応JupyterLab環境です。バージョン管理されたイメージ、カスタマイズのしやすさ、Docker‑Compose対応を備え、NVIDIA GPUを搭載した任意のマシンで再現可能なディープラーニング実験を可能にします。
microsoft/TypeAgent
TypeAgentは、大規模言語モデル、構造化プロンプト、および独自の「構造化RAG」メモリシステムを活用して、単一のパーソナルAIアシスタントを構築するMicrosoftのオープンソースサンプルです。Electronベースのシェル、自然言語リクエストをタイプ化されたエージェントにルーティングするディスパッチャー、論理的エンティティとして会話の事実を保存するメモリ層、およびLLM呼び出しを削減するキャッシュを含んでいます。このリポジトリには、カレンダー、メール、ブラウザなど多くのサンプルエージェントと、カスタムエージェントを追加するためのSDKが含まれています。これは初期段階のサンプルコードであり、Azure OpenAIで英語でテスト済みで、さらなる検証なしにはプロダクション用途には向いていません。
texttron/tevatron
LLMを使用して、異なる言語やモダリティにわたる数十億規模のニューラルリトリーバーをトレーニングおよびデプロイするための統合ツールキット。
MarioSieg/magnetron
Python API を備えた、C 言語ベースのコンパクトな機械学習ランタイム。テンソル実行とメモリの完全な制御を提供し、研究や低レベル最適化に最適です。
kubeflow/kale
セルにタグを付けるだけで、Jupyter Notebookを本番環境向けのKubeflow Pipelinesに変換し、KFP SDKを使用したコードの書き換えを不要にするツールです。
pnnx/pnnx
pnnxは、PyTorchモデルを最適化し、軽量で依存関係のない形式(PNNX)およびncnn/ONNX-zeroファイルにエクスポートできるオープンソースツールで、エッジデバイスでの高速推論を可能にします。
aryn-ai/sycamore
ETLおよびRAGのためのAI駆動型ドキュメント処理エンジンであり、非構造化ドキュメントをベクトルデータベース用の高品質なデータチャンクに変換します。
Lightning-AI/litData
LitDataは、S3/GCS/Azure/HF Hubなどから直接非同期バッチダウンロードで生ファイルをストリーミングするか、一度だけデータセットをLitData独自のチャンク化バイナリ形式に変換することで、PyTorchトレーニングを最大20倍高速化するLightning AIのライブラリです。`StreamingRawDataset` はクラウドストレージから直接データをストリーミングし、`ld.optimize` はデータを最適化して再開可能でシャッフル対応の高速ストリーミングを可能にします。また、画像リサイズや埋め込み生成などの並列前処理を `ld.map` で実行でき、PyTorch Lightning、Hugging Face datasets、Lightning Cloudとの統合も完備。I/Oがボトルネックとなる大規模MLプロジェクトに最適です。
QJHWC/PaperForge
PaperForge Research OS v3は、AI支援による論文執筆、実験オーケストレーション、成果物追跡、および検証可能な出版を統合するPythonベースのツールです。すべての主張と証拠のリンクをSQLite「Scientific Memory」に保存し、3つの実行プロファイル(writing-only、research、full)を強制し、ローカル、Docker、SSH、Slurm、Kubernetes、クラウドコンピューティングのバックエンドをサポートします。CLI (`paperforge …`) とローカルWeb UIを通じて、ユーザーはワークフローの実行、提案の承認、組み込みテンプレート(generic、CVPR、IEEE、Elsevier)を使用したLaTeXのコンパイル、およびシークレットスキャン後の決定論的なソースバンドルのリリースが可能です。再現性のある学術研究のために設計されており、非商用ライセンスの下でオープンソース化されています。
facebookresearch/mvdust3r
スパースなRGBビューから、既知のカメラポーズを必要とせずに約2秒で3Dポイントクラウドとカメラポーズを生成する単一ステージの3Dシーン再構成ツール。
scikit-tda/scikit-tda
トポロジーに精通していないユーザーが利用できるように設計された、トポロジカルデータ解析(TDA)用Pythonライブラリのコレクション。
EnzymeAD/Enzyme.jl
LLVM上で動作し、最適化されたコードに対して効率的な勾配を計算できる高性能自動微分ツール、EnzymeのJuliaバインディング。
PrimeIntellect-ai/OpenDiloco
分散重み平均化を使用して通信オーバーヘッドを削減する、大規模モデルのグローバル分散トレーニング用オープンソースフレームワーク。
PacificAI/langtest
NLPおよびLLMモデルの堅牢性、バイアス、公平性、安全性をテストする包括的な評価ライブラリ。
SII-Holos/synergy
AIエージェント向けのオープンソースワークスペースで、永続的かつ回復可能なセッションと、ソフトウェア開発および知識作業のための統合実行環境を提供します。
e-sensing/sits
SITS は、衛星画像時系列データキューブの構築、正則化、分類に向けたオープンソース R パッケージ(Python ラッパー付き)です。多数の公開 EO コレクションに接続可能で、ML/DL モデル(GPU加速付き CNN やアテンションエンコーダーを含む)を提供し、学習、分類、平滑化、不確実性推定、アクティブラーニングまでをエンドツーエンドでサポートします。
irockel/tda
デッドロック、パフォーマンス問題、仮想スレッドのピンニングを診断するためのGUIとMCPサーバーを備えたJavaスレッドダンプおよびヒープ分析ツール。
zsylvester/segmenteverygrain
地形学および堆積地質学の研究を目的として、ハイブリッドU-NetとSAM 2.1アプローチを用いた画像内の粒の検出とセグメンテーションを行うPythonパッケージ。
rodmarkun/SmolML
教育的目的のために完全に自作された純粋な Python 機械学習ライブラリ。主要な ML アルゴリズムの透明な実装と、自動微分エンジンを提供します。
nschaetti/EchoTorch
研究目的向けに設計された、PyTorchベースのエコーアレイネットワークとリザーバー計算の実装・テスト用モジュール。ディープアーキテクチャへの統合を想定しています。
visionworkbench/visionworkbench
NASAが開発した、汎用的な画像処理・コンピュータビジョン用のC++ライブラリ。カメラモデル、地図投影、モザイク合成のためのツールを提供します。
camel-ai/loong
合成データの生成と自動検証の自己改善ループを通じて、推論能力を持つモデルをスケールさせるためのフレームワーク。
RosettaCommons/rosetta
タンパク質構造、酵素、生物学的高分子の計算解析および設計に使用されるバイオ分子モデリングライブラリ。
radareorg/r2ai
radare2 用の LLM 統合型プラグインセット。関数の説明、脆弱性の発見、拡張デコンパイルなどのリバースエンジニアリングタスクを支援します。
uncomplicate/deep-diamond
CPU および GPU の高速化を実現する最適化されたネイティブライブラリを活用した、高速なテンソルおよびニューラルネットワーク計算を実現する Clojure ライブラリ。
receptron/mulmocast-cli
JSONベースの中間言語「MulmoScript」を使用して、動画、ポッドキャスト、スライドデッキなどマルチモーダルコンテンツを生成するAIネイティブなプレゼンテーションプラットフォーム。
microsoft/onnxruntime-extensions
ONNX Runtimeにカスタムオペレータを追加し、ビジョン、テキスト、NLPモデルのプリプロセスおよびポストプロセスをONNXグラフ内で処理できるようにするC/C++ライブラリ。
Seeed-Studio/ModelAssistant
低コストの組み込みデバイスやマイコンに最適化されたAIアルゴリズムをデプロイするためのツールチェインで、コンピュータビジョン、異常検出、シナリオ固有のタスクをサポートします。
axclogo/AxcAgentEngine
より信頼性の高い複雑なタスク実行のため、単純なReActループを置き換える計画・観察・再計画(POR)システムを備えたエージェント実行エンジン。
facebookresearch/vizseq
VizSeqは、テキスト生成出力(MT、要約、キャプション、音声/ビデオ翻訳など)の視覚的かつインタラクティブな分析のためのPythonツールキットです。多くの標準および埋め込みベースのメトリクスを並列で計算し、Jupyterノートブックまたは組み込みのWebアプリで結果を表示します。オプションのFairseq統合も可能です。
NVlabs/nvdiffrecmc
モンテカルロレンダリングとノイズ除去を用いて、複数視点画像から3Dトポロジー、材質、照明を同時に再構築するPyTorch実装。
mcpdotdirect/evm-mcp-server
60以上のEVM互換ブロックチェーンとやり取りできるMCPサーバー。トークン送金、スマートコントラクト操作(自動ABI取得機能付き)、ENS解決を提供する。
ml-struct-bio/cryodrgn
連続的な3D構造の分布をモデル化するニューラルネットワークベースのアルゴリズム。異種的な低温EMおよび低温ET再構成に適しています。
blueqat/blueqatSDK
PyTorchベースの量子コンピューティングSDKで、シミュレータまたは実ハードウェア上で量子回路のシミュレーション、最適化、実行が可能。微分実行と専用スピン量子ビットサポートを特徴とする。
WP-Autoplugin/wp-autoplugin
LLM を使用して、WordPress 管理ダッシュボード内でプラグインおよびテーマのコードを計画・生成・レビューできるエージェント型コーディングツール。
yihaosun1124/OfflineRL-Kit
最先端のモデルフリーおよびモデルベースのアルゴリズムの標準化されたフレームワークと実装を提供する、オフライン強化学習のためのPyTorchライブラリ。
JamesShi96/project-butler
プロジェクトのコンテキスト、ルール、進捗をセッション間で維持する構造化されたMarkdownベースのメモリスタックを使用する、AIコーディングアシスタント向けの永続的メモリシステム。
adalca/neurite
医療画像解析向けのニューラルネットワークツールボックス。空間データ用の専門的なテンソル操作、事前構築されたアーキテクチャ、プロットツールを提供。
ahmadvh/octochains
高リスク意思決定におけるエージェントのバイアスやグループシンキングを防ぐ、軽量なPythonフレームワーク。並列かつ隔離されたマルチエージェント推論と合意形成を実現。
Talmaj/onnx2pytorch
ONNXモデルをPyTorchモデルに変換するライブラリで、ユーザーがPyTorchのバックエンドとニューラルネットワーク操作ツールを活用できるようにします。
linus-sch/Mind-Map-Wizard
LLM と独自の SVG レンダリングエンジンを使用して、トピックやファイルをインタラクティブで視覚的なマインドマップに変換する AI ベースのツール。