lab-v2/pyreason

PyReasonは、時間的および実数論理を使用してグラフ構造上で説明可能な推論を行うためのツールであり、論理規則と事実を用いて推論を実行します。

shenjingnan/xiaozhi-client

AIサーバーとModel Context Protocol (MCP)サーバーを接続するクライアントで、AIエージェントが外部ツールやデータソースにアクセスできるようにします。

kleosr/cursorkleosr

常に有効なルールとMarkdownファイルを使用して、セッション間でプロジェクトの状態と目標を追跡する、Cursor AIエージェント向けの永続的メモリシステムです。

docling-project/docling-parse

Docling Parse は高速で構成可能なPDF解析ライブラリ(Python API と C++ コア)で、テキスト、単語、行、ベクターシェイプ、ビットマップ画像とその座標を抽出します。シーケンシャルおよびマルチスレッド解析をサポートし、ページごとに計算・マテリアライズする内容を選択可能。レンダリングユーティリティも備え、レイアウトに配慮したドキュメントデータをAIワークフローに最適化しています。

audeering/opensmile-python

機械学習研究における標準化された音声特徴の抽出を可能にする、openSMILE 用の Python インターフェース。

BlueFalconHD/apple_generative_model_safety_decrypted

Apple Intelligenceの生成モデルが使用する安全フィルターやガードレールを復号・分析するためのツールキット。異なる地域間でのコンテンツフィルタリングの仕組みを明らかにする。

iago-suarez/ELSED

ELSEDは、ドローンやスマートフォンなどのリソース制限されたデバイス向けに設計された高速線分検出器です。

WorksApplications/SudachiDict

Sudachi日本語トークナイザー用の辞書で、正確な分かち書きと形態素解析のためにさまざまなサイズの辞書を提供します。

lmcinnes/pynndescent

Nearest Neighbor Descentアルゴリズムを使用した高速な近似最近傍探索を実現するPythonライブラリで、幅広い距離メトリクスをサポートしています。

retentioneering/retentioneering-tools

クリックストリームおよびイベントログデータに対する再現可能なプロダクト分析のためのオープンソースPythonツールキットとMCPサーバー。ユーザーのジャーニーに対する深い行動分析を可能にします。

cosmicstack-labs/mercury-agent-skills

23の異なるカテゴリにわたる、プロダクション対応のキュレートされたワークフローを提供する、オープンソースの標準化されたSKILL.mdプレイブックライブラリです。

jax-ml/ml_dtypes

機械学習向けの低精度フォーマット(bfloat16、8ビット浮動小数点、狭い整数など)をサポートする、NumPy dtype拡張の独立した実装。

AllenInstitute/bmtk

Brain Modeling Toolkit (BMTK) は、複数の解像度レベルにわたって大規模な脳ネットワークを構築、シミュレーション、および分析するためのオープンソースのソフトウェアスイートです。

bamsumit/slayerPytorch

バックプロパゲーションを用いてシナプス結合重みと軸索遅延を学習する多層スパイキングニューラルネットワークの学習を可能にするPyTorch実装。

ViciousSquid/Dosidicus

ユーザーがリアルタイムで観察・追跡できるニューラルネットワークを育てることで神経科学を学べる、透明な認知サンドボックス兼デジタルペットシミュレーション。

cazala/synaptic

Node.jsおよびブラウザ向けに設計された、柔軟でアーキテクチャに縛られないニューラルネットワークの作成とトレーニングを可能にするJavaScriptニューラルネットワークライブラリ。

common-voice/common-voice

音声認識関連ツールのトレーニング用パブリックドメインデータセットを作成するため、音声寄付を収集するウェブアプリケーション。

VRSEN/OpenSwarm

1つのターミナルプロンプトから、スライド資料、調査レポート、動画などのプロフェッショナルな成果物を生成する、専門的なAIエージェントを連携させるマルチエージェントシステム。

onnx/tensorflow-onnx

TensorFlow、Keras、TensorFlow.js、TFLiteモデルを、クロスプラットフォーム互換性とデプロイメントに適したONNX形式に変換するツール。

facebookresearch/fvcore

FAIRが開発したコンピュータビジョンフレームワーク向けに、不可欠な共有機能とユーティリティを提供する軽量なコアライブラリ。

flexflow/flexflow-train

自動的に最適な並列化戦略を探索することで、分散型DNN学習を高速化するディープラーニングフレームワーク。

aeonfun/opendia

AIモデルが既存のログインアカウントとセッションデータを使って、ブラウザを制御できるオープンソースのMCPサーバーとブラウザ拡張機能です。

JuliaAI/MLJ.jl

MLJ は、200以上の機械学習モデルの選択、調整、比較に使える共通インターフェースとメタアルゴリズムを提供する、Julia用の機械学習ツールボックスです。

Vchitect/Latte

高品質な動画生成を実現する潜在拡散Transformerで、テキストから動画およびテキストから画像の両方のタスクをサポートします。

Lightning-AI/lightning-thunder

Python風の中間表現と拡張可能な変換プラグインを用いて、トレーニングおよび推論向けにモデルを最適化するPyTorch用ソースツーソースコンパイラ。

pnnl/neuromancer

機械学習と科学計算を統合することで、パラメトリックな制約付き最適化および物理情報付きシステム同定を解決する微分可能なプログラミングライブラリです。

tensorflow/text

TensorFlow でトレーニングと推論の両方で一貫した前処理を実現する、テキスト処理クラスとオペレーションのコレクションです。

yym68686/uni-api

uni‑apiは、OpenAI互換APIを1つ提供する設定のみのサーバーであり、OpenAI、Anthropic、Gemini、Vertex、Azure、AWSなど、多数のLLMプロバイダーにリクエストをルーティングします。重み付きおよびラウンドロビンのロードバランシング、自動リトライ、モデルごとのタイムアウト、レート制限、ツールコールの透過、コンテンツモデレーション、細かいリクエストオーバーライドなどを`api.yaml`ファイルまたは`CONFIG_URL`で定義可能。Dockerコンテナとしてデプロイ可能(Fugueのワンクリックボタンを提供)

flutter-ml/google_ml_kit_flutter

モバイルアプリがデバイス上でビジョン、自然言語、生成AI機能を実行できるようにする、Flutterプラグインのセット。

yongliang-wu/DFT

予測確率に基づいてトークン損失を動的に再スケーリングすることで、教師あり微調整(SFT)中のLLMの汎化性能を向上させる手法。特に推論タスクにおいて効果的です。

ikawaha/kagome

埋め込み辞書を備えた純Goの日本語形態素解析器で、テキストをトークン化し、品詞を分析する。デプロイが容易なため、簡単に利用可能。

BabitMF/bmf

ByteDanceが開発したクロスプラットフォームマルチメディア処理フレームワークで、強力なGPUアクセラレーションを活用した高パフォーマンスな動画変換、編集、AI推論を実現します。

AndersonBY/vector-vein

VectorVeinは、コードを書かずにAI駆動の自動化ワークフローを構築できるクロスプラットフォームの無コードデスクトップアプリです。LLM呼び出し、埋め込み、音声認識などを視覚的に接続でき、OpenAI互換エンドポイント(OpenAI、Ollama、LM‑Studioなど)をサポート。プログラムによる実行を可能にするローカルFastAPI REST APIを備え、pywebviewで構築された単一実行可能ファイルとして配布されます。

fal-ai/fal

クラウド上でインフラ管理なしにMLモデルやパイプラインをデプロイ・スケーリングできる、サーバーレスPythonランタイムとクライアントライブラリ。

SegmentationBLWX/sssegmentation

PyTorch を基盤とした監視付きセマンティックセグメンテーション用のツールボックスで、トレーニングおよびテスト用の統一されたフレームワークと、広範なモデルズーを提供します。

thekevinscott/UpscalerJS

ブラウザまたは Node.js で AI を使って画像の解像度を向上させ、ノイズを除去し、ぼかしを修正できる JavaScript ライブラリです。

huggingface/dataset-viewer

Hugging FaceデータセットビューアのバックエンドAPIで、Hub上のデータセットを事前計算されたデータを使って閲覧、フィルタリング、検査できるようにします。

kendryte/nncase

TFLite、Caffe、および ONNX 形式のモデルを K210、K510、および K230 のような専用ハードウェアに最適化してデプロイするための AI アクセラレータ用ニューラルネットワークコンパイラです。

scribeocr/scribeocr

画像からテキストを認識し、高精度な校正を行い、完全にデジタル化されたebookスタイルのドキュメントを作成するブラウザベースのウェブアプリケーション。

omnimind-ai/OmniInfer

デスクトップ、モバイル、エッジデバイス上で LLM や VLM をローカルで実行するための、高性能でクロスプラットフォームな推論エンジンです。

Restream/reindexer

C++とGoで書かれた、組み込み可能なインメモリ・ドキュメントデータベース。ベクトル検索と全文検索をサポートし、Elasticsearchに代わる高性能な選択肢を提供します。

RichmondAlake/memorizz

永続的なエピソード記憶、意味記憶、手続き記憶を使用して、経験を記憶し、時間とともに新しいスキルを学習する記憶最優先のAIエージェントを構築するためのPythonフレームワークです。

mandiant/stringsifter

バイナリから抽出された文字列を自動的にランク付けする機械学習ツール。マルウェアアナリストが最も関連性の高い情報を迅速に特定できるように支援します。

mistralai/client-python

Mistral AIのクラウドAPI(チャット、埋め込み、音声、ファイル、エージェントなど)向けの公式Python SDK。`pip`/`uv`/`poetry`でインストールし、`MISTRAL_API_KEY`を設定後、`client.chat.complete(...)` を同期または `asyncio` で呼び出せます。AzureおよびGCPラッパー、ストリーミング、ページネーション、リトライなどもサポートしています。

RPG-fan/Cline-Recursive-Chain-of-Thought-System-CRCT-

Cline VS Code 拡張機能用のフレームワークで、再帰的でファイルベースの追跡システムとローカル LLM アシスト分析を用いて、大規模プロジェクトのコンテキストと依存関係を管理します。

iot-salzburg/gpu-jupyter

GPU‑Jupyterは、Python、PyTorch、TensorFlow、Julia、Rが事前にインストールされたDockerベースのGPU対応JupyterLab環境です。バージョン管理されたイメージ、カスタマイズのしやすさ、Docker‑Compose対応を備え、NVIDIA GPUを搭載した任意のマシンで再現可能なディープラーニング実験を可能にします。

microsoft/TypeAgent

TypeAgentは、大規模言語モデル、構造化プロンプト、および独自の「構造化RAG」メモリシステムを活用して、単一のパーソナルAIアシスタントを構築するMicrosoftのオープンソースサンプルです。Electronベースのシェル、自然言語リクエストをタイプ化されたエージェントにルーティングするディスパッチャー、論理的エンティティとして会話の事実を保存するメモリ層、およびLLM呼び出しを削減するキャッシュを含んでいます。このリポジトリには、カレンダー、メール、ブラウザなど多くのサンプルエージェントと、カスタムエージェントを追加するためのSDKが含まれています。これは初期段階のサンプルコードであり、Azure OpenAIで英語でテスト済みで、さらなる検証なしにはプロダクション用途には向いていません。

texttron/tevatron

LLMを使用して、異なる言語やモダリティにわたる数十億規模のニューラルリトリーバーをトレーニングおよびデプロイするための統合ツールキット。