spectralpython/spectral

画像分光法から得られるハイパースペクトル画像データの処理、可視化、分類を行うための純粋なPythonモジュール。

johntruckenbrodt/pyroSAR

さまざまなミッションおよびソフトウェアツールからのSAR衛星データのスケーラブルな整理と処理を可能にするPythonフレームワーク。

histolab/histolab

デジタル病理における Whole Slide Images (WSIs) の処理用ツールで、自動組織検出と深層学習パイプライン用の情報量の多いタイル抽出を提供します。

seung-lab/connected-components-3d

3Dマルチラベルおよびグレースケール画像における連結成分ラベリングのための高性能ライブラリ。バイオメディカルイメージングにおけるインスタンスセグメンテーション解析を加速する設計。

cocoa-xu/evision

Elixir アプリケーション向けの OpenCV バインディングで、コンピュータビジョンツールの自動生成を提供し、CUDA およびエッジデバイス向けシステムにも対応しています。

MRtrix3/mrtrix3

MRtrix3 は、MRIデータの処理と可視化を提供する医療画像ソフトウェアパッケージです。

upipes/PipeNet-Expansion

大規模言語モデル(LLM)によって生成された環境知識を用いて、Ground Penetrating Radar(GPR)地下診断分類器を新しい地理的地域に適応させるためのフレームワークとプロトタイプシステム。

jcreinhold/intensity-normalization

スキャナーとサイト間で MR 画像の強度を正規化し、取得アーティファクトによって機械学習パイプラインが破損するのを防ぐための Python パッケージ。

ngageoint/sarpy

NGA 標準およびさまざまな商業用 SLC 形式をサポートする、複雑な合成開口レーダー(SAR)データを読み取り、書き込み、処理するための Python ライブラリ。

0x09/resdet

周波数領域分析を使用して画像や動画のアップスケーリングを検出し、元のソース解像度を特定するコマンドラインツールおよび C ライブラリ。

pySTEPS/pysteps

光学流と確率的生成器を用いた、短期間のアンサンブル予測システムを構築するためのPythonライブラリ。

koide3/iridescence

ポイントクラウドアルゴリズムの迅速プロトタイピングに最適な、軽量な 3D 可視化ライブラリ。統合された UI ツールを備えています。

orfeotoolbox/OTB

テラバイト規模の光学、マルチスペクトル、レーダーデータを処理できるオープンソースのライブラリ。

dkogan/mrcal

mrcal は、カメラキャリブレーションおよび構造から運動(SfM)の問題を解決するための汎用ツールキットであり、CおよびPythonのライブラリとコマンドラインツールを提供しています。

foundry/OpenCVSwiftStitch

OpenCV を使用して iOS で画像をパノラマにスタッチする例プロジェクト。現代的な Swift/C++ 相互運用性を示す。

scverse/squidpy

空間分子データおよび組織顕微鏡画像の分析と可視化のためのスケーラブルなツールキット。

rameau-fr/MC-Calib

パースペクティブとフィッシュアイレンズをハイブリッド構成でサポートする汎用的で堅牢なキャリブレーションツールボックスです。

AlanLuSun/High-quality-ellipse-detection

現実世界の画像における高品質な楕円検出アルゴリズムで、ロボットビジョンやPCB検査などの応用において、高い位置精度と効率性を提供します。

hacker-frok/qq-farm-bot-ai

OpenCVテンプレートマッチングを使用して、画面内の要素を視覚的に識別し、収穫、種の管理、社交行動を自動化するQQクラシックファーム用の視覚的自動化ボット。

Faceunity/FULiveDemoDroid

FaceunityのFace AR SDKのAndroid統合例。リアルタイムの顔トラッキング、ビューティフィルター、ARエフェクトを実演しています。

Faceunity/FULiveDemo

FaceunityのNama SDKを使用したリアルタイム顔AR、ビューティフィケーション、モーショントラッキングを実装するiOS統合例

cheind/py-motmetrics

MOTA、MOTP、IDF1、HOTA などの標準指標を使用して、複数オブジェクト追跡結果を評価するための Python ライブラリ。

eduardolundgren/tracking.js

カラー追跡や顔検出などのコンピュータビジョンアルゴリズムをブラウザ上で直接実行できる軽量なJavaScriptライブラリ。

sirfz/tesserocr

並列実行とPillowの統合をサポートし、画像から効率的にテキストを抽出することを可能にする、Tesseract OCR API用のPythonラッパー。

3DiVi/nuitrack-sdk

複数のプラットフォームで動作するさまざまな深度センサーに対応する統合APIを提供する3Dボディおよびスケルタルトラッキングライブラリで、人間中心の空間理解を実現します。

borglab/gtsfm

GTSAM と Dask を基盤としたエンドツーエンドで分散型のStructure-from-Motionパイプライン。2D画像から3Dシーンを再構築し、ネイティブな並列計算をサポート。

ros-perception/perception_pcl

3Dジオメトリ処理およびn-Dポイントクラウド処理のためのROSインターフェーススタック。Point Cloud Library (PCL) をROSと接続する。

aws-samples/amazon-textract-textractor

ドキュメントからテキスト、テーブル、フォーム、身分証明書データを抽出するためのAmazon Textractを簡素化するPythonパッケージ。

scverse/cellrank

マルコフ状態モデルを用いて細胞動態と分化確率を推定する、単細胞データにおける運命マッピングのモジュール式フレームワーク。

luxonis/depthai-python

depthai-core C++ライブラリ用のPythonバインディングで、Luxonisハードウェア向けのAIおよびコンピュータビジョンアプリケーションをPythonで構築できるようにします。

LearnTechWithUs/Stereo-Vision

2台のWebカメラを使用してステレオビジョンをキャリブレーションし、不一致マップと回帰を用いて物体までの距離を測定するコンピュータビジョンプログラム。

brainiak/brainiak

神経科学研究のための Python ベースの解析キット。機能的磁気共鳴画像法 (fMRI) データの処理と解析に焦点を当てています。

ashawkey/kiuikit

3D 視覚、torchネイティブメッシュ処理、および事前構築された PyTorch ニューラルネットワークブロックを提供するニッチなコンピュータビジョンツールキット。

ossimlabs/ossim

OSSIM は、正射投影、再投影、地理空間画像の分析を可能にするオープンソースの C++ 地理空間画像処理ライブラリです。

oliverbravery/PrintGuard

3Dプリントの失敗をリアルタイムで検出し、プリンターを自動的に一時停止してユーザーに警告することで、フィラメントの無駄を防ぐローカルビジョンベースの監視システム。

MohrJonas/obsidian-ocr

Tesseract などのローカル OCR エンジンを使用して、Obsidian で画像や PDF 内のテキスト検索を可能にするプラグイン。

cs-chan/Total-Text-Dataset

自然なシーン画像における任意形状のテキストの検出を改善するための単語レベルの英語曲がったテキストデータセットと評価フレームワーク。

conjuncts/gmft

gmftは、MicrosoftのTable Transformerを使用してPDFの表を構造化された形式(Pandasデータフレームなど)に変換する軽量で高性能なPDF表抽出ツールです。

FAST-Imaging/FAST

CPU と GPU を使用した高パフォーマンスな医療画像処理、ニューラルネットワーク推論、リアルタイム可視化のオープンソースフレームワーク。

microblink/blinkid-ios

IDやパスポートなど、さまざまな書類のスキャンを安全に自動化する包括的なiOS SDK。オプションの即時利用UIを備え、データの自動抽出と検証を実現。

cmusatyalab/openface

深層ニューラルネットワークを使用して、画像およびリアルタイムのビデオストリームから人物を識別するオープンソースの顔認識ライブラリです。

pqpo/SmartCropper

OpenCVとTensorFlowを使用して、文書、IDカード、名刺のインテリジェントな画像切り抜きと透視補正を行うAndroidライブラリ。

NVlabs/nvdiffrec

複数視点画像から三角形3Dモデル、材質、照明を共同最適化によって抽出する微分可能なレンダリングフレームワーク。

frgfm/torch-cam

畳み込みおよびトランスフォーマー型ビジョンモデルの予測を説明・デバッグするための、PyTorch用のクラス活性化マップ(CAM)可視化ライブラリです。

ZFTurbo/Weighted-Boxes-Fusion

Weighted Boxes Fusion (WBF) や NMS などの手法を用いて、複数のオブジェクト検出モデルからの境界ボックス予測をアンサンブルするための Python ライブラリ。

yoshitomo-matsubara/torchdistill

torchdistill は PyTorch を基盤とするライブラリで、YAML 設定ファイルを書くだけで知識蒸留実験(ティーチャー・スタディー学習)を実行できます。多くの最新の KD 損失、中間特徴の抽出用のフォワード・フックマネージャー、およびビジョンおよび NLP タスク用の例題スクリプトを提供します。`pip install torchdistill` でインストールでき、研究で使用する場合は関連論文を引用してください。

lucidrains/alphafold3-pytorch

タンパク質やその他の生体分子の相互作用の3次元構造を予測するためのPyTorch実装であり、PDBデータセットのキュレーションに向けた包括的なツールを備えています。

vturrisi/solo-learn

PyTorch Lightningをベースとした、教師なし視覚表現学習のための自己教師あり学習手法ライブラリ。SOTAの視覚モデルを訓練・比較するための統一された環境を提供します。