spectralpython/spectral
画像分光法から得られるハイパースペクトル画像データの処理、可視化、分類を行うための純粋なPythonモジュール。
johntruckenbrodt/pyroSAR
さまざまなミッションおよびソフトウェアツールからのSAR衛星データのスケーラブルな整理と処理を可能にするPythonフレームワーク。
histolab/histolab
デジタル病理における Whole Slide Images (WSIs) の処理用ツールで、自動組織検出と深層学習パイプライン用の情報量の多いタイル抽出を提供します。
seung-lab/connected-components-3d
3Dマルチラベルおよびグレースケール画像における連結成分ラベリングのための高性能ライブラリ。バイオメディカルイメージングにおけるインスタンスセグメンテーション解析を加速する設計。
cocoa-xu/evision
Elixir アプリケーション向けの OpenCV バインディングで、コンピュータビジョンツールの自動生成を提供し、CUDA およびエッジデバイス向けシステムにも対応しています。
MRtrix3/mrtrix3
MRtrix3 は、MRIデータの処理と可視化を提供する医療画像ソフトウェアパッケージです。
upipes/PipeNet-Expansion
大規模言語モデル(LLM)によって生成された環境知識を用いて、Ground Penetrating Radar(GPR)地下診断分類器を新しい地理的地域に適応させるためのフレームワークとプロトタイプシステム。
jcreinhold/intensity-normalization
スキャナーとサイト間で MR 画像の強度を正規化し、取得アーティファクトによって機械学習パイプラインが破損するのを防ぐための Python パッケージ。
ngageoint/sarpy
NGA 標準およびさまざまな商業用 SLC 形式をサポートする、複雑な合成開口レーダー(SAR)データを読み取り、書き込み、処理するための Python ライブラリ。
0x09/resdet
周波数領域分析を使用して画像や動画のアップスケーリングを検出し、元のソース解像度を特定するコマンドラインツールおよび C ライブラリ。
pySTEPS/pysteps
光学流と確率的生成器を用いた、短期間のアンサンブル予測システムを構築するためのPythonライブラリ。
koide3/iridescence
ポイントクラウドアルゴリズムの迅速プロトタイピングに最適な、軽量な 3D 可視化ライブラリ。統合された UI ツールを備えています。
orfeotoolbox/OTB
テラバイト規模の光学、マルチスペクトル、レーダーデータを処理できるオープンソースのライブラリ。
dkogan/mrcal
mrcal は、カメラキャリブレーションおよび構造から運動(SfM)の問題を解決するための汎用ツールキットであり、CおよびPythonのライブラリとコマンドラインツールを提供しています。
foundry/OpenCVSwiftStitch
OpenCV を使用して iOS で画像をパノラマにスタッチする例プロジェクト。現代的な Swift/C++ 相互運用性を示す。
scverse/squidpy
空間分子データおよび組織顕微鏡画像の分析と可視化のためのスケーラブルなツールキット。
rameau-fr/MC-Calib
パースペクティブとフィッシュアイレンズをハイブリッド構成でサポートする汎用的で堅牢なキャリブレーションツールボックスです。
AlanLuSun/High-quality-ellipse-detection
現実世界の画像における高品質な楕円検出アルゴリズムで、ロボットビジョンやPCB検査などの応用において、高い位置精度と効率性を提供します。
hacker-frok/qq-farm-bot-ai
OpenCVテンプレートマッチングを使用して、画面内の要素を視覚的に識別し、収穫、種の管理、社交行動を自動化するQQクラシックファーム用の視覚的自動化ボット。
Faceunity/FULiveDemoDroid
FaceunityのFace AR SDKのAndroid統合例。リアルタイムの顔トラッキング、ビューティフィルター、ARエフェクトを実演しています。
Faceunity/FULiveDemo
FaceunityのNama SDKを使用したリアルタイム顔AR、ビューティフィケーション、モーショントラッキングを実装するiOS統合例
cheind/py-motmetrics
MOTA、MOTP、IDF1、HOTA などの標準指標を使用して、複数オブジェクト追跡結果を評価するための Python ライブラリ。
eduardolundgren/tracking.js
カラー追跡や顔検出などのコンピュータビジョンアルゴリズムをブラウザ上で直接実行できる軽量なJavaScriptライブラリ。
sirfz/tesserocr
並列実行とPillowの統合をサポートし、画像から効率的にテキストを抽出することを可能にする、Tesseract OCR API用のPythonラッパー。
3DiVi/nuitrack-sdk
複数のプラットフォームで動作するさまざまな深度センサーに対応する統合APIを提供する3Dボディおよびスケルタルトラッキングライブラリで、人間中心の空間理解を実現します。
borglab/gtsfm
GTSAM と Dask を基盤としたエンドツーエンドで分散型のStructure-from-Motionパイプライン。2D画像から3Dシーンを再構築し、ネイティブな並列計算をサポート。
ros-perception/perception_pcl
3Dジオメトリ処理およびn-Dポイントクラウド処理のためのROSインターフェーススタック。Point Cloud Library (PCL) をROSと接続する。
aws-samples/amazon-textract-textractor
ドキュメントからテキスト、テーブル、フォーム、身分証明書データを抽出するためのAmazon Textractを簡素化するPythonパッケージ。
scverse/cellrank
マルコフ状態モデルを用いて細胞動態と分化確率を推定する、単細胞データにおける運命マッピングのモジュール式フレームワーク。
luxonis/depthai-python
depthai-core C++ライブラリ用のPythonバインディングで、Luxonisハードウェア向けのAIおよびコンピュータビジョンアプリケーションをPythonで構築できるようにします。
LearnTechWithUs/Stereo-Vision
2台のWebカメラを使用してステレオビジョンをキャリブレーションし、不一致マップと回帰を用いて物体までの距離を測定するコンピュータビジョンプログラム。
brainiak/brainiak
神経科学研究のための Python ベースの解析キット。機能的磁気共鳴画像法 (fMRI) データの処理と解析に焦点を当てています。
ashawkey/kiuikit
3D 視覚、torchネイティブメッシュ処理、および事前構築された PyTorch ニューラルネットワークブロックを提供するニッチなコンピュータビジョンツールキット。
ossimlabs/ossim
OSSIM は、正射投影、再投影、地理空間画像の分析を可能にするオープンソースの C++ 地理空間画像処理ライブラリです。
oliverbravery/PrintGuard
3Dプリントの失敗をリアルタイムで検出し、プリンターを自動的に一時停止してユーザーに警告することで、フィラメントの無駄を防ぐローカルビジョンベースの監視システム。
MohrJonas/obsidian-ocr
Tesseract などのローカル OCR エンジンを使用して、Obsidian で画像や PDF 内のテキスト検索を可能にするプラグイン。
cs-chan/Total-Text-Dataset
自然なシーン画像における任意形状のテキストの検出を改善するための単語レベルの英語曲がったテキストデータセットと評価フレームワーク。
conjuncts/gmft
gmftは、MicrosoftのTable Transformerを使用してPDFの表を構造化された形式(Pandasデータフレームなど)に変換する軽量で高性能なPDF表抽出ツールです。
FAST-Imaging/FAST
CPU と GPU を使用した高パフォーマンスな医療画像処理、ニューラルネットワーク推論、リアルタイム可視化のオープンソースフレームワーク。
microblink/blinkid-ios
IDやパスポートなど、さまざまな書類のスキャンを安全に自動化する包括的なiOS SDK。オプションの即時利用UIを備え、データの自動抽出と検証を実現。
cmusatyalab/openface
深層ニューラルネットワークを使用して、画像およびリアルタイムのビデオストリームから人物を識別するオープンソースの顔認識ライブラリです。
pqpo/SmartCropper
OpenCVとTensorFlowを使用して、文書、IDカード、名刺のインテリジェントな画像切り抜きと透視補正を行うAndroidライブラリ。
NVlabs/nvdiffrec
複数視点画像から三角形3Dモデル、材質、照明を共同最適化によって抽出する微分可能なレンダリングフレームワーク。
frgfm/torch-cam
畳み込みおよびトランスフォーマー型ビジョンモデルの予測を説明・デバッグするための、PyTorch用のクラス活性化マップ(CAM)可視化ライブラリです。
ZFTurbo/Weighted-Boxes-Fusion
Weighted Boxes Fusion (WBF) や NMS などの手法を用いて、複数のオブジェクト検出モデルからの境界ボックス予測をアンサンブルするための Python ライブラリ。
yoshitomo-matsubara/torchdistill
torchdistill は PyTorch を基盤とするライブラリで、YAML 設定ファイルを書くだけで知識蒸留実験(ティーチャー・スタディー学習)を実行できます。多くの最新の KD 損失、中間特徴の抽出用のフォワード・フックマネージャー、およびビジョンおよび NLP タスク用の例題スクリプトを提供します。`pip install torchdistill` でインストールでき、研究で使用する場合は関連論文を引用してください。
lucidrains/alphafold3-pytorch
タンパク質やその他の生体分子の相互作用の3次元構造を予測するためのPyTorch実装であり、PDBデータセットのキュレーションに向けた包括的なツールを備えています。
vturrisi/solo-learn
PyTorch Lightningをベースとした、教師なし視覚表現学習のための自己教師あり学習手法ライブラリ。SOTAの視覚モデルを訓練・比較するための統一された環境を提供します。