scverse/anndata

Annotated data.

解決的問題

anndata 提供了一種標準化的方式來處理帶註解的資料矩陣,彌補了 pandas 與 xarray 之間的差距。它讓研究人員能有效率地在記憶體或磁碟上管理大型資料集——包含單細胞體組學分析所使用的資料集。

工作原理

該套件實作了一種支援註解矩陣的資料結構。其特點包括計算上高效的運算,支援稀疏資料與延遲運算,從而能在不一次性將所有資料載入記憶體的情況下,高效處理大型資料集。

適用對象

主要針對資料科學家與研究人員,特別是處理單細胞體組學資料的使用者(因其最初是為 Scanpy 所開發),但任何需要註解資料矩陣的應用場景皆適用。

主要亮點

  • 專為註解矩陣設計的自訂資料結構
  • 支援稀疏資料以減少記憶體使用
  • 支援延遲運算以實現高效處理
  • 兼容記憶體與磁碟後端的資料集
  • 與 scverse 生態系統整合

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案