elixir-explorer/explorer
Series (one-dimensional) and dataframes (two-dimensional) for fast and elegant data exploration in Elixir
解決的問題
Explorer 為 Elixir 語言提供快速的資料探索與操作功能,將系列(1D)與資料框(2D)引入生態系。讓開發者能在不離開 Elixir 環境的情況下,高效處理大型資料集。
運作方式
Explorer 使用可插入的後端系統,其預設後端基於 Polars 庫的 NIF 綁定,確保高效率的資料處理。它實作受 Tidy Data 與 dplyr 影響的 API,提供一組受限制的「動詞」用於資料操作。該庫支援多種資料格式,包括 CSV、Parquet、NDJSON 與 Arrow IPC,並可透過 ADBC 與外部資料庫整合,或直接連接至 S3 儲存空間。
適用對象
專為需要在其應用程式中或 Livebook 等互動式環境中進行結構化資料分析、清洗與探索的 Elixir 開發者所設計。
主要特色
- 高效率:基於 Polars 庫,實現超快執行速度。
- 語言優雅性:結合 Polars 的速度與「Elixir 風格」的不可變 API。
- 廣泛格式支援:原生支援 Parquet、CSV、NDJSON 與 Arrow IPC。
- 彈性整合:透過 ADBC 連接 S3 與外部資料庫。
- 強型別支援:支援多種簡單型別系列,包括二進位、布林值、日期以及各種整數/浮點數大小。
相關
- 專案
- 專案
- 專案
- 專案
- 專案