elixir-explorer/explorer
Series (one-dimensional) and dataframes (two-dimensional) for fast and elegant data exploration in Elixir
何を解決するか
Explorer は Elixir 言語向けに高速なデータ探索および操作機能を提供し、データ系列(1次元)とデータフレーム(2次元)をエコシステムに導入します。大規模なデータセットを Elixir 環境から離れることなく効率的に扱えるようにします。
動作方法
Explorer はプラグイン可能なバックエンドシステムを採用しており、デフォルトのバックエンドは Polars ライブラリへの NIF バインディングに基づいています。これにより、高速なデータ処理が保証されます。Tidy Data および dplyr に影響を受けた API を実装しており、データ操作のための制約付き「動詞」のセットを提供します。CSV、Parquet、NDJSON、Arrow IPC などのさまざまなデータフォーマットをネイティブでサポートし、ADBC を通じて外部データベースに接続したり、S3 ストレージに直接接続することも可能です。
対象ユーザー
アプリケーション内や Livebook などのインタラクティブ環境で構造化データの分析、データクリーニング、探索を必要とする Elixir 開発者向けに設計されています。
主な特徴
- 高速性: Polars ライブラリを基盤として、超高速な実行を実現。
- 言語的な洗練さ: Polars の高速性と "Elixir風" の不変 API を組み合わせ。
- 広範なフォーマット対応: Parquet、CSV、NDJSON、Arrow IPC のネイティブサポート。
- 柔軟な統合: ADBC を通じて S3 および外部データベースに接続可能。
- 強力な型システム: バイナリ、ブール値、日付、さまざまな整数/浮動小数点型を含む幅広い単純型の系列をサポート。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト