graphistry/pygraphistry
PyGraphistry is a Python library to quickly load, shape, embed, and explore big graphs with the GPU-accelerated Graphistry visual graph analyzer
何を解決するか
PyGraphistryは、大規模なグラフデータを可視化、分析、スケーリングする方法を提供します。従来のテーブルツールや標準の可視化ライブラリでは、数百万のエッジを処理・可視化するのが困難であるため、GPUアクセラレーションとカラム形式データフォーマットを活用しています。
動作方法
このライブラリは、Pythonデータフレーム(Pandas、cuDF、Spark、Apache Arrow)と統合され、グラフデータのインポートと準備が可能です。ベクトル化されたグラフクエリには、専用のクエリ言語GFQL(Graph Frame Query Language)を使用します。可視化には、Graphistryサーバー(クラウドまたはセルフホステッド)に接続してインタラクティブなグラフをレンダリングします。また、graphistry[ai]モジュールを備えており、クラスタリングやUMAP埋め込みなどのグラフMLおよびAIタスクを実行できます。
対象ユーザー
複雑な関係データを扱い、スケールに応じてグラフ分析、機械学習、高パフォーマンスな可視化を必要とするデータサイエンティストや開発者向けに設計されています。
特徴
- GPUアクセラレーション: NVIDIA RAPIDSを使用し、処理および可視化で100倍以上の高速化を実現。
- GFQL: Cypherに似た構文をサポートする、データフレームネイティブなグラフクエリ言語。
- 広範な統合: グラフデータベース(Neo4j、Amazon Neptune、TigerGraph、ArangoDB、Memgraph)およびデータプラットフォーム(Databricks、Splunk、PostgreSQL)と接続可能。
- AI/ML機能: グラフニューラルネットワーク、UMAP埋め込み、自動特徴工学のための組み込みメソッド。
- インタラクティブな可視化: ドリルダウン、タイムバー、フィルタリングなどの組み込みツールで、数百万のエッジをサポート。
関連
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト
- プロジェクト