datavane/tis

Support agile Ontology DataOps Based on Flink, DataX and Flink-CDC with Web-UI

何を解決するか

TISは、データエンジニアリングの複雑なプロセスを簡素化するために設計されたAIネイティブなデータ統合プラットフォームです。自然言語を使用してデータパイプラインを作成し、データ分析を実行できるようにすることで、手動による複雑な設定やSQLの記述の必要性を排除します。

仕組み

TISは、実績のあるバッチおよびストリーム処理エンジン(DataXおよびFlink-CDCを使用)と、最新のAIレイヤーを組み合わせています:

  • Pipeline AI Agent: LLMを使用して、自然言語によるビジネス要件を、自動化されたプラグインの選択、パラメータの生成、およびタスクのオーケストレーションに変換します。
  • ChatBI: オントロジーレイヤー(ビジネスエンティティとセマンティクスを定義)とGraphRAG(Neo4j経由)を組み合わせて、関連データを取得し、自然言語の質問からSQLクエリを生成します。
  • DataOps Approach: 実行フローをモデル化して「失敗のない」運用体験を提供し、DockerやKubernetesなどのさまざまなデプロイモードをサポートします。

対象ユーザー

パイプライン作成を自動化したいデータエンジニア、およびSQLを知らなくてもデータインサイトを得る必要があるビジネスユーザー向けに構築されています。

ハイライト

  • Natural Language Pipelines: ビジネスニーズを記述するだけで、データパイプラインを作成できます。
  • GraphRAG-powered ChatBI: ナレッジグラフを使用して、ビジネスクエリに対して正確なセマンティック理解とデータ取得を保証します。
  • Multi-LLM Support: DeepSeek、Tongyi Qianwen、GPT-4を含むさまざまなモデルと統合されています。
  • Unified Engine: バッチおよびリアルタイムのデータ同期(例:MySQLからStarRocksまたはDoris)の両方をサポートします。
  • Extensible Architecture: プラグインベースのシステムとマイクロフロントエンドフレームワークにより、容易なカスタマイズが可能です。

関連

  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト
  • プロジェクト