datavane/tis

Support agile Ontology DataOps Based on Flink, DataX and Flink-CDC with Web-UI

What it solves

TIS 是一個 AI 原生資料整合平台,旨在簡化複雜的資料工程流程。它透過允許使用者透過自然語言建立資料管線並進行資料分析,消除了對手動、複雜配置與 SQL 編寫的需求。

How it works

TIS 結合了經過生產驗證的批次與串流處理引擎(使用 DataX 與 Flink-CDC)與現代 AI 層:

  • Pipeline AI Agent: 使用 LLM 將自然語言業務需求轉換為自動化的插件選擇、參數生成與任務編排。
  • ChatBI: 採用結合了本體層(定義業務實體與語義)與 GraphRAG(透過 Neo4j)的技術,從自然語言問題中檢索相關資料並生成 SQL 查詢。
  • DataOps Approach: 對執行流程進行建模,以提供「防呆」的操作體驗,並支援 Docker 與 Kubernetes 等各種部署模式。

Who it’s for

它是為想要自動化管線建立的資料工程師,以及需要從中獲得資料洞察而不需要知道 SQL 的業務使用者而設計的。

Highlights

  • Natural Language Pipelines: 透過簡單描述業務需求即可建立資料管線。
  • GraphRAG-powered ChatBI: 使用知識圖譜來確保業務查詢的精確語義理解與資料檢索。
  • Multi-LLM Support: 整合了包括 DeepSeek、Tongyi Qianwen 與 GPT-4 在內的各種模型。
  • Unified Engine: 支援批次與即時資料同步(例如:MySQL 到 StarRocks 或 Doris)。
  • Extensible Architecture: 採用基於插件的系統與微前端框架,以便於進行客製化。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案