Basekick-Labs/arc
Open, SQL-native time-series database for telemetry you need to keep. 34M+ records/sec ingestion, 8M+ rows/sec queries. InfluxDB Line Protocol and Telegraf compatible. Open Parquet on your storage. Single binary. S3/Azure native. Air-gap ready. AGPL-3.0.
解決的問題
Arc 是一個專為高吞吐量遙測資料設計的 SQL 原生時序資料庫。它透過使用開放的 Parquet 儲存引擎,解決了「保留崖」問題——即團隊因儲存成本被迫刪除或降採樣舊資料。此方案讓團隊能在自有基礎設施(本地磁碟、S3、Azure 或 MinIO)上保留完整解析度的歷史資料,而無需將熱資料與冷資料路徑分開處理。
運作方式
Arc 作為單一靜態連結二進位檔運作,整合了資料攝取管道、Parquet 儲存引擎以及基於 DuckDB 的 SQL 查詢層。支援多種攝取協定,包括 InfluxDB Line Protocol 和 MessagePack,並透過背景壓縮系統自動將小的 Parquet 檔案合併為更大的優化檔案,以減少儲存空間並提升查詢速度。提供分析型 SQL 功能(CTE、視窗函數、JOIN),並透過保留策略與持續查詢管理資料生命週期。
適用對象
主要為航太遙測而建構,但也適用於任何機器持續產生資料的環境,例如工業物聯網、製造、能源、車隊遙測與一般可觀測性。
核心亮點
- 高效率攝取:使用 MessagePack Columnar 可達每秒超過 3400 萬筆記錄的攝取能力。
- 開放儲存:以標準 Apache Parquet 檔案格式儲存資料,避免供應商鎖定。
- SQL 原生:使用標準分析型 SQL,而非專有查詢語言。
- 零相依:以單一二進位檔部署,無需 JVM、Python 或外部叢集。
- 廣泛相容:相容 InfluxDB Line Protocol 與 Telegraf,支援低風險遷移。
- 企業就緒:提供可選的 FIPS 140-3 建構版本,適用於受規範環境,並支援 S3/Azure 儲存後端。
相關
- 專案
- Dispatch
- Dispatch
- Dispatch
- 專案