spiceai/spiceai

Add a real-time analytics node to your operational database. Spice is a portable, accelerated SQL query, search, and LLM-inference engine in Rust for data-grounded AI apps and agents.

해결하는 문제

Spice는 데이터 기반 AI 애플리케이션과 에이전트를 구축할 때 복잡한 데이터 파이프라인과 "글루" 코드가 필요 없도록 설계된 포터블하고 고속의 SQL 쿼리, 검색, LLM 추론 엔진입니다. 연합된 데이터 소스에 접근할 때 발생하는 높은 지연과 운영 부담 문제를 해결하며, 로컬에서 밀리초 수준의 지연으로 쿼리와 AI 추론을 실행할 수 있도록 하면서도 분산 클러스터로 확장할 수 있습니다.

작동 방식

Spice는 "클러스터 사이드카 아키텍처"를 사용합니다. 애플리케이션 파드 내에 가벼운 Spice 사이드카가 실행되어 로컬에서 제한된 데이터 세트를 기반으로 SQL, 검색, LLM 추론을 제공합니다. 더 큰 데이터셋이나 "롱테일" 쿼리의 경우, Apache Ballista를 기반으로 한 분산 쿼리 처리와 Spice Cayenne 데이터 가속기로 구동되는 중앙 Spice 클러스터로 요청을 자동으로 위임합니다. PostgreSQL, MySQL, MongoDB에 대해 네이티브 Change Data Capture (CDC)를 지원하여 Kafka나 Debezium과 같은 ETL 도구 없이 실시간 분석 복제를 가능하게 합니다.

대상 사용자

S3, Snowflake, MongoDB, Postgres 등 다양한 소스의 연합된 데이터에 실시간으로 접근이 필요한 데이터 집약형 애플리케이션과 AI 에이전트를 개발하는 개발자에게 적합합니다. 또한 하나의 쿼리 계획 내에서 LLM 추론과 벡터 검색을 통합해야 하는 경우에도 적합합니다.

주요 특징

  • 실시간 분석 노드: Postgres, MySQL, MongoDB의 운영 데이터베이스를 약 2초의 최신성으로 사전 복제하며, 본격적인 생산 환경에 부담을 주지 않습니다.
  • AI 네이티브 런타임: OpenAI 호환 API, 텍스트-에서-SQL (NSQL), 벡터 검색(Amazon S3 Vectors 포함)을 SQL 기본 기능에 직접 통합합니다.
  • 하이브리드 검색: 하나의 SQL 쿼리 내에서 BM25 풀텍스트 검색, 벡터 검색, Reciprocal Rank Fusion (RRF)을 사용한 재순위 지정을 결합합니다.
  • 고성능 가속: Vortex에서 동작하는 Spice Cayenne 가속기로, Parquet나 DuckDB보다 더 빠른 랜덤 액세스와 낮은 메모리 사용량을 제공합니다.
  • 페데레이티드 쿼리: 30개 이상의 데이터 소스에 연결 가능하며 고급 쿼리 푸시다운 기능을 지원합니다.
  • 엔터프라이즈 대응: mTLS, HashiCorp/Azure Key Vault 통합, Model Context Protocol (MCP) 지원을 포함합니다.

관련

  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트
  • 프로젝트