chroma-core/chroma
Search infrastructure for AI
What it solves
Chroma는 AI를 위한 오픈 소스 데이터 인프라를 제공하며, 특히 임베딩의 저장과 검색에 초점을 맞춥니다. AI 애플리케이션을 위한 벡터 데이터베이스 구축 프로세스를 단순화하여, 개발자가 문서를 저장하고 관련 메타데이터(metadata)를 함께 저장한 후, 유사성 검색을 통해 가장 관련성 높은 정보를 찾을 수 있도록 합니다.
How it works
Chroma는 토큰화(tokenization), 임베딩(embedding), 및 인덱싱(indexing)을 자동으로 처리하는 벡터 데이터베이스로 작동합니다. 사용자는 문서 컬렉션(collections)을을 생성하고, 고유한 ID와 메타데이터(metadata)를 함께 문서들을 추가하고, 쿼리 텍스트를 사용하여 벡터 유사성을 기반으로 가장 유사한 결과를 검색할 수 있습니다. 메모리 내 프로토타이핑과 지속성 저장소, 그리고 클라이언트-서버 모드를 모두 지원합니다.
Who it’s for
Python 또는 JavaScript에서 프로토타이핑을 진행 중이든 관계없이, AI 애플리케이션에 벡터 검색과 데이터 지속성을 통합하기 위한 빠르고 쉬운 방법을 필요로 하는 AI 개발자를 위해 설계되었습니다.
Highlights
- 벡터, 하이브리드 및 전체 텍스트 검색 기능.
- 토큰화, 임베딩 및 인덱싱의 자동 처리.
- 컬렉션 생성, 문서 추가 및 메타데이터 필터링을 위한 핵심 기능을 갖춘 간단한 API.
- Python 및 JavaScript 클라이언트를 지원합니다.
- Chroma Cloud를 통해 호스팅되는 서버리스 버전을 제공합니다.