vespa-engine/vespa

The AI search platform

Vespa – 大规模搜索与AI服务化平台

是什么 – Vespa 是一个开源的高性能平台,用于服务搜索、推荐、个性化以及其他由AI驱动的工作负载。它允许您存储和查询大规模的向量、张量、文本和结构化数据,实时运行机器学习模型,并聚合结果——所有操作均在几十毫秒内完成,且可扩展至任意规模。

为何重要 – 现代AI应用(语义搜索、向量相似性、排序、实时个性化)需要结合快速检索与即时模型推理。Vespa 提供了分布式集群上的高可用性基础设施,无需您自行拼接独立的数据库、特征存储和推理服务器即可实现这一目标。

核心功能

  • 向量与张量索引 – 存储高维嵌入并执行近似最近邻搜索。
  • 服务时的模型推理 – 在查询管道中直接运行 Java 或 C++ 机器学习模型。
  • 丰富的查询语言 – 结合关键词、语义和结构化过滤器;计算自定义排序函数。
  • 可扩展的低延迟架构 – 专为亚100毫秒响应时间设计,即使在大规模、持续变化的数据集上也能保持高效。
  • 混合云与本地部署 – 可在 Vespa Cloud(免费试用)上运行,或在支持 Docker 的 Linux(AlmaLinux 8)上自托管。
  • 可扩展的 Java 组件 – 添加自定义排序、排序函数或数据处理器。

快速入门

  1. 试用云服务 – 访问 vespa.ai/free-trial 注册并部署一个示例应用。
  2. 本地运行 – 参考文档中的 Getting Started 指南安装单节点 Vespa 实例。
  3. 从源码构建(可选)– 仓库包含所有 C++ 和 Java 代码。使用提供的 Docker 开发镜像,或设置本地 AlmaLinux 8 环境,然后运行 ./bootstrap.sh java && mvn install
  4. 探索示例应用sample-apps 仓库展示了语义搜索和推荐等典型用例。

文档与社区

贡献 – 欢迎贡献。请参阅 CONTRIBUTING.md 了解流程,Code-map.md 了解代码结构,TODO.md 查看待改进的开放想法。

许可证 – Apache 2.0(详见 LICENSE)。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目