CerebriumAI/examples

Examples for Cerebrium Serverless GPUs

解决的问题

为在 Cerebrium 平台上构建和部署 AI 应用的开发者提供一个全面的、实用的、即开即用的实现示例库。它通过提供各种 AI 模态的预配置模板,弥合了平台功能与实际部署之间的差距。

如何工作

每个示例都是一个针对特定用例的自包含项目。用户克隆仓库后,进入特定示例文件夹并使用 cerebrium deploy 命令将应用推送到 Cerebrium 平台。这些示例涵盖了从基础模型部署到高级推理优化的广泛技术实现。

适用人群

希望快速原型设计并部署 LLM、语音代理、图像生成流水线及其他 AI 服务,而无需从零开始的机器学习工程师和 AI 开发者。

主要亮点

  • 多样化的 AI 模态:包含 LLM(vLLM、Falcon)、语音(Whisper、XTTS、实时代理)和图像/视频(Stable Diffusion、ComfyUI、ControlNet)的示例。
  • 推理优化:演示高级技术,如多 GPU 推理、Inferentia 部署和更快的权重加载。
  • 集成模式:提供 Langchain QA 系统、使用 Langsmith 的工具调用以及基于 WebSocket 的流式传输模板。
  • 生产级工具:包含使用 LitServe 和 transformers 实现请求批处理的示例,以及部署 FastAPI 或 Gradio 接口的示例。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目