CerebriumAI/examples
Examples for Cerebrium Serverless GPUs
解决的问题
为在 Cerebrium 平台上构建和部署 AI 应用的开发者提供一个全面的、实用的、即开即用的实现示例库。它通过提供各种 AI 模态的预配置模板,弥合了平台功能与实际部署之间的差距。
如何工作
每个示例都是一个针对特定用例的自包含项目。用户克隆仓库后,进入特定示例文件夹并使用 cerebrium deploy 命令将应用推送到 Cerebrium 平台。这些示例涵盖了从基础模型部署到高级推理优化的广泛技术实现。
适用人群
希望快速原型设计并部署 LLM、语音代理、图像生成流水线及其他 AI 服务,而无需从零开始的机器学习工程师和 AI 开发者。
主要亮点
- 多样化的 AI 模态:包含 LLM(vLLM、Falcon)、语音(Whisper、XTTS、实时代理)和图像/视频(Stable Diffusion、ComfyUI、ControlNet)的示例。
- 推理优化:演示高级技术,如多 GPU 推理、Inferentia 部署和更快的权重加载。
- 集成模式:提供 Langchain QA 系统、使用 Langsmith 的工具调用以及基于 WebSocket 的流式传输模板。
- 生产级工具:包含使用 LitServe 和 transformers 实现请求批处理的示例,以及部署 FastAPI 或 Gradio 接口的示例。
相关
- 项目
- 项目
- 项目
- 项目
- 项目