receptron/mulmocast-cli

AI-powered podcast & video generator.

解决的问题

MulmoCast 解决了传统演示工具(如 PowerPoint)专为人类设计而非 AI 的局限性。它提供了一个 AI 原生环境,使生成式 AI 能够从单一可信源生成丰富的多模态内容,如视频、播客、幻灯片、漫画和 PDF,同时保持人类在创作流程中。

如何工作

系统的核心是 MulmoScript,一种基于 JSON 的中间语言,充当剧本。LLM 生成此脚本以定义叙事结构、视觉元素和音频。MulmoCast CLI 通过以下流程处理该脚本:

  1. 脚本生成:通过交互式 AI 聊天、网页内容或本地文件生成 MulmoScript。
  2. 音频生成:使用 TTS 提供商(OpenAI、ElevenLabs、Google)生成配音。
  3. 图像生成:使用图像模型(OpenAI、Google、Replicate)生成视觉内容,或通过 Slide DSL(Tailwind CSS + Puppeteer)渲染幻灯片。
  4. 合成:将这些资产组合成最终格式,如带字幕的 MP4 视频。

适用人群

专为希望将报告、提案或故事转化为动态多格式内容的创作者、研究人员和商务专业人士设计,无需手动构建每个资产。

主要亮点

  • 多模态输出:可导出为视频、播客、幻灯片、PDF、漫画或「Swipe Anime」。
  • 幻灯片 DSL:一种结构化 JSON 系统,支持 12 种布局和 10 种内容块类型,用于创建专业幻灯片。
  • AI 原生工作流:集成工具支持交互式脚本生成和自动翻译。
  • 使用量追踪:内置功能可估算并追踪多个 AI 提供商的 token、字符和成本消耗。
  • 丰富样式:提供 100 多种预设 CSS 样式,适用于商业、科技、自然等各类主题的 Markdown 幻灯片。

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目