AI数字人渲染合成管线 #1798

Closed
opened 2026-09-08 14:28:16 +08:00 by xiaoxia · 0 comments
Owner

目标

后端实现AI数字人视频的完整渲染合成流程:对口型视频 + B-roll插入 + 标题叠加 + 封面帧 → 最终输出视频。

合成流程

  1. 输入:对口型视频(来自 MediaKit)+ B-roll素材列表 + 标题配置 + 封面配置
  2. B-roll插入:根据用户指定的分段位置,在全屏切换或画中画模式下插入素材
  3. 标题叠加:复用现有 drawtext 滤镜逻辑(#1789 已实现)
  4. 封面提取:根据封面配置从指定时间点提取帧
  5. 输出:最终视频 + 封面图

FFmpeg 滤镜链

  • 复用 video_filter_builder.py 的现有能力
  • 新增 overlay 滤镜支持(画中画模式)
  • 新增 B-roll 片段拼接逻辑(全屏切换模式)

任务管理

  • 复用现有异步任务队列
  • 任务状态:pending → processing → completed / failed
  • 进度回调通知前端

API

  • POST /api/ai-avatar/render — 提交渲染任务
  • GET /api/ai-avatar/render/{task_id} — 查询渲染状态
  • WebSocket 推送渲染进度

约束

  • 复用现有视频合成基础设施,不重复造轮子
  • drawtext 滤镜逻辑从 #1789 复用
  • 不能破坏现有智能剪辑的渲染流程
## 目标 后端实现AI数字人视频的完整渲染合成流程:对口型视频 + B-roll插入 + 标题叠加 + 封面帧 → 最终输出视频。 ## 合成流程 1. **输入**:对口型视频(来自 MediaKit)+ B-roll素材列表 + 标题配置 + 封面配置 2. **B-roll插入**:根据用户指定的分段位置,在全屏切换或画中画模式下插入素材 3. **标题叠加**:复用现有 drawtext 滤镜逻辑(#1789 已实现) 4. **封面提取**:根据封面配置从指定时间点提取帧 5. **输出**:最终视频 + 封面图 ### FFmpeg 滤镜链 - 复用 video_filter_builder.py 的现有能力 - 新增 overlay 滤镜支持(画中画模式) - 新增 B-roll 片段拼接逻辑(全屏切换模式) ### 任务管理 - 复用现有异步任务队列 - 任务状态:pending → processing → completed / failed - 进度回调通知前端 ## API - POST /api/ai-avatar/render — 提交渲染任务 - GET /api/ai-avatar/render/{task_id} — 查询渲染状态 - WebSocket 推送渲染进度 ## 约束 - 复用现有视频合成基础设施,不重复造轮子 - drawtext 滤镜逻辑从 #1789 复用 - 不能破坏现有智能剪辑的渲染流程
Sign in to join this conversation.
1 Participants
Notifications
Due Date
No due date set.
Dependencies

No dependencies set.

Reference: xiaoxia/xiaoxia-saas#1798