Skip to content

6 关键帧视频生成操作指南

本指南演示如何使用 AI API Gateway 的 ComfyUI 6 关键帧首尾帧视频生成功能,将 6 张关键帧图片转换为一段流畅的过渡视频。

📋 前置准备

1. 准备 6 张关键帧图片

关键帧图片需要保持特定人、物、风格、场景的一致性。本示例使用「鲤鱼跳龙门」场景:

关键帧 1

关键帧 1:起始姿态

关键帧 2

关键帧 2:准备起跳

关键帧 3

关键帧 3:跃出水面

关键帧 4

关键帧 4:腾空而起

关键帧 5

关键帧 5:穿越龙门

关键帧 6

关键帧 6:完成跳跃

关键帧设计要点

  • 动作连贯:相邻帧之间的动作变化要平滑自然
  • 风格一致:保持统一的画风、色彩和光照
  • 主体一致:同一角色或物体在不同帧中保持可识别性
  • 场景连贯:背景和环境要有逻辑关联

2. 获取 API 密钥

联系管理员获取 AI API Gateway 的访问密钥(格式:sk-xxx)。


🎬 生成视频

方法一:AI 助手对话式生成(推荐)

这是最简单的方式,只需将 Skill 文件发送给 AI 助手,然后用自然语言描述需求。

步骤 1:学习 Skill

在 AI 对话中发送以下指令:

学习:https://ai.ospreyai.cn/docs/raw/skills/comfyui-keyframes-video-generation.md,保存为本地的技能 skills
📸 查看对话截图AI 助手学习 Skill

步骤 2:上传图片并生成视频

将 6 张关键帧图片发送给 AI 助手,并说明生成需求:

请使用刚学习的 6 关键帧视频生成技能,将这 6 张图片生成一段视频。
每张图片作为一个关键帧,生成流畅的过渡动画。

AI 助手会自动:

  1. 上传 6 张图片到 ComfyUI
  2. 构建 5 段首尾帧过渡工作流
  3. 提交生成任务并监控进度
  4. 下载最终视频文件

步骤 3:获取视频

生成完成后(通常需要 1-2 分钟),AI 助手会提供视频文件的下载链接。


方法二:API 直接调用

适合开发者集成到自己的应用中。详细参数说明请参考 ComfyUI 6 关键帧视频生成 Skill

快速示例

bash
export GW="https://ai.ospreyai.cn"
export API_KEY="sk-your-api-key"

# 1. 上传 6 张关键帧图片
for i in {1..6}; do
  curl -X POST "$GW/api/v1/ai/upload/image" \
    -H "Authorization: Bearer $API_KEY" \
    -F "image=@keyframe_$i.png" \
    -F "overwrite=true" \
    -F "subfolder=keyframes_demo"
done

# 2. 提交工作流(完整 prompt 见 Skill 文档)
curl -X POST "$GW/api/v1/ai/prompt" \
  -H "Authorization: Bearer $API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "prompt": {
      "1": {"inputs": {"image": "keyframes_demo/keyframe_1.png"}, "class_type": "LoadImage"},
      "2": {"inputs": {"image": "keyframes_demo/keyframe_2.png"}, "class_type": "LoadImage"},
      ...
    }
  }'

# 3. 查询任务状态
curl "$GW/api/v1/ai/history/{prompt_id}" \
  -H "Authorization: Bearer $API_KEY"

# 4. 下载视频
curl -o output.mp4 "$GW/api/v1/ai/view?filename={filename}&subfolder=video&type=output" \
  -H "Authorization: Bearer $API_KEY"

🎥 效果演示

以下是使用本指南生成的「鲤鱼跳龙门」视频:

🎬 6 关键帧生成的完整视频(720×720, 24fps, ~5 秒)

视频参数

参数
分辨率720 × 720
帧率24 fps
总时长~5 秒
总帧数125 帧(5 段 × 25 帧)
模型Wan 2.2 FLF2V + LightX2V 加速

💡 最佳实践

关键帧设计

  1. 动作分解:将一个完整动作分解为 6 个关键姿态

    • 帧 1:起始状态
    • 帧 2-5:过渡动作
    • 帧 6:结束状态
  2. 变化幅度:相邻帧之间的变化不宜过大,建议每次变化 15-20%

  3. 构图一致:保持主体在画面中的位置和比例相对稳定

生成技巧

  1. 提示词:每段过渡可以使用不同的正向提示词(positive prompt)来引导动作

    • 段 1(帧1→帧2):描述从状态 A 到状态 B 的过渡
    • 段 2-5:可以留空或使用简短描述
  2. 负面提示词:使用统一的负面提示词过滤低质量内容:

    worst quality, low quality, blurry, distorted, deformed, ugly, bad anatomy, disfigured, poorly drawn, extra limbs, clone face
  3. 种子控制:使用固定 seed 可以获得可重复的结果,便于调试

常见问题

Q: 视频过渡不自然怎么办?
A: 检查相邻关键帧的变化幅度,确保动作连贯。可以尝试增加中间帧或调整关键帧顺序。

Q: 生成时间太长?
A: 这是正常的,6 关键帧需要生成 5 段视频并合并。通常需要 1-2 分钟,取决于服务器负载。

Q: 可以使用更多关键帧吗?
A: 当前 Skill 固定支持 6 关键帧。如需更多帧,可以分段生成后手动拼接。


📚 延伸阅读


🔗 相关资源

AI API Gateway Documentation