1用参考图与文本提示生成主体一致的视频
- 1准备一张主体清晰的参考图片(如人物、宠物或商品),确保主体在画面中占比适中、背景不过于杂乱。
- 2在 Phantom 的输入界面中上传该参考图,并输入描述动作与场景的文本提示,例如“一位穿红色外套的女孩在雪地中行走”。
- 3调整生成参数(如视频时长、分辨率、随机种子),点击生成按钮,等待模型完成跨模态对齐与视频合成。
- 4预览生成结果,检查主体外观是否与参考图一致;若不满意,微调文本提示或更换参考图后重新生成。
2为已有视频替换或保持特定主体外观
- 1选取一段包含目标主体的源视频,截取其中一帧作为主体参考图,或直接使用原始视频中的主体帧。
- 2将参考图与描述目标动作或场景变化的文本提示一同输入 Phantom。
- 3运行生成流程,让模型在保持主体身份特征的前提下,根据文本提示生成新的视频内容。
- 4对比输出视频与源视频中主体的外观一致性,必要时调整参考帧的清晰度或文本描述的细节后重试。
3快速验证文本到视频的主体一致性效果
- 1访问 Phantom 官网(https://phantom-video.github.io/Phantom/),查看是否提供在线演示或示例输入。
- 2使用官网提供的示例参考图与文本提示,直接运行生成,观察主体在视频中的一致性表现。
- 3替换为自己准备的参考图和简短文本提示(如“一只棕色小狗在草地上奔跑”),再次生成并对比效果。
- 4记录不同参考图与提示词组合下的生成质量,筛选出适合后续正式创作的主体与提示词搭配。
