← 指南
由人工智能制作的 UGC 产品视频截帧:一个人手里拿着 canberke.com Cool Lime 瓶子

canberke.com · 指南

5 分钟做出 UGC

Reels 里那支 UGC 产品视频从零制作的完整流程。图像与视频都在 Higgsfield 上完成(z-image、GPT Image 2、Kling 3.0);配音用的是 ElevenLabs。每一步都写明了所用模型,以及可以复制并按自己情况修改的提示词。提示词特意用英文——模型对英文的响应更好。

这份指南是可交互的。 把下面“填写你的信息”里的内容换成你自己的产品,这里所有提示词都会 立即按你的信息 更新。然后一键复制每条提示词。

填写你的信息

填写一次,下面所有提示词都会自动套用。高亮部分就是你填的内容。

1 产品图 工具:GPT Image 2 / Nano Banana(Higgsfield)· 约 7 点数

如果手上有实物,就用手机在干净光线下拍正反两面——这样最真实。没有实物(像我这样)就用人工智能生成。关键是标签必须清晰可读。


        
提示词 · 英文
2 出镜人物(UGC 主角) 工具:z-image(Higgsfield)· 约 0.15 点数

生成手持产品的人物。真实感的关键就在这里:如果不写上“iPhone 前置摄像头、皮肤有瑕疵、房间杂乱、轻微运动模糊”这类描述,画面立刻就假。让一只手在胸前摊开,下一步才好把产品放进去。


        
提示词 · 英文
3 把产品放进手里 工具:GPT Image 2 · 人物 + 产品参考(Higgsfield)· 约 7 点数

第 2 步的人物图 ve 和第 1 步的产品图一起作为参考。目标是:同一个人,手里拿着产品,标签朝向镜头且清晰可读。写明“保持人物与场景不变,只改手部”能保住一致性。


        
提示词 · 英文
4 生成视频 工具:Kling 3.0(Higgsfield)· 首帧 = 第 3 步 · 9:16 · 8 秒 · 约 12 点数

把第 3 步的图作为首帧上传。“看起来不像 AI”的关键就在这一步:让光线、标签和手的姿势逐帧保持一致。加上“NO morphing, label stays sharp”能明显减少画面漂移。


        
提示词 · 英文
5 配音 工具:ElevenLabs(克隆音色或现成音色)

视频先做成无声,土耳其语配音单独叠加。原因是:视频模型的土耳其语口型同步并不可靠。用 ElevenLabs 配好音再放进视频;需要的话可以用配音/口型同步工具对齐嘴型。


        
配音 · 土耳其语

什么情况下会失败: 这套流程做产品展示和短 UGC 非常好用。但如果是长时间对着镜头说话的人脸,或者复杂的手部动作,仍然可能露馅。那时就交给声音、节奏和剪辑。最后一步永远是你的剪辑:字幕、节奏与调色。

这份指南是免费的。遇到问题可以在 Instagram上给我留言。— canberke.com