做本地探店号的阿荔一直有个执念:开场三秒要有电影感。实拍要设备要天气,买素材又贵又容易撞车。Veo这类文生视频模型把这条路铺平了——一句结构完整的描述,就能生成一段带运镜的镜头。这个教程以Gemini里的Veo为例,把提示词的写法和生成流程拆开讲。
准备清单
一个Google账号,登录 gemini.google.com;免费档可以体验视频生成,但有排队和次数限制,急用或者批量产出需要付费档,具体额度以页面当日提示为准;想好你要的镜头四要素:主体是谁、在什么场景、什么光线、什么运镜,缺一个,出片质量就打折扣。
分步操作
第 1 步:进入视频生成。在Gemini对话里直接描述"帮我生成一段视频",或从工具入口选视频生成。预期结果:界面切换到视频模式,输入框提示你描述画面。
第 2 步:写结构化提示词。别只写"一杯咖啡",用这个模板,方括号里换你的内容:
A cinematic close-up shot of [a barista pouring latte art] in [a sunlit specialty coffee shop], shallow depth of field, warm morning light through the window, slow dolly-in camera movement, 8 seconds, photorealistic.
为什么这么填:主体和场景负责"拍什么",光线负责氛围,运镜负责质感——AI对"slow dolly-in(缓慢推镜)"这类影视词汇的响应非常敏感;"8 seconds"锁定时长;要竖屏就加"vertical 9:16",探店视频用竖屏参数,发布时不用裁。
第 3 步:生成与等待。提交后进入队列,免费档可能要等上几分钟。预期结果:得到一段可直接预览的视频。常见失败:排队超时或生成失败,多半是高峰期,换个时段重试;画面元素没出现,回头检查提示词里是不是塞了太多主体,一次只拍一件事。
第 4 步:迭代调整。第一版不满意不要推倒重来,在原对话里追加修改指令:"keep the same scene, but change the camera movement to orbit"。预期结果:新版本保留上一版的场景设定,只换你要改的维度,迭代两三轮就能逼近想要的效果。
第 5 步:下载进剪辑线。满意后下载视频,导入剪映,AI镜头接实拍主体片段,配乐对上节奏,一条"AI开场+实拍内容"的成片就齐了。
效果与验收
验收标准:生成镜头的主体清晰、运动自然、没有明显变形,放到成片开头三秒能留住人。阿荔现在的开场镜头全走这条路,一条几块钱的成本顶掉一次外拍,用她的话说,"以前开场靠运气,现在开场靠提示词"。
进阶方向
把店铺logo和主打产品的实拍图用图生视频功能动起来,比纯文字生成的更像"这家店";批量做系列视频时,固定一段风格描述词不动,只换主体和场景,整套账号的视觉调性就统一了。国产侧想对比效果的,用可灵跑同样的提示词,两条产线各留一段素材库。