Veo 3 提示词的结构
按导演在片场的思路写,Veo 的效果最好:先看到什么,发生什么,怎么拍,听到什么。一个可靠的模板:
- 主体:画面里是谁或是什么,加一两个关键特征
- 动作:这段视频里发生的一件事
- 场景与光线:地点、时间、天气和氛围
- 运镜:景别和运动方式,比如特写、推镜、航拍
- 声音:环境声、音效或音乐,直接写出来
- 台词:谁在说,以及放在引号里的那句话
这个 Veo 3 提示词库收录 24 条提示词,分为 6 组:对白场景、电影感空镜、产品与美食、竖屏短视频、图生视频和动画风格。好的 Veo 3 提示词只描述一个镜头:主体、动作、场景、运镜和光线,然后是声音;台词放在引号里,长度要能在 8 秒内说完。提到“这张照片”的提示词需要上传起始图片。
每条提示词只描述一个能拍出来的瞬间,4 到 8 秒刚好放得下。
环境声、音效和音乐都写明,因为 Veo 会生成你描述的声音。
写明说话人,台词短到能在视频结束前说完。
替换主体、地点或台词,保留让镜头成立的结构。
复制它,或点“去试试”在生成器中打开。
手机端选 9:16,其他选 16:9;有台词选 8 秒,快速空镜 4 秒就够。
用 Veo 3.1 Lite 或 Fast 测试,再用 Veo 3.1 生成满意的版本。
按导演在片场的思路写,Veo 的效果最好:先看到什么,发生什么,怎么拍,听到什么。一个可靠的模板:
说话需要时间。8 秒视频里,英文大约能放下 15 到 20 个单词,中文大约 20 到 30 个字;更长的台词会说得很赶或被截断。画面里有两个人时写明说话人,必要时描述语气:低语、大喊、笑着说。
如果 Veo 加了你不想要的字幕,在提示词里加上“不要字幕”后重新生成。英文台词最稳定;中文台词也能生成,但发音和口型偶尔会有偏差,建议先用 Lite 测试。
从图片开始时,主体、风格和光线已经由图片决定。提示词只需要写运动、运镜和声音:“蒸汽升起,镜头缓缓推近,水壶开始鸣响。”温和、符合物理的运动能让视频忠于原图。
提到“这张照片”的提示词需要上传起始图片。可以直接复制,或点“去试试”在生成器中打开。
夜晚,霓虹灯照亮的潮湿小巷。一位穿风衣的侦探蹲在一把破伞旁,抬头说:“这不是意外。”缓慢推镜,雨声沙沙,远处传来警笛。
午后暖光里,两个老朋友在小咖啡桌旁重逢。女生笑着说:“你一点都没变。”他笑出声。中景双人镜头,咖啡馆人声,杯子轻碰。
昏暗的航天指挥大厅里,飞行总指挥凑近麦克风,平静地说:“准许着陆。”屏幕微光,轻微的无线电对话,随后一片安静。不要字幕。
阳光照进木工坊,一位老木匠打磨椅腿,抬头对着镜头说:“量两次,再下锯。”光线里飘着木屑,轻柔的打磨声,特写。
清晨薄雾漫过松林间平静的湖面,一声潜鸟的鸣叫掠过水面,无人机贴着水面缓慢滑行,冷色柔光。
雨夜的东京涩谷十字路口,数百把雨伞,湿漉漉的柏油路映着霓虹,高机位远景,城市环境声和过街提示音。
黄金时刻,一列长长的货运列车穿过红色沙漠,航拍跟随大远景,热浪蒸腾,引擎和车轮低沉的轰鸣。
风暴中巨浪拍上渔船船头,甲板上的手持镜头,浪花溅到镜头上,狂风呼啸,金属吱嘎作响。
阳光照进厨房,一台哑光黑咖啡机正在萃取浓缩咖啡,微距特写油脂滴落,蒸汽的嘶嘶声和一声轻响。
一只白色球鞋慢动作落在湿漉漉的水泥地上,水花向四周溅开,棚拍轮廓光,沉闷的落地声和一记低音。
夜市摊位上,厨师在冒火的铁锅里颠炒面条,火苗窜起,特写,响亮的滋滋声和锅铲碰撞声。
黑色大理石上的一瓶玻璃香水,一束光缓缓扫过瓶身,轻柔的环绕镜头,一声空灵的风铃音。
俯拍双手在大理石台面上做抹茶拿铁,茶筅轻敲碗沿,牛奶倒入,清晨柔光,轻快的 lo-fi 音乐。
街头采访者把麦克风递给一位穿连帽衫的年轻人,他笑着说:“说实话?菠萝就该放在披萨上。”嘈杂的街头环境声,手持镜头。
穿黄色雨衣的金毛在城市人行道上踩水坑,低机位跟拍,雨声和欢快的狗叫。
女生在阳光明媚的石板街上转身,展示飘逸的红裙,镜头环绕她,轻快的流行节拍和脚步声。
这张照片里的人眨眨眼,微微一笑,说:“嗨,是我。”微风吹动头发,安静的室内环境声。
这张照片里的云慢慢向左飘,水面泛起涟漪,镜头缓缓推近,风声和远处的鸟鸣。
这张照片里的产品在台面上缓缓旋转,一道柔和的光带扫过表面,细微的机械转动声。
这张照片里的画活了过来:树叶摇曳,鸟儿飞过天空,笔触质感保持可见,轻柔的管弦乐。
只写一个镜头:一个主体、一个动作、场景和光线、明确的运镜,再写声音。台词放在引号里并写明说话人,长度控制在 8 秒内能说完。
写明谁在说话,并把台词放在引号里,例如:厨师抬头说:“尝尝这个。”台词控制在一两句短句,需要时再描述语气。
在提示词里加上“不要字幕”或“画面中不要出现文字”,然后重新生成。提示词没有排除字幕时,Veo 有时会给对白场景加上字幕。
适用。每条提示词三个模型都能用。先用 Lite 或 Fast 测试节省积分,再用 Veo 3.1 生成满意的版本。
两到四句就够了。先写主体和动作,再补运镜、光线和声音;写得太长,模型反而很难顾及每个细节。
可以。Veo 能理解中文提示词,但对英文的理解最稳定。效果不理想时,把画面描述改成英文再试,台词可以保留中文。
最后更新:2026年10月6日