GPT Image 2.5:先确定画面,再开始视频
讨论一段视频时,一张具体的图片往往比抽象描述更容易对齐想法。在 Veo Omni 使用 GPT Image 2.5 探索地点、确定取景角度或准备起始画面。写下场景描述,按需加入参考图,生成一张图片,再决定后续视频里什么需要运动。
为视频想法找到一个看得见的起点
把环境、光线和取景落实到静态画面,再单独准备视频任务。
先研究场景
描述建筑、天气、时间,以及主体需要活动的空位。文字难以说明时,可以上传地点照片提供视觉参考。
确定开场构图
横向场景选 16:9,竖屏镜头选 9:16。提示词说明前景、背景以及计划为动作预留的空间。
逐张检查结果
每次请求返回一张图片。先检查布局并保存结果,再修改提示词重新尝试,确定后用于下一步创作。
Veo Omni 工作流中的静态画面准备
GPT Image 2.5 负责生成图片,Veo Omni 的视频工具负责另一次生成。本页适合先确定场景的视觉方向,把布景选择和视频运动拆成两项清晰的工作。
默认设置为 Flare、1K 和自动比例,也可以选择 Sunburst。两个版本均支持文字或最多 16 张参考图,每次生成一张图片。Veo Omni 的 1K、2K、4K 每张分别为 3、5、7 积分,增加参考图不额外收费。
把设计与运动分别说明
先确定物件在图中的位置。镜头运动、动作和时长放到后续视频提示词中说明。
自行带入视频工具
下载选中的图片,再打开支持图片输入的视频工具并上传。视频任务使用独立设置,另行计算生成费用。
让场景选择更容易讨论
用具体画面判断哪些细节值得保留,再进入后续制作。
给参考图明确分工
按顺序说明:第一张用于地点,第二张提供道具,第三张表达光线。提示词负责解释各张图片在画面中的用途。
用草稿规格探索布局
可以先用 3 积分生成 1K 构图草稿。下一次请求需要更多细节时,再选 2K 或 4K。
同时考虑横竖取景
三档分辨率都支持自动构图与十种指定比例。生成前选择画幅,避免把布局问题全部留给后续裁切。
随时返回任务记录
打开「我的作品」查看提交状态或找回生成帧。确认生成失败后,本次消耗的积分会全额退还。
两条可以直接尝试的场景提示词
下面描述的是静态图片。得到画面后,在视频工具中另写运动与镜头要求。
提示词:雨后车站开场帧
选择 16:9、1K 和 Flare。提示词:「雨后蓝调时刻的乡间火车站台,左下方是一张黄色长椅,湿润地砖映出两盏暖色灯光,远处有群山。平视广角,中央通道保持空旷。没有列车、行人或文字。」检查中央空位是否符合之后让主体入镜的构想。
提示词:商品揭幕布景
上传商品照片作为参考图 1,选择 9:16 和 2K。提示词:「以参考图 1 的陶瓷瓶为主体,放在明亮房间里的浅色石台上,后墙有柔和的叶片投影。瓶子位于画面中下部,上三分之一留空。完整展示瓶身,露出少量地面,不加入其他物件。」生成后对照原图检查瓶形和构图。
准备一张可继续使用的参考帧
让创作要求聚焦于一张图片能够表达的内容。
描述画面中看得见的内容
说明主体、地点、视角高度、光线和构图。上传参考图时,逐张指出希望借用哪些细节。
设置图片输出
选择 Flare 或 Sunburst、画面比例,以及 1K、2K 或 4K。提交前查看积分,每次请求生成一张图片。
检查并下载,再用于下一步
确认结果后下载图片。需要动画时,打开相应的 Veo Omni 视频工具,把下载图片作为新的请求输入。
从静态画面走向视频之前
本页可以直接生成视频吗?
不可以。GPT Image 2.5 返回静态图片。Veo Omni 提供独立视频工具,可以把下载图片上传到兼容的图生视频流程中。该视频任务有自己的参数和费用。
一次能生成完整分镜吗?
每次请求只生成一张图片。需要分别下载的分镜时,应为每个镜头单独提交请求,并在提示词中重复重要的视觉设定。生成后仍需逐张检查一致性。
从哪个版本和分辨率开始?
默认是 Flare 和 1K。Sunburst 是另一种可选版本,不代表承诺更快或更高质量。两者的 1K、2K、4K 每张都分别消耗 3、5、7 积分。
多张参考图如何使用?
最多提供 16 张图片,仍须填写文字提示词。请说明每张有用参考图的作用。16 张指输入上限,生成结果只有一张。
等待较久会自动退款吗?
不会。延迟或暂时查询失败不代表任务确认失败,可到「我的作品」重新查看。确认失败后全额退还本次积分;已提交任务不能取消。
