Veo 3.1 Lite 每秒 $0.05,标准版每秒 $0.40——同一家的模型差 8 倍。这篇教你按「废片率」而不是「单价」算真实成本,并说明哪些营销场景现在真的能用 AI 视频。
这是 Google 官方公布的价格。Google 的 Veo 3.1,同一个模型家族里最便宜和最贵的档差 8 倍:
- Veo 3.1 **Lite**:每秒 $0.05(720p)/ $0.08(1080p),含音频
- Veo 3.1 **Fast**:每秒 $0.10(720p)/ $0.12(1080p)/ $0.30(4K),含音频
- Veo 3.1 **标准**:每秒 $0.40(720p 与 1080p)/ $0.60(4K),含音频
- (Google Gemini API 官方定价)
按标准版算,一条 30 秒的 1080p 视频是 $12。按 Lite 算是 $2.4。
但这两个数字都不是你的真实成本,因为**你不会一次就生成出能用的片子**。
本文重点
- Veo 3.1 官方价从每秒 $0.05 到 $0.60,跨度 12 倍(Google 官方)
- 真实成本 = 单价 × 时长 × **废片倍数**,废片倍数通常在 3 到 10 之间
- ⚠️ 网上大量 AI 视频比价文的数字与官方定价对不上,用之前务必回官网核对
- 按场景选档位:测试用 Lite,社交发布用 Fast,只有交付客户才用标准版
- AI 视频现在真正好用的是**素材层**,不是成片层
先说数据可信度
写这篇时我对比了几篇流传较广的 AI 视频比价文章,它们给出的 Veo 3.1 Fast 价格是每秒 $0.15。而 Google 官方定价页上,Veo 3.1 Fast 是 **$0.10(720p)**、$0.12(1080p)。
而且那些文章基本都没提到 Veo 3.1 Lite 这一档——那是最便宜的 $0.05。
AI 模型的定价变动非常频繁,二手比价内容过期得特别快。**看到任何 AI 工具的价格对比,都值得花两分钟回官网核对一次**,尤其在你要据此做预算决策的时候。
真实成本的算法:加上废片倍数
AI 视频生成的不可控程度远高于文字和图片。同一个 prompt 生成十次,结果可能有明显差异;而视频里任何一个瑕疵——手指数量不对、文字扭曲、物体穿模、动作违反物理——整条就废了。
所以实际公式是:
真实成本 = 每秒单价 × 视频时长 × 废片倍数
废片倍数取决于你的要求有多严。粗略的经验区间:
- **要求宽松**(抽象画面、氛围镜头、不含人物特写):3 到 5 倍
- **要求中等**(有人物但不特写、有简单动作):5 到 8 倍
- **要求严格**(人物特写、手部动作、画面内有文字、需要连续多镜头一致):10 倍以上,甚至做不出来
按 5 倍算,一条 30 秒 1080p 的成片,标准版实际成本是 $60,Fast 是 $18,Lite 是 $12。
**这个倍数才是选档位的真正依据。** 用标准版反复试错,是在用最贵的价格买废片。
分档使用,不要只用一个档
最省钱的做法是把生成过程分成两段。
**先用最便宜的档位试 prompt。** Lite 每秒 $0.05,用它反复调整描述、构图、镜头运动,直到画面结构基本符合预期。这个阶段你要的是「方向对不对」,不是画质。
**prompt 定了再用高档位出成片。** prompt 定下来之后,再用 Fast 或标准版生成最终版本。此时废片率会显著低于盲试阶段。
这个做法能把总成本压到直接用标准版硬试的三分之一以下。
哪些营销场景现在真的能用
诚实地说,AI 视频目前在**成片层**还不够可靠,但在**素材层**已经很实用。
**现在就能用的:**
- **B-roll 和转场素材** —— 城市空镜、抽象动效、产品漂浮旋转。没有人物、没有文字,废片率最低
- **广告的开头三秒** —— 需要抓眼球的视觉冲击,不需要叙事连贯
- **社交平台的短视频背景** —— 配上文字和配音后,AI 素材的瑕疵不易察觉
- **同一概念的多版本测试** —— 投放前要测五个不同视觉方向,AI 的成本远低于实拍
**现在还别用的:**
- **真人口播** —— 人物一致性和口型仍然是弱项,观众很容易察觉