0.09 元每秒的视频模型来了:Vidu Q4 Preview 把「演技」当成卖点
好莱坞对试镜有一种近乎迷信的坚持:不管你拿过多少奖、身价多高,想进组,先演几十秒给我看。这套制度…
文章目录
好莱坞对试镜有一种近乎迷信的坚持:不管你拿过多少奖、身价多高,想进组,先演几十秒给我看。这套制度筛的是电影里最贵的东西——演技。如今,一个视频生成模型也想用同样的逻辑证明自己。
生数科技开放了新一代视频生成模型的预览版本 Vidu Q4 Preview,官方给它的定位是「高表现力旗舰模型」,主打人物演技、镜头张力和复杂特效,价格低到 0.09 元每秒起。
一分钟速览
- Vidu Q4 Preview 是面向创作者的首个预览版本,定位高表现力旗舰模型;
- 主打人物演技、镜头张力与复杂特效,价格 0.09 元/秒起;
- 参考生视频支持最多 15 张参考图、3 段参考音频,可选 2K、4K 超清输出;
- 上手体验中被用来复刻《沙丘》《喜剧之王》《黑神话:悟空》等片段;
- 当前仍属预览阶段,情绪剧烈转折时的节奏自然度还有提升空间。
深度分析
当画面清晰度卷到头,比的是「会不会演」
视频模型的竞争已经走过了几个阶段:先解决画面能不能看,再解决运镜能不能动、清晰度能不能到 4K。当这些东西逐渐变得「都能做」,新的分水岭出现了——模型到底知不知道自己正在拍什么镜头。
Vidu Q4 Preview 的判断是:主体、情绪和叙事节奏,并不会因为运镜数量增加而自动变好。于是它把重点放在「反应」上。所谓反应,是我们听到一句台词只需两秒,但角色脸上那半秒钟从听到、消化到决定回应的变化——这正是判断「这人是真是假」的依据。
实测:从《沙丘》到《喜剧之王》
在《沙丘》式的宫斗片段里,王后从震惊转为恐惧和愤怒,最终只用一个眼神收尾。整场戏没有动作、没有走位,16 秒几乎全靠两个近景的正反打。生成效果自然比不上真人原版,但王后那段「听完、停顿、眼睛先移过去、再慢慢转回头」的反应次序,恰恰是真人演员处理「意识到真相」的方式。
更具挑战的是被北电纳入教材的《喜剧之王》片段:柳飘飘在雨后的街上回头笑着说「你先养好你自己吧」,转身离开,独自在出租车后座崩溃。难点全在后半段从笑到哭、演出溃堤的过程。预览版能把整个流程演出来,但整体节奏目前还不够自然——这符合 Preview 的定位:先把模型交到创作者手里,在真实使用中暴露问题、收集反馈,再迭代到正式版。
而在情绪转折不那么剧烈的场景里,Q4 Preview 对人物状态的把握会稳定很多。动态动作戏则是它更有辨识度的一面:把《黑神话:悟空》的天命人和《影之刃零》的魂放进一座暴雨中的破古寺,滑步突进、劈头横斩、长棍架挡、拧身反扫、跃过棍身、落地追斩,模型都按不同运镜呈现了出来。
数据支撑
- 价格 0.09 元/秒起;
- 参考生视频支持最多 15 张参考图、3 段参考音频;
- 输出可选 2K、4K 超清。
产品链接
- Vidu 官网体验:https://www.vidu.cn/home/recommend
趋势洞察
视频生成的价格战已经打到「分钱级」,接下来拼的是内容质量而不是参数。当清晰度和运镜都不再是瓶颈,能不能演出「正在变得悲伤的过程」,会成为区分玩具和工具的关键。对影视、广告、短剧行业来说,这意味着 AI 不再只是省钱的特效按钮,而是开始进入「表演」这块最贵、最依赖人的领域。0.09 元每秒的价格,则让这种能力第一次具备了工业化试错的经济性。
本文地址:https://www.163264.com/16513