Vidu Q4 Preview 是生数科技新一代旗舰音视频模型的首个公开预览版。2026 年 10 月 7 日,生数科技通过公司新闻稿正式发布 Vidu Q4 Preview,10 月 8 日又宣布该模型进入 YouCam 系列应用;模型已在 Vidu 网页产品和 API 平台上线,发布价低至每秒 0.014 美元。
这次升级主要补在"表演"上
按官方介绍,Q4 Preview 的改进集中在人物表演、镜头运动和视觉效果三处:面部表情、情绪、身体动作和声音之间的配合更协调,目标是让角色在没有台词的停顿里也能传递情绪。参考能力是这一版的硬指标:最多可同时使用 15 张参考图来搭建复杂场景和角色形象,最多 3 段参考音频用于约束角色音色和情绪表达;输出支持 2K 或 4K 分辨率和 10-bit 色深,面向需要进入专业流程的素材标准。
每秒 0.014 美元,算的是创作者的试错账
视频生成很少一次到位:一个能用的镜头往往要反复调整表情、换机位、试不同的开场。生数科技联合创始人兼首席执行官罗怡航在发布稿中表达的意思很明确——效率的提升最终应该变成创作者"再多试一条"的自由。把单价压到每秒 0.014 美元起,瞄准的正是独立创作者、小型工作室和短剧、广告等量产团队的试错成本,而不是只拼单条样片的上限。
值得继续观察的两点
第一,Q4 目前仍是 Preview(预览)阶段,官方给出的是能力方向和创作者的试用反馈,尚没有公开的第三方基准对比,真实成片稳定性要等更多团队上手后才能判断。第二,它的打法很清楚:用多参考图和参考音频解决角色一致性这个行业老问题,再用低价扩大试用面。如果后续正式版能把一致性和价格同时守住,短剧和广告这类对"人物不能变脸"最敏感的生产场景,会是最先感受到变化的地方。