本报讯 (记者贾丽)10月8日,北京生数科技股份有限公司(以下简称“生数科技”)发布新一代视频生成旗舰模型的首个预览版本Vidu Q4 Preview。模型重点提升人物演绎、镜头语言与复杂视效,首发优惠价格低至0.09元/秒起。
相比单纯刷新模型指标,这次发布更值得关注的变化是,旗舰视频生成模型正在进入普通创作者和小团队可以更高频调用的价格区间。
AI降低技术门槛
传统视频制作涉及脚本、表演、摄影、灯光、特效和后期等多个环节。生成式AI让文字和图片可以直接转化为动态内容,降低了设备、场地和专业软件的门槛,但并没有消除创作中的试错。
恰恰相反,当生成变得更容易,创作者会更自然地尝试不同的人物表演、镜头、节奏和版本。因此,衡量视频模型是否真正普惠,不能只看“生成一条视频多少钱”,还要看一条可用镜头需要尝试多少次,以及整个创作过程的综合成本。
只有模型能力提升和使用成本下降同时发生,前沿视频模型才有机会从少量精选样片真正进入日常创作。
据了解,此次Vidu Q4 Preview首发优惠价格为0.09元/秒起,并提供540P、720P、1080P、2K、4K等多种输出规格。在可比规格与计费条件下,同等预算可生成约5倍内容。
对普通创作者而言,这意味着一个想法不必因为第一次生成效果不理想就被放弃;对独立创作者和小型工作室而言,则意味着有限预算可以支持更多试镜、分镜和版本测试。
这种变化也会进一步传导到产业端。广告团队可以同时测试多个创意和开场,电商商家可以针对不同产品和人群生成更多素材,漫剧、短剧团队可以提前验证人物关系和镜头节奏,影视制作也可以将AI更多用于创意验证和分镜预演。AI降低的并不是创作本身的价值,而是反复尝试的成本。
价格降低并不天然意味着普惠。如果模型生成大量不可用内容,创作者付出的时间和返工成本反而更高。因此,Vidu Q4 Preview在降低价格的同时,将“传神表现力”作为这一代旗舰模型的重点:提升人物表情、情绪与动作的完整性,加强动态运镜、切镜和复杂镜头衔接,并进一步改善爆炸、烟火、粒子等复杂视效与人物、空间和叙事之间的关系。
模型最多支持15张参考图、3段参考音频,并支持2K、4K输出。
从这个角度看,视频模型所谓的“DeepSeek时刻”,并不只是一次价格下降,而是模型能力、系统效率和大众可用性同时向前一步。然而,它是否真正到来,最终仍要由真实项目中的可用率、服务稳定性、持续价格和用户规模来验证。
中国视频模型正在从技术竞赛走向生产竞赛
过去两年,中国视频生成模型快速迭代,行业竞争的坐标也在改变。
早期市场更关注“能不能生成”、分辨率和单条样片效果,随着模型进入真实生产,可控性、一致性、生成速度、总制作成本以及能否进入实际工作流,开始成为更重要的评价标准。Vidu Q4 Preview进一步把模型和工程效率转化为更低的创作成本。
生数科技负责人表示,希望通过提前开放,让模型尽快进入真实创作场景,并通过用户反馈和实际需求持续完善正式版本。
技术普惠最终不应只看生成了多少条视频,而要看有多少创作者因此拥有了更多尝试的机会,有多少小团队获得了过去难以承担的内容生产能力,又有多少行业开始把AI从偶尔展示的工具变成日常生产的一部分。
当模型效率真正转化为更低的试错成本,视频生成才可能从技术能力走向更广泛的创作能力。
(编辑 王浩)