生数科技发布高可控视频大模型Vidu Q1：可精准调整所有动作行为

IT之家

2025-03-29 18:20发布于湖北IT之家官方账号

+关注

IT之家 3 月 29 日消息，清华大学人工智能研究院副院长、生数科技创始人兼首席科学家朱军今日发布了高可控视频大模型 Vidu Q1，官方宣称其为业内首个高可控 AI 视频大模型。

IT之家从官方获悉，Vidu Q1 在多主体细节可控（特别是动作、布局可控）、音效同步可控、画质增强等方面均取得显著成效。以多主体细节可控为例，在语义指令的基础上，通过融入参考图的视觉指令，Vidu Q1 支持对场景中多主体的位置、大小、运动轨迹等属性进行更进一步的可控，对所有动作行为（出场、退场、坐立姿态、行动路线）进行精准调整。

其支持音效同步可控功能，可确保随着视频环境与画面转场，Vidu Q1 能够输出生成相应音效，并可精准控制每段音效的长短区间，精准设置每段音频出现的时间点，如 0-2s 风声、3-5s 雨声等。

个人观点，仅供参考

免责声明：本内容来自腾讯平台创作者，不代表腾讯新闻或腾讯网的观点和立场。