Google Research推出一套名为AI视频联合导演的智能体框架,目标是处理长视频生成中的身份漂移和级联错误问题。
这套系统包含Co-Director、CANVAS、A²RD和VQQA四个框架,可把短片段拼接成数分钟长的连贯故事视频,同时支持语音和配乐。
测试结果
据MarkTechPost介绍,Co-Director框架在GenAD-Bench基准测试中获得平均81.4分,人类评分为3.96分,满分为5分。
CANVAS在背景连续性、角色一致性和道具一致性上分别提升21.6%、9.6%和7.6%。A²RD框架在1到10分钟视频上的一致性提升最高达30%,叙事连贯性提升20%。
底层模型
该系统构建于Gemini和Veo模型之上,但设计为模型无关,也可驱动其他生成器。其输出继承了基础模型的SynthID水印技术。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

