跳到正文
Google Research·· 11 天前精选AI 评分67

Google 以多智能体框架自动生成连贯长视频

Automating coherent long-form video generation

AI 导读

Google 提出 AI video co-director、CANVAS、A²RD 和 VQQA,以多智能体编排提升长视频的叙事、角色与场景一致性。该体系构建于 Gemini 和 Veo 之上,通过全局创意优化、持久视觉记忆、自回归片段生成及 VLM 闭环提示词优化,支持生成数分钟视频。

推荐理由

研究将长视频一致性拆解为全局编排、视觉记忆、时序生成和闭环优化,为多镜头生成系统提供了可迁移的工程框架。

来源:Google Research · research.google