谷歌发布根据互联网视频训练的基础世界模型Genie,该模型参数规模为11B,可以从合成图像、照片甚至草图生成无数种动作可控的交互式环境。Genie可以用它以前从未见过的图像提示,论文地址:https://arxiv.org/abs/2402.15391
谷歌发11B基础世界模型 生成交互虚拟世界
上一篇:南京大学开设AI通识核心课程体系
下一篇:Pika推出“对口型”功能
谷歌发布根据互联网视频训练的基础世界模型Genie,该模型参数规模为11B,可以从合成图像、照片甚至草图生成无数种动作可控的交互式环境。Genie可以用它以前从未见过的图像提示,论文地址:https://arxiv.org/abs/2402.15391
上一篇:南京大学开设AI通识核心课程体系
下一篇:Pika推出“对口型”功能