AI画画模型Composer惊艳亮相!图像拆分再灵活重组,创造力飞升

发布时间:2024-09-25 13:33:20 浏览量:148次

AI画画通用模型,新增一员大将!

阿里达摩院副院长周靖人等人打造的可控扩散模型Composer,一经发布就引起了轩然大波。

这个模型由50亿参数训练而来,与Stable Diffusion原理有所不同。

它更进一步把训练图像拆解成了多个元素,然后基于这些元素训练扩散模型,让它们能够灵活组合。

模型的创造能力因此大幅提升,创作的可能性倍增。

网友们看了纷纷表示,AI画画发展速度也太快了!

团队表示,模型的训练和推理代码都在路上了。

有限手段的无限使用

该框架的核心思想是组合性(compositionality),模型名字就叫做Composer。

观察到现下很多AI画画模型,在细节的可控性上还有待提高,Composer的出现填补了这一空白。

研究团队认为,想要实现图像的可控生成,重点应该放在组合性上,这种方式可以将图像的创造力提升到指数级。

具体来看,该模型将每个训练图像拆解成一系列基础元素,如蒙版图、草稿图、文字描述等,用它们来训练一个扩散模型。

然后让这些被拆分的元素,在推理阶段灵活组合,生成大量新的图像输出。

它可以支持多种形式作为输入。比如文字描述作为全局信息,深度图和草图作为局部引导,颜色直方图为低级细节等。

在保证生成图像可控的基础上,作为一个通用框架,该模型还能不用再训练就可以完成大量经典生成任务。

团队表示,现有成果还在继续优化,以应对AI画画模型面临的挑战和风险。

达摩院副院长带队

该研究由火星时代教育及蚂蚁团队完成,成果斐然。

通讯作者为周靖人。

他现任火星时代教育副院长、智能计算CTO,是IEEE Fellow。

了解更多数字艺术教育培训课程,请点击咨询

热门课程推荐

热门资讯

请绑定手机号

x

同学您好!

您已成功报名0元试学活动,老师会在第一时间与您取得联系,请保持电话畅通!
确定