原标题:阿里发布千亿参数规模AI模型,可设计30多种物品高清图像
品玩3月2日讯,阿里巴巴今天与清华大学联合发布业界最大的中文多模态预训练AI模型M6。该模型参数规模超千亿,同时具备文本、图像的理解和生成能力,可应用于产品设计、信息检索、机器人对话、文学创作等领域。
以图像生成为例,模型可设计包括服饰、鞋类、家具、首饰、书籍等在内的30多个物品类别的图像,最短一分钟即可完成作品的创作,效率超越普通设计师。M6的突破源自多项底层技术创新。阿里巴巴研究团队基于自研Whale分布式框架,将参数规模扩展到千亿的同时,利用大规模数据并行和模型并行,训练速度提升10倍以上,仅需1-2天即可完成上亿数据的预训练。此外,M6模型首次将多模态预训练模型应用到基于文本的图像生成任务,结合向量量化生成对抗网络学习文本与图像编码共同建模的任务,能够生成清晰度高且细节丰富的图像。