Imagen是Google Research开发的人工智能系统,能够根据输入的文本描述创建具有极高真实感的图像。该系统结合了大型预训练语言模型与级联扩散模型,展现出卓越的语言理解能力和图像生成质量。通过引入DrawBench基准测试,Imagen在图像与文本的对齐度及样本质量上表现优异。目前该模型主要用于研究展示,旨在探索文本到图像生成的技术边界。