ANTI-AI ARCHIVE
艺术史节点 / 083 · 2022-05

Imagen:深层语言理解与逼真图像生成

Photorealistic Text-to-Image Diffusion Models with Deep Language Understanding

Chitwan Saharia et al. / Google Research

历史背景与研究说明

Imagen 使用大型文本编码器和 diffusion decoder,研究显示扩大 language model 对 image-text alignment 的收益尤其明显。它强化了一个后来被 GPT-native image generation 继续推进的方向:更强语言理解会改变视觉生成能力。

日期与版本记录

节点标注日期:2022-05 · 研究母版原记日期:2022-05

以上日期属于历史事件或资料所记版本,不是本站页面的上线日期;保留原有日期精度与待核事项。

原始资料与进一步阅读

以下链接通往来源的论文、文章、机构或会议页面。外部原文的语言以来源为准。

01
Imagen:深层语言理解与逼真图像生成 ↗

Photorealistic Text-to-Image Diffusion Models with Deep Language Understanding

https://arxiv.org/abs/2205.11487

当前引用地址

02
Imagen:深层语言理解与逼真图像生成 ↗

Imagen

https://imagen.research.google/

母版或补充资料所引地址,可能已迁移或失效

出处、翻译与核验状态

档案节点 #083 · 历史节点

研究母版与补充出处 · 3

AI 艺术谱系研究母版 · p. 25 · 083
原记日期: 2022-05
Imagen:深层语言理解与逼真图像生成 ↗
Photorealistic Text-to-Image Diffusion Models with Deep Language Understanding

生成式视觉发布编年研究母版 · p. 5 · R020
原记日期: 2022-05
Imagen:深层语言理解与逼真图像生成 ↗
Google Imagen

生成式视觉发布编年研究母版 · p. 6 · R021
原记日期: 2022-05
Imagen:深层语言理解与逼真图像生成 ↗
Imagen

站内说明据母版译编,非外链全文译本;AI 辅助翻译,待人工审校。

母版研究论述与日期尚待独立核验。

引用本节点

ANTI-AI ARCHIVE. Imagen:深层语言理解与逼真图像生成. 艺术史节点 #083. https://salondesrefuses.cn/zh/art-history/083

引用具体史实时,请同时引用上方原始资料,并补充你的访问日期。本站说明不是外链全文译本。

相邻节点按时间顺序排列,不意味着二者存在直接影响或因果关系。