分享
DALL-E 3
输入“/”快速插入内容
DALL-E 3
用户529
用户529
2024年1月21日修改
DALL-E 介绍
DALL-E是一个可以通过文本描述中生成图像的人工智能程序。于2021年1月5日由OpenAI发表。
DALL-E 是 GPT-3 的 120 亿参数版本,经过训练,可以使用文本-图像对的数据集从文本描述生成图像。它具有多种功能,包括创建动物和物体的拟人化版本、以合理的方式组合不相关的概念、渲染文本以及对现有图像应用转换。
它的名字是2008年动画电影WALL-E(瓦力)和20世纪西班牙加泰罗尼亚画家萨尔瓦多·达利(Salvador Dalí)的合成词。
2022年4月,OpenAI宣布了新版本的DALL-E 2,它可以生成更逼真、更准确的图像,分辨率提高 4 倍。OpenAI称DALL-E 2是一个“可以从文本描述中生成原创、逼真的图像和艺术”的模型。
DALL-E 3 介绍
DALL-E 3于2023年9月面世,它利用 ChatGPT 通过自动扩展提示的方式,帮助创作更复杂、精心构思的艺术作品,为生成器提供更详细、连贯的指导。DALL-E 3的新功能在于简化了所需的文本细化过程,即所谓的“提示工程”,并且通过ChatGPT的对话界面允许用户进行细化。
DALL-E 3在根据复杂提示创建图像方面比DALL-E 2要好得多。例如,DALL-E 3可以准确地表示具有特定对象和它们之间关系的场景。在生成图像中的文本以及手部等人体细节方面,DALL-E 3相比DALL-E 2有显著的改进。DALL-E 3默认情况下可以创建引人入胜的图像,无需任何技巧或提示工程。
DALL-E 3 的升级
现代文本到图像系统倾向于忽略文字或描述,迫使用户学习提示工程。 DALL-E 3 代表了Open AI生成完全符合您提供的文本的图像的能力的飞跃。
即使具有相同的提示,DALL-E 3 也比 DALL-E 2 有了显著的改进。
DALL·E 2
“An expressive oil painting of a basketball player dunking, depicted as an explosion of a nebula.”
50%
DALL·E 3
“An expressive oil painting of a basketball player dunking, depicted as an explosion of a nebula.”
50%
DALL-E 3 与 ChatGPT
DALL-E 3 原生构建于 ChatGPT 之上,让您可以使用 ChatGPT 作为集思广益的合作伙伴并完善您的提示。只需询问 ChatGPT 您想看到什么,从简单的句子到详细的段落。
当提出想法时,ChatGPT 将自动为 DALL-E 3 生成定制的详细提示,将您的想法变为现实。如果你喜欢某个特定的图像,但它不太正确,你可以要求 ChatGPT 只需几句话就可以进行调整。
DALL·E 3 于 2023年10月初向 ChatGPT Plus 和 Enterprise 客户提供。与 DALL·E 2 一样,您使用 DALL·E 3 创建的图像可供您使用,无需 Open AI 的许可即可重印、出售或销售它们。