令人兴奋的 Dall-E3 即将到来

经过10个月左右的沉寂,OpenAI 终于即将要发布 Dall-E3,这是其 AI 图像生成器的最新版本。据说 Dall-E3 比 Dall-E2 有明显的改进升级,具有更多细微差别和细节。

Dall-E3 有什么新功能?

  • 更好的图像质量和一致性
  • Dall-E3 可以生成文本
  • Dall-E3 集成在 ChatGPT 中
  • Dall-E3 创建的图像版权归用户

据说目前的版本可供约 400 个用户使用,超越了 OpenAI 的先前模型以及公认的竞争对手,例如 Midjourney 或者 Stable Diffusion XL。

更好的图像质量和一致性

和 Dall-E2 相比,Dall-E3 有更好的图像质量和一致性。

为了更好地说明其差异,来看看下面的示例。两个图像使用相同的提示(提示还是以英文为主)。

Prompt: A paper craft art depicting a girl giving her cat a gentle hug. Both sit amidst potted plants, with the cat purring contentedly while the girl smiles. The scene is adorned with handcrafted paper flowers and leaves.

这个例子展示了 Dall-E3 理解和生成复杂概念的能力。除此之外,注意到右图中的女孩既没有微笑也没有拥抱猫。

Dall-E3 可以生成文本

另一个重要的更新是能够正确、清晰地拼写单词。例如,可以使用 Dall-E3 生成复古的旅行海报:

Prompt: A vintage travel poster for Venus in portrait orientation. The scene portrays the thick, yellowish clouds of Venus with a silhouette of a vintage rocket ship approaching. Mysterious shapes hint at mountains and valleys below the clouds. The bottom text reads, 'Explore Venus: Beauty Behind the Mist'. The color scheme consists of golds, yellows, and soft oranges, evoking a sense of wonder.

这个实例 AI 根据海报风格选择其理解的字体和颜色以匹配海报的整体美感,这一点是其他人工智能工具无法做到的。

集成在 ChatGPT 中

从 2023 年 10 月开始,ChatGPT Plus 订阅者将能够在 ChatGPT 中本地使用 Dall-E3 。这意味着可以使用 ChatGPT 生成或完善 Dall-E3 的提示,只需询问想查看什么即可。

ChatGPT Plus 还允许访问最新的语言模型、GPT-4 和 ChatGPT 插件,有条件的可以开通尝试。

它将于今年秋天晚些时候在 OpenAI Labs 上推出。

图像版权归用户

使用 Dall-E3 创建的图像可供您使用、重印、出售或商品化。

根据内容政策和条款,您拥有使用 DALL·E 创建的图像,包括转载、销售和商品化的权利 - 无论图像是通过免费还是付费信用生成的。

比 MidJourney 好吗?

MidJourney AI 长期以来被认为是最好的 AI 图像生成器。然而,Dall-E3 生成的图像质量是相当的,这两种工具目前处于激烈的竞争之中。

下面来看一个示例,当然这个示例不能代表所有,每个工具对于不同用户的喜好程度是不一样的。

Prompt: A vibrant yellow banana-shaped couch sits in a cozy living room, its curve cradling a pile of colorful cushions. on the wooden floor, a patterned rug adds a touch of eclectic charm, and a potted plant sits in the corner, reaching towards the sunlight filtering through the window. 提示:舒适的客厅里摆放着一张充满活力的黄色香蕉形沙发,其曲线支撑着一堆色彩缤纷的靠垫。木地板上,有图案的地毯增添了一丝不拘一格的魅力,一盆盆栽坐落在角落里,迎向透过窗户的阳光。

从上面的结果来看,其实跟现实中的两个人类似,不同的理解而已,效果都相当惊人。

总结

Dall-E3 目前尚未公开,但其结果的早期效果令人印象深刻。如果事实证明它比 MidJourney 更好,相信很多人愿意取消MidJourney 订阅并在 ChatGPT 上使用 Dall-E3。

译自:medium.com/generative-...

相关推荐
vvandre2 小时前
ChatGPT桌面版深度解析
chatgpt
哪吒编程3 小时前
炸裂!OpenAI GPT-5提前泄露?最强模型诞生
openai
中等生4 小时前
ReAct: 减少 LLM 幻觉,提升准确度
llm·openai·ai编程
Java陈序员4 小时前
轻松处理证件照!又一款 AI 证件照制作工具!
openai·ai编程·aiops
GitLqr6 小时前
AI洞察 | 工具集:京东通用智能体,提示词管家AI Gist,开源的MidJourney
midjourney·agent·ai编程
LinXunFeng15 小时前
AI - Gemini CLI 摆脱终端限制
openai·ai编程·gemini
软件测试君1 天前
【Rag实用分享】小白也能看懂的文档解析和分割教程
aigc·openai·ai编程
一个处女座的程序猿2 天前
LLMs之Agent:ChatGPT Agent发布—统一代理系统将研究与行动无缝对接,开启智能助理新时代
chatgpt·agent
gptplusplus2 天前
停止“玩具式”试探:深入拆解ChatGPT Agent的技术栈与实战避坑指南
chatgpt
WSSWWWSSW2 天前
基于模拟的流程为灵巧机器人定制训练数据
人工智能·chatgpt·机器人