注意!ChatGPT 全新 AI 图像功能延迟对免费用户开放

2025 年 3 月 25 日,OpenAI 正式宣布在 ChatGPT 中推出基于 GPT-4o 模型的全新原生图像生成功能。

这一功能允许用户通过对话生成和编辑图像,支持从写实风格到插图风格的多种形式。OpenAI 首席执行官萨姆・奥特曼(Sam Altman)在社交平台 X 上表示,该技术是公司的一项重大突破,首批图像生成结果令人惊叹。

新功能的亮点包括:

  • 能够精确渲染文本内容,提供高质量的图像效果。
  • 支持多种输入输出方式,涵盖文本、图像和音频等多种形式。
  • 理解复杂指令并结合上下文,创造出具有真实感的第一人称视角图像。

与之前的图像生成模型 DALL・E 不同,GPT-4o 采用了一种自回归模型,原生嵌入在 ChatGPT 中。这意味着,它能够处理多达 10 至 20 个不同物体的复杂指令,而竞争对手通常只能处理 5 至 8 个,展现出更强的能力。

用户只需简洁地描述需求,比如指定纵横比、颜色或透明背景,模型便可以快速生成图像。虽然渲染较复杂的细节可能需要稍等一会儿,但最终的效果是值得的。

改进之后的AI图像功能更容易地创建逼真的图片,生成的模式逻辑也与以往的不同,类似于文本书写,是按照从左到右,从上到下的顺序来生成图像,以往的扩散技术是一次性生成整个图像。

在一次发布会上,演示者展示了多个具体案例。比如,他将一张合影转化为动漫风格的图像,模型不仅成功保留了人物的特征,还完美融合了动漫视觉效果。

此外,演示者要求生成一页关于相对论的幽默漫画,结果生成的漫画不仅结构完整,还生动有趣。

OpenAI 对此功能的安全性也非常重视,所有生成的图像都带有 C2PA 元数据标识,确保内容的来源可追溯,并有效阻止不当请求的生成。

当然,OpenAI 的图像生成工具并非没有缺点,比如在裁剪、上下文理解和非拉丁文本渲染等方面仍存在不足。不过,OpenAI 表示他们会在未来不断优化这些问题。

但由于用户的需求远远超出了公司的预期,ChatGPT原先计划该功能会向所有用户开放,也会随之推迟。目前,OpenAI 只向 ChatGPT Pro、Plus 和 Teams 的订阅用户推出了这一功能。 Sam Altman表示:"ChatGPT 中的图像功能比我们想象的要受欢迎得多(而且我们的预期已经很高了)。"

相关推荐
嗷嗷哦润橘_9 小时前
AI Agent学习:MetaGPT之我的工作
人工智能·学习·flask
PPIO派欧云9 小时前
PPIO上线阿里Wan 2.6:制作电影级AI视频,对标Sora2
人工智能
火山kim9 小时前
经典论文研读报告:DAGGER (Dataset Aggregation)
人工智能·深度学习·机器学习
Coding茶水间9 小时前
基于深度学习的水果检测系统演示与介绍(YOLOv12/v11/v8/v5模型+Pyqt5界面+训练代码+数据集)
图像处理·人工智能·深度学习·yolo·目标检测·机器学习·计算机视觉
檐下翻书1739 小时前
算法透明度审核:AI 决策的 “黑箱” 如何被打开?
人工智能
undsky_10 小时前
【RuoYi-SpringBoot3-Pro】:接入 AI 对话能力
人工智能·spring boot·后端·ai·ruoyi
网易伏羲10 小时前
网易伏羲受邀出席2025具身智能人形机器人年度盛会,并荣获“偃师·场景应用灵智奖
人工智能·群体智能·具身智能·游戏ai·网易伏羲·网易灵动·网易有灵智能体
搬砖者(视觉算法工程师)10 小时前
什么是无监督学习?理解人工智能中无监督学习的机制、各类算法的类型与应用
人工智能
西格电力科技10 小时前
面向工业用户的绿电直连架构适配技术:高可靠与高弹性的双重设计
大数据·服务器·人工智能·架构·能源
TextIn智能文档云平台10 小时前
图片转文字后怎么输入大模型处理
前端·人工智能·python