注意!ChatGPT 全新 AI 图像功能延迟对免费用户开放

2025 年 3 月 25 日,OpenAI 正式宣布在 ChatGPT 中推出基于 GPT-4o 模型的全新原生图像生成功能。

这一功能允许用户通过对话生成和编辑图像,支持从写实风格到插图风格的多种形式。OpenAI 首席执行官萨姆・奥特曼(Sam Altman)在社交平台 X 上表示,该技术是公司的一项重大突破,首批图像生成结果令人惊叹。

新功能的亮点包括:

  • 能够精确渲染文本内容,提供高质量的图像效果。
  • 支持多种输入输出方式,涵盖文本、图像和音频等多种形式。
  • 理解复杂指令并结合上下文,创造出具有真实感的第一人称视角图像。

与之前的图像生成模型 DALL・E 不同,GPT-4o 采用了一种自回归模型,原生嵌入在 ChatGPT 中。这意味着,它能够处理多达 10 至 20 个不同物体的复杂指令,而竞争对手通常只能处理 5 至 8 个,展现出更强的能力。

用户只需简洁地描述需求,比如指定纵横比、颜色或透明背景,模型便可以快速生成图像。虽然渲染较复杂的细节可能需要稍等一会儿,但最终的效果是值得的。

改进之后的AI图像功能更容易地创建逼真的图片,生成的模式逻辑也与以往的不同,类似于文本书写,是按照从左到右,从上到下的顺序来生成图像,以往的扩散技术是一次性生成整个图像。

在一次发布会上,演示者展示了多个具体案例。比如,他将一张合影转化为动漫风格的图像,模型不仅成功保留了人物的特征,还完美融合了动漫视觉效果。

此外,演示者要求生成一页关于相对论的幽默漫画,结果生成的漫画不仅结构完整,还生动有趣。

OpenAI 对此功能的安全性也非常重视,所有生成的图像都带有 C2PA 元数据标识,确保内容的来源可追溯,并有效阻止不当请求的生成。

当然,OpenAI 的图像生成工具并非没有缺点,比如在裁剪、上下文理解和非拉丁文本渲染等方面仍存在不足。不过,OpenAI 表示他们会在未来不断优化这些问题。

但由于用户的需求远远超出了公司的预期,ChatGPT原先计划该功能会向所有用户开放,也会随之推迟。目前,OpenAI 只向 ChatGPT Pro、Plus 和 Teams 的订阅用户推出了这一功能。 Sam Altman表示:"ChatGPT 中的图像功能比我们想象的要受欢迎得多(而且我们的预期已经很高了)。"

相关推荐
AI周红伟9 分钟前
周红伟:《OpenClaw安全防控:OpenClaw++Skills智能体安全部署、实操和企业应用实操》
人工智能·阿里云·云计算·腾讯云·openclaw
火山引擎开发者社区16 分钟前
ArkClaw 适配微信,可以在微信上指挥你的龙虾啦
人工智能
小超同学你好42 分钟前
Langgraph 18. Skill 四种形态 —— Inline / File-based / External / Meta(含代码示例)
人工智能·语言模型·langchain
不只会拍照的程序猿43 分钟前
《嵌入式AI筑基笔记02:Python数据类型01,从C的“硬核”到Python的“包容”》
人工智能·笔记·python
uzong44 分钟前
Skill 被广泛应用,到底什么是 Skill,今天详细介绍一下
人工智能·后端·面试
Jokeny1 小时前
OpenClaw本地"养虾"全攻略:数据真·不出电脑,本地大模型+飞书自动化方案
人工智能
reesn1 小时前
copaw梳理
人工智能
算法玩不起1 小时前
以乳腺癌诊断数据为例的医学AI分类建模方法入门
人工智能·分类·数据挖掘
Tadas-Gao1 小时前
Mem0分层记忆系统:大语言模型长期记忆的架构革命与实现范式
人工智能·语言模型·自然语言处理·架构·大模型·llm·transformer
极客小俊1 小时前
Windows 卸载 OpenClaw
人工智能