OpenAI GPT-4o模型推出重大更新:为ChatGPT增加了图像生成和编辑功能

Openai于2025年3月25日正式宣布在GPT-4o模型中集成图像编辑和视觉生成功能,用户可以通过对话式来生成图像、修改现有视觉内容,甚至设计复杂的材料,如图表、菜单和地图等。

OpenAI GPT-4o模型推出重大更新:为ChatGPT增加了图像生成和编辑功能.webp

功能特点:

  • 实时迭代:用户可以实时迭代图像请求,例如要求生成“城市中的蜗牛”,然后通过改变背景或添加配饰来细化场景。

  • 复杂指令处理:该系统能够处理更复杂的图像构图指令。

  • 文本渲染改进:GPT-4o在图像中渲染清晰且结构化的文本方面有了显著提升,使其能够更好地生成信息图表、图表、标志等专业视觉内容。

  • “修复”功能:用户可以对现有图像进行“修复”,编辑前景和背景元素,即使照片中有人物也适用。

性能与速度

虽然GPT-4o处理图像请求的速度比其前身DALL·E 3慢,但生成的图像更准确、更详细。图像生成可能需要长达一分钟的时间。

数据训练

OpenAI表示,GPT-4o的图像能力训练使用了“公开可用的数据”,以及来自合作伙伴(如Shutterstock)的专有内容。

技术改进

  • 多模态生成:GPT-4o的图像生成器与文本生成器集成在同一模型中,能够更好地结合文本和图像。

  • 自回归生成方式:与DALL-E 3等扩散模型不同,GPT-4o采用自回归方式,从左到右、从上到下逐步生成图像,这可能是其文本渲染和对象绑定能力更强的原因。

这个功能更新现在对OpenAI每月200美元的Pro计划订阅用户开放,然后扩展到免费和Plus层级用户,还有就是通过OpenAI API的开发者。

详细情况:https://openai.com/index/introducing-4o-image-generation/

收藏
最新工具
Ztalk ai
Ztalk ai

一个AI驱动的会议实时语音翻译平台,可以与 Zoom、Googl...

Supercut
Supercut

一款屏幕录制工具,能帮你快速录下屏幕上的内容,录制的视频可以自动...

DreamShootAI
DreamShootAI

一个能帮你用照片生成各种风格图片的AI情侣照片生成工具,比如情侣...

讯飞星辰MaaS
讯飞星辰MaaS

科大讯飞开发的一款一站式AIGC内容运营平台,主要面向开发者,提...

星辰Agent开发平台
星辰Agent开发平台

讯飞星火新一代智能体Agent开发平台,助力开发者快速搭建生产级...

Drimo智能影视创作平台
Drimo智能影视创作平台

一款由追梦极客推出的面向影视、广告从业者以及AI视频创作者设计的...

码上飞
码上飞

一个需求秒变软件的全流程自动化智能开发平台,码上飞是L4级无人软...

Simular AI
Simular AI

一款专为Mac用户设计的本地AI智能助手,它能通过自然语言处理执...

FotoForensics
FotoForensics

一个由Hacker Factor提供的在线图像篡改检测工具,主要...

PixPin
PixPin

一款功能强大、完全免费的截图、贴图工具,具备高效截图、图片标注、...