OpenAI GPT-4o模型推出重大更新:为ChatGPT增加了图像生成和编辑功能

Openai于2025年3月25日正式宣布在GPT-4o模型中集成图像编辑和视觉生成功能,用户可以通过对话式来生成图像、修改现有视觉内容,甚至设计复杂的材料,如图表、菜单和地图等。

OpenAI GPT-4o模型推出重大更新:为ChatGPT增加了图像生成和编辑功能.webp

功能特点:

  • 实时迭代:用户可以实时迭代图像请求,例如要求生成“城市中的蜗牛”,然后通过改变背景或添加配饰来细化场景。

  • 复杂指令处理:该系统能够处理更复杂的图像构图指令。

  • 文本渲染改进:GPT-4o在图像中渲染清晰且结构化的文本方面有了显著提升,使其能够更好地生成信息图表、图表、标志等专业视觉内容。

  • “修复”功能:用户可以对现有图像进行“修复”,编辑前景和背景元素,即使照片中有人物也适用。

性能与速度

虽然GPT-4o处理图像请求的速度比其前身DALL·E 3慢,但生成的图像更准确、更详细。图像生成可能需要长达一分钟的时间。

数据训练

OpenAI表示,GPT-4o的图像能力训练使用了“公开可用的数据”,以及来自合作伙伴(如Shutterstock)的专有内容。

技术改进

  • 多模态生成:GPT-4o的图像生成器与文本生成器集成在同一模型中,能够更好地结合文本和图像。

  • 自回归生成方式:与DALL-E 3等扩散模型不同,GPT-4o采用自回归方式,从左到右、从上到下逐步生成图像,这可能是其文本渲染和对象绑定能力更强的原因。

这个功能更新现在对OpenAI每月200美元的Pro计划订阅用户开放,然后扩展到免费和Plus层级用户,还有就是通过OpenAI API的开发者。

详细情况:https://openai.com/index/introducing-4o-image-generation/

收藏
最新工具
ChinaTextbook
ChinaTextbook

一个专门收集和分享中国大陆从小学到大学的教材资源的开源项目,特别...

暗壳AI
暗壳AI

家居AIGC营销与导购工具,它号称“一人即团队”,能够快速生成渲...

UntitledPen
UntitledPen

一个可以生成真实人声旁白的工具,也就是能够在一个平台上编写、编辑...

PageAI
PageAI

一款AI网站生成工具,就像一个小型创意工作室一样,能在短时间内根...

Seedance AI
Seedance AI

字节跳动推出的一款强大的视频生成工具,借助 Seedance 1...

ChatPs
ChatPs

ChatPs 是一款为 Photoshop 设计的插件,它背后是...

趣丸千音
趣丸千音

一个AI语音创作平台,专注提供一站式智能语音解决方案。集成文本转...

太极神器 TAICHI-flet
太极神器 TAICHI-flet

基于flet的一款多功能娱乐软件,实现了浏览图片、音乐、小说、各...

YIKM
YIKM

一个能在线玩小霸王、红白机、街机、FC 等经典游戏的地方,像《魂...

Bridgely
Bridgely

基于AI的实时通用翻译浏览器扩展,支持 60 多种语言,包括 W...