OpenAI GPT-4o模型推出重大更新:为ChatGPT增加了图像生成和编辑功能

Openai于2025年3月25日正式宣布在GPT-4o模型中集成图像编辑和视觉生成功能,用户可以通过对话式来生成图像、修改现有视觉内容,甚至设计复杂的材料,如图表、菜单和地图等。

OpenAI GPT-4o模型推出重大更新:为ChatGPT增加了图像生成和编辑功能.webp

功能特点:

  • 实时迭代:用户可以实时迭代图像请求,例如要求生成“城市中的蜗牛”,然后通过改变背景或添加配饰来细化场景。

  • 复杂指令处理:该系统能够处理更复杂的图像构图指令。

  • 文本渲染改进:GPT-4o在图像中渲染清晰且结构化的文本方面有了显著提升,使其能够更好地生成信息图表、图表、标志等专业视觉内容。

  • “修复”功能:用户可以对现有图像进行“修复”,编辑前景和背景元素,即使照片中有人物也适用。

性能与速度

虽然GPT-4o处理图像请求的速度比其前身DALL·E 3慢,但生成的图像更准确、更详细。图像生成可能需要长达一分钟的时间。

数据训练

OpenAI表示,GPT-4o的图像能力训练使用了“公开可用的数据”,以及来自合作伙伴(如Shutterstock)的专有内容。

技术改进

  • 多模态生成:GPT-4o的图像生成器与文本生成器集成在同一模型中,能够更好地结合文本和图像。

  • 自回归生成方式:与DALL-E 3等扩散模型不同,GPT-4o采用自回归方式,从左到右、从上到下逐步生成图像,这可能是其文本渲染和对象绑定能力更强的原因。

这个功能更新现在对OpenAI每月200美元的Pro计划订阅用户开放,然后扩展到免费和Plus层级用户,还有就是通过OpenAI API的开发者。

详细情况:https://openai.com/index/introducing-4o-image-generation/

收藏
最新工具
ByRutor
ByRutor

俄罗斯的一个免费游戏资源下载网站,提供超23,000多款游戏,涵...

RandomStreetView
RandomStreetView

一个可以随机展示全球谷歌街景照片的网站,每次点按钮,系统会随机选...

ZType
ZType

官网:zty.pe,一个把打字练习和射击游戏结合的在线工具。玩家...

XiaomiROM
XiaomiROM

一个能下载小米手机、平板等设备官方系统固件的网站,收集了国行、全...

CPS check
CPS check

一人测试用户点击速度(CPS,即每秒点击次数) 的在线网站,可在...

中国庭审公开网
中国庭审公开网

全国法院的庭审直播平台,能看各类案件庭审直播和回放,还能按不同条...

GradientHunt
GradientHunt

一个免费的色彩灵感平台,提供大量手工制作的时尚渐变色,目标是成为...

特工宇宙
特工宇宙

国内首个专注于Agent的科技媒体,由杭州电子科技大学00后毕业...

面灵AI
面灵AI

一款面试辅助工具,能实时分析面试问题并给出专业建议,支持多语言面...

Teleprompter Online
Teleprompter Online

一款免费的在线提词器网页应用,能在PC或Mac的现代网页浏览器上...