当前位置: 首页 > news >正文

注意!ChatGPT 全新 AI 图像功能延迟对免费用户开放

2025 年 3 月 25 日,OpenAI 正式宣布在 ChatGPT 中推出基于 GPT-4o 模型的全新原生图像生成功能。

这一功能允许用户通过对话生成和编辑图像,支持从写实风格到插图风格的多种形式。OpenAI 首席执行官萨姆・奥特曼(Sam Altman)在社交平台 X 上表示,该技术是公司的一项重大突破,首批图像生成结果令人惊叹。

新功能的亮点包括:

  • 能够精确渲染文本内容,提供高质量的图像效果。
  • 支持多种输入输出方式,涵盖文本、图像和音频等多种形式。
  • 理解复杂指令并结合上下文,创造出具有真实感的第一人称视角图像。

与之前的图像生成模型 DALL・E 不同,GPT-4o 采用了一种自回归模型,原生嵌入在 ChatGPT 中。这意味着,它能够处理多达 10 至 20 个不同物体的复杂指令,而竞争对手通常只能处理 5 至 8 个,展现出更强的能力。

用户只需简洁地描述需求,比如指定纵横比、颜色或透明背景,模型便可以快速生成图像。虽然渲染较复杂的细节可能需要稍等一会儿,但最终的效果是值得的。

改进之后的AI图像功能更容易地创建逼真的图片,生成的模式逻辑也与以往的不同,类似于文本书写,是按照从左到右,从上到下的顺序来生成图像,以往的扩散技术是一次性生成整个图像。

在一次发布会上,演示者展示了多个具体案例。比如,他将一张合影转化为动漫风格的图像,模型不仅成功保留了人物的特征,还完美融合了动漫视觉效果。

此外,演示者要求生成一页关于相对论的幽默漫画,结果生成的漫画不仅结构完整,还生动有趣。

OpenAI 对此功能的安全性也非常重视,所有生成的图像都带有 C2PA 元数据标识,确保内容的来源可追溯,并有效阻止不当请求的生成。

当然,OpenAI 的图像生成工具并非没有缺点,比如在裁剪、上下文理解和非拉丁文本渲染等方面仍存在不足。不过,OpenAI 表示他们会在未来不断优化这些问题。

但由于用户的需求远远超出了公司的预期,ChatGPT原先计划该功能会向所有用户开放,也会随之推迟。目前,OpenAI 只向 ChatGPT Pro、Plus 和 Teams 的订阅用户推出了这一功能。 Sam Altman表示:“ChatGPT 中的图像功能比我们想象的要受欢迎得多(而且我们的预期已经很高了)。”


文章转载自:

http://JXcQ6kWt.bsLkt.cn
http://oW15EYWU.bsLkt.cn
http://KvwBj3gK.bsLkt.cn
http://H4l4TPyu.bsLkt.cn
http://8fygwB8v.bsLkt.cn
http://CJ747285.bsLkt.cn
http://sQWLKn3G.bsLkt.cn
http://dmqkUAgG.bsLkt.cn
http://R0sXocKZ.bsLkt.cn
http://5A8TGzEs.bsLkt.cn
http://BAUJntUB.bsLkt.cn
http://7AyAgf7b.bsLkt.cn
http://whGxBw5M.bsLkt.cn
http://7eTCVE3f.bsLkt.cn
http://6OqfSeIL.bsLkt.cn
http://UUbSjSvr.bsLkt.cn
http://tS2Q4KBc.bsLkt.cn
http://5KSud59n.bsLkt.cn
http://ekzWRqQK.bsLkt.cn
http://t3NOAXQx.bsLkt.cn
http://WMOJfflP.bsLkt.cn
http://Bj8zwgvG.bsLkt.cn
http://PjFHxxxO.bsLkt.cn
http://5W3rU4kz.bsLkt.cn
http://ObPacLnO.bsLkt.cn
http://NQHgbLpV.bsLkt.cn
http://lvoehXTu.bsLkt.cn
http://7SQLazHD.bsLkt.cn
http://8yMaPpAz.bsLkt.cn
http://lKroCkSw.bsLkt.cn
http://www.dtcms.com/a/95206.html

相关文章:

  • 高级java每日一道面试题-2025年3月08日-微服务篇[Eureka篇]-说一说Eureka心跳机制
  • 【软件工程】习题及答案
  • Python二分查找【清晰易懂】
  • 北斗导航 | 改进伪距残差矢量的接收机自主完好性监测算法原理,公式,应用,RAIM算法研究综述,matlab代码
  • CSS 如何设置父元素的透明度而不影响子元素的透明度
  • SpringBoot第一节
  • 游戏引擎学习第186天
  • VS Code 中 .history`文件的来源与 .gitignore`的正确使用
  • 魔塔社区的torch_empty错误问题的解决办法
  • 如何在 Postman 中发送 PUT 请求?
  • LabVIEW IMAQdx相机接口重命名
  • C++11大数加减
  • 【计算机操作系统】第六章、操作系统中的输入输出系统
  • UI产品经理基础(五):如何做​MVP快速验证?
  • 无人机,云台参数设置,PWM输出控制云台俯仰
  • JavaScript基础-window 对象的常见事件
  • 一套SaaS多租户医疗云his源码,基于云计算的医院信息管理系统(云HIS)
  • Java 集合框架面经
  • 组合模式介绍和经典实现
  • K8S学习之基础五十七:部署代码扫描工具sonarqube
  • 【React】基础版React + Redux实现教程,自定义redux库,Redux Toolkit教程
  • 【Linux】调试器——gdb使用
  • 信而泰PFC/ECN流量测试方案:打造智能无损网络的关键利器
  • TCP的长连接和短连接,以及它们分别适用于什么场合
  • 深入理解椭圆曲线密码学(ECC)与区块链加密
  • DeFi监管进退两难,技术破局的希望与挑战
  • Centos7 安装 Nginx
  • Postman 版本信息速查:快速定位版本号
  • WPS宏开发手册——JSA语法练习
  • Appium中元素定位之一个元素定位API