首页 > 快讯 > OpenAI推出全新图像生成模型，挑战Google一句话P图

OpenAI推出全新图像生成模型，挑战Google一句话P图

发布时间：2025-03-26 10:36:25 | 责任编辑：字母汇 | 浏览量：265 次

在科技界的最新动态中，OpenAI 刚刚宣布，他们在最新的 GPT-4o 模型中集成了迄今为止最先进的图像生成器。OpenAI 的首席执行官萨姆・奥特曼（Sam Altman）在社交媒体平台 X 上兴奋地分享了他第一次看到模型生成的图像时的震惊，认为这简直难以置信，并期待用户们充分发挥他们的创造力。
新功能的亮点包括:
- 能够精确渲染文本内容，提供高质量的图像效果。
- 支持多种输入输出方式，涵盖文本、图像和音频等多种形式。
- 理解复杂指令并结合上下文，创造出具有真实感的第一人称视角图像。
与之前的图像生成模型 DALL・E 不同，GPT-4o 采用了一种自回归模型，原生嵌入在 ChatGPT 中。这意味着，它能够处理多达10至20个不同物体的复杂指令，而竞争对手通常只能处理5至8个，展现出更强的能力。
用户只需简洁地描述需求，比如指定纵横比、颜色或透明背景，模型便可以快速生成图像。虽然渲染较复杂的细节可能需要稍等一会儿，但最终的效果是值得的。
在一次发布会上，演示者展示了多个具体案例。比如，他将一张合影转化为动漫风格的图像，模型不仅成功保留了人物的特征，还完美融合了动漫视觉效果。此外，演示者要求生成一页关于相对论的幽默漫画，结果生成的漫画不仅结构完整，还生动有趣。
OpenAI 对此功能的安全性也非常重视，所有生成的图像都带有 C2PA 元数据标识，确保内容的来源可追溯，并有效阻止不当请求的生成。
当然，OpenAI 的图像生成工具并非没有缺点，比如在裁剪、上下文理解和非拉丁文本渲染等方面仍存在不足。不过，OpenAI 表示他们会在未来不断优化这些问题。
与此同时，Google 也在同一时间发布了自家的强大 AI 模型 Gemini2.5Pro Experimental，展现出在推理和编程能力上的显著提升。这一系列的动态显示出，AI 领域的竞争愈发激烈，各大科技巨头都在不断推出更先进的技术，力争在这场 “AI 争霸战” 中占据领先地位。

©️版权声明：
本网站(https://aigc.izzi.cn)刊载的所有内容，包括文字、图片、音频、视频等均在网上搜集。
访问者可将本网站提供的内容或服务用于个人学习、研究或欣赏，以及其他非商业性或非盈利性用途，但同时应遵守著作权法及其他相关法律的规定，不得侵犯本网站及相关权利人的合法权利。除此以外，将本网站任何内容或服务用于其他用途时，须征得本网站及相关权利人的书面许可，并支付报酬。
本网站内容原作者如不愿意在本网站刊登内容，请及时通知本站，予以删除。

上一篇： OpenAI承认API故障!对话补全错误率高，紧急修复中

下一篇：谷歌发布全新推理 AI 模型 Gemini 2.5和Gemini 2.5 Pro实验版

OpenAI推出全新图像生成模型，挑战Google一句话P图

最新Ai信息

最新Ai工具

热门AI推荐