openai近期在chatgpt内发布了新的生图模型面向所有用户开放,根据博主的卡尔的AI沃茨测评结果显示,目前这个生图模型一定程度上让openai在主战场面对claude,grok,deepseek围追堵截下,可以稍稍缓一口气,综合能力暂时“遥遥领先”。
| 对比领域 | GPT-4o 表现 | 结果/特点 |
| 写实风格 vs FLUX | 在人物特写表现惊艳,光效和氛围感强,但质感略逊于Flux | |
| 风格化 vs MJ | 在“赛博水墨”“敦煌飞天机械姬”等复杂风格融合上表现惊艳,逻辑清晰,元素精准 | |
| 文字处理 vs 即梦 | 生成稳定中文、复杂文字布局(如海报、漫画对白)能力强,文字精准无乱码 | |
| 对话修图 vs Gemini 豆包 | 能根据用户指令逐步修改图片,风格化处理自然,保留原图特征 | |
| 多图融合 | 支持多张图片上传,可进行风格转换、人物融合(如马斯克+奥特曼)、UI设计+场景合成等 | |
| 四格漫画 vs 即梦 | 能根据文字或图片生成逻辑完整的四格漫画,画风统一,叙事清晰 | |
对于暂时无法使用openai的国内用户来说,字节跳动的即梦或者豆包依然是我们的首选,相信用不了多久,生图模型的DeepSeek时刻也即将到来。
立即咨询 JOTO
JOTO 提供覆盖企业智能体规划与搭建、AI 平台私有化部署、RAG 知识工程、AI 安全治理、FDE 驻场共创及持续运营优化的全周期 AI 落地服务,帮助企业把验证中的 AI 能力转化为安全、可控、可持续迭代的生产力。 联系 JOTO 获取 AI 落地咨询