DALL-E 4升级了什么

DALL-E 4是OpenAI最新图像生成模型,相比DALL-E 3主要提升:文字渲染准确率大幅提升(可生成含正确拼写的图像)、理解复杂长prompt能力增强、生成图片分辨率更高、可自然语言对话迭代修改。对于商用图片场景,文字渲染能力的提升意味着可以做海报、Logo、图表等含文字的素材。

第一步:精细提示词五维度

高质量DALL-E 4提示词包含五个维度:

[主体]+[动作/状态]+[环境/场景]+[风格/质感]+[技术参数]

主体

清晰描述对象,越具体越好:

a young female photographer in her 20s, with short brown hair, wearing a denim jacket, holding a vintage film camera

动作/状态

crouching on a busy street, taking a photo of pigeons

环境/场景

on a rainy evening in Tokyo Shibuya, with neon signs reflecting on wet pavement

风格/质感

cinematic photography, Kodak Portra 400 film grain, shallow depth of field, warm color grading

技术参数

–ar 16:9 –q 2 –style raw

第二步:风格标签库

常用风格词分类记忆:

摄影风格

  • cinematic photography, hyperrealistic, photojournalism
  • portrait photography, fashion photography, street photography
  • 35mm film, Kodak Portra, Fujifilm Superia

插画风格

  • digital illustration, vector art
  • watercolor illustration, oil painting
  • Studio Ghibli style, Pixar style, Pixar-style 3D render

艺术风格

  • art deco, art nouveau, brutalism
  • minimalist, geometric, organic
  • cyberpunk, solarpunk, steampunk

组合使用:cinematic photography + film grain + warm tones = 商业摄影风

第三步:长prompt vs 短prompt

短prompt:

a happy dog

长prompt:

a golden retriever puppy playing in a sunny meadow, tongue out, mid-jump catching a frisbee, soft focus on distant wildflowers, golden hour lighting, Canon EOS R5 with 85mm lens, shallow depth of field, hyperrealistic photography style

DALL-E 4对长prompt理解更准,因为细节明确了AI不会自由发挥模糊。商用级别图片几乎都用长prompt。

第四步:多轮编辑迭代

DALL-E 4最强功能是用对话迭代修改图片。在同一对话中:

用户:生成一张咖啡店室内图
AI:[生成]
用户:把背景墙改成砖墙,灯换成工业风吊灯,整体色调暖一点
AI:[重新生成保留构图细节]
用户:在角落加一只黑猫
AI:[生成含黑猫版]

每次修改比从头开始更高效,AI会保留你想保留的元素。

第五步:变体与扩展

对满意图片可生成变体或扩展:

  • 变体——同风格不同构图,适合做系列图
  • 扩展——向外扩展画面(outpaint),用于海报拉长
  • 局部修改——框选区域指定修改内容

第六步:分辨率与导出

DALL-E 4默认输出1792×1024(横版)或1024×1792(竖版)。如需更大分辨率:

  1. 下载原图
  2. 用Real-ESRGAN或Topaz Gigapixel AI无损放大2-4倍
  3. 用于印刷和大屏展示

第七步:商用授权与版权

DALL-E 4生成的图片版权归属:

  • ChatGPT Plus/Team/Enterprise用户——生成的图片归你所有,可商用
  • 免费用户——仍可使用但商用有限制
  • API用户——按OpenAI使用条款

禁止:模拟真实艺术家风格避免侵权、生成含真实人物肖像的图用于商业、生成违规内容。

实战场景

  • 电商品牌——批量生成产品场景图,统一视觉风格
  • 社交媒体——为每篇博文配独立图,避免视觉重复
  • PPT制作——快速生成概念图,10倍速完成PPT
  • 书籍/电子书——自制封面和插图,零设计基础