上周五晚上,我女朋友做了顿红烧肉,拍照发朋友圈。我随手用 GPT-Image 2 搞了个操作——把照片里每样食材都标了手绘风注解,还画了箭头指向"精选五花肉"、“冰糖少许”、“八角两粒”。

然后她的朋友圈炸了。评论区清一色"这图怎么做的?"“求教程!”“太有食欲了!”

说实话,我当时也没想到效果这么好。今天就把这个玩法拆开来讲。

这不是滤镜,是"会说话"的美食图

很多人拍美食就是调个滤镜、加个暖色调。但 GPT-Image 2 的"手绘美食标注"玩法完全不是一个路子——它是在照片上叠加一层手绘风格的标注系统

想象一下:你上传一张刚做好的番茄牛腩照片,AI 不只会识别出番茄和牛腩,还能给你画上:

  • 白色细线条勾勒食材轮廓
  • 箭头指向关键部位
  • 手写风格字体标注食材名称、分量、甚至口感点评
  • 整体是日系可爱的插画风格

这不是滤镜能搞定的。这是 AI 理解了你的照片内容之后,在视觉上"翻译"了一遍。

怎么操作?一条指令的事

说实话,我也没搞什么复杂的 prompt 工程。指令就一句话:

“观察这张照片中的所有食材和元素,为每个物体加上手绘风注解。白色细手绘线条,一笔画风格,箭头引导,手写风格字体,偏日系可爱,带情绪标注,比如’好吃到哭’之类。”

然后上传你的美食照片,等大概45秒,一张带手绘标注的美食图就出来了。

有手就行的三个玩法

我用了一个周末试了一堆场景,分享三个我觉得最炸的:

玩法一:自制菜谱封面

上面说了红烧肉那个例子。但最好的效果其实是做菜谱封面

我拍了张自己做的小龙虾照片,让 AI 标注:

  • 龙虾头部 → “虾黄满满”
  • 虾尾 → “去虾线更干净”
  • 配菜 → “土豆条先炸后煮”

做出来直接可以当小红书封面图。我发到做饭群里,三个哥们问我要原图说也要做。

玩法二:探店点评配图

这个更骚。上周去一家新开的日料店,拍了一张三文鱼刺身的照片。让 GPT-Image 2 标注:

  • “挪威进口三文鱼,肥瘦比例完美”
  • “现磨山葵,不辣但香”
  • “薄切2mm,入口即化”

标注完的照片往大众点评一放,阅读量比我之前干写的10条评论还高。店家甚至在评论区问我想不想当他们的美食体验官。

玩法三:烘焙教程的步骤图

这个是给我姐用的。她做烘焙发小红书,之前都是纯文字说明步骤。我让她拍一张铺满食材的桌面,用 GPT-Image 2 标注:

  • “高筋面粉 250g”
  • “黄油 50g 室温软化”
  • “盐 3g 海盐最佳”
  • “酵母 5g 温水激活”

她说那条笔记的互动量翻了3倍,评论区全在问"这是什么App"。

为什么这个玩法很值得学

我不吹不黑,GPT-Image 2 的这批隐藏玩法,最有价值的其实是这个"照片+手绘标注"的方向

理由有三:

第一,门槛极低。你不需要会画画、不需要会PS、甚至不需要写复杂 prompt。一张照片 + 一句话 = 一张独特的手绘美食图。

第二,社交传播力强。现在社交媒体上美食图太多了,你发一张带手绘标注的,视觉上直接跟其他人拉开差距。这种差异化就是流量。

第三,实用场景多。菜谱、探店、烘焙、备菜展示、食材介绍……几乎每个跟吃有关的场景都能用。

说几个实操技巧

踩了两天坑,总结几个能让效果更好的点:

照片要清晰。这个废话,但确实重要。照片够清楚,AI 才能准确识别食材。拍糊的那种,标注会跑到奇怪的地方去。

背景简约最佳。干净的白色桌布、木质案板都行。背景太杂的话,箭头和标注文字会跟背景混在一起。

不要贪多。一张图上标注 3-5 个关键元素就好。标太多反而拥挤,像 PPT 贴满了标签。

语气要有温度。我在 prompt 里加了"带情绪标注"之后,效果好了一个档次。AI 会自己判断这个食材应该配什么情绪词——比如红烧肉配"馋哭了"、沙拉配"轻食必备"、蛋糕配"甜度刚好"。

跟其他 AI 绘图工具对比

我也试了 Midjourney 和 Stable Diffusion 做类似的事情。

坦白讲,在"理解照片内容并添加标注"这件事上,GPT-Image 2 是碾压级别的

Midjourney 可以做手绘风格,但它不能"理解"你的照片里有什么食材——它只是用自己的风格重新生成一张图,标注的位置和内容完全不可控。

Stable Diffusion 配合 ControlNet 理论上可实现,但配置复杂、出图不稳定、而且你需要本地有 GPU。

GPT-Image 2 的优势在于:它真的看懂了你的照片。它知道哪块是肉、哪块是蔬菜、锅里的东西是什么。这是多模态理解能力带来的质变。

写在最后

说实话,这次体验让我对 AI 绘图的价值有了新的认识。

以前我觉得 AI 绘图就是"画壁纸、做设计素材、生成奇幻场景"——更多的是从0到1的创造。但这个玩法给我的感觉不一样,它是在真实世界的基础上做增强

你拍了真实的生活照片,AI 在你的画面上叠加了一层创造性信息。这是一种"先记录,再创造"的模式,我觉得比纯粹生成图像更实用、更有温度。

如果你也想试试,手边正好有一张美食照片的话,打开 GPT-Image 2,把上面那条指令贴进去就行。

效果好不好,朋友圈见分晓。

下期预告:GPT-Image 2 隐藏玩法 #23——手相趣味解读,上传手掌照片让 AI 帮你算命,包好玩的。

Logo

AtomGit 是由开放原子开源基金会联合 CSDN 等生态伙伴共同推出的新一代开源与人工智能协作平台。平台坚持“开放、中立、公益”的理念,把代码托管、模型共享、数据集托管、智能体开发体验和算力服务整合在一起,为开发者提供从开发、训练到部署的一站式体验。

更多推荐