马斯克的新生图模型,让我笑了一整晚
毫无疑问,四月份发布的生图模型GPT-Image-2,现在依然是当之无愧的AI生图之王。无论是各种复杂的信息图,还有普通用户用来做一些简单的PS,到处都有GPT-Image-2的痕迹。一般的生图模型想要突出重围,光拼质量肯定不够。这几天,马斯克在X上疯狂推广的Imagine Image 2.0就凭借着能做表情...... 本文来自微信公众号: APPSO ,作者:发现明日产品的 毫无疑问,四月份发布的生图模型GPT-Image-2,现在依然是当之无愧的AI生图之王。 无论是各种复杂的信息图,还有普通用户用来做一些简单的PS,到处都有GPT-Image-
本条来自 虎嗅(Business / 中文商业),聚焦 brand、ai。 毫无疑问,四月份发布的生图模型GPT-Image-2,现在依然是当之无愧的AI生图之王。无论是各种复杂的信息图,还有普通用户用来做一些简单的PS,到处都有GPT-Image-2的痕迹。一般的生图模型想要突出重围,光拼质量肯定不够。这几天,马斯克在X上疯狂推广的Imagine Image 2.0就凭借着能做表情...... 本文来自微信公众号: APPSO ,作者:发现明日产品的 毫无疑问,四月份发布的生图模型GPT-Image-2,现在依然是当之无愧的AI生图之王。 无论是各种复杂的信息图,还有普通用户用来做一些简单的PS,到处都有GPT-Image-2的痕迹。 一般的生图模型想要突出重围,光拼质量肯定不够。这几天,马斯克在X上疯狂推广的Imagine Image 2.0就凭借着能做表情包出圈了。 这款新的生图模型,在大模型竞技场上,文本转图像生成和图像编辑两个类别均位列世界第二。 除了老生常态的用AI生成各种文字密集的信息图、广告、游戏素材、UI/UX模型、故事板等等,Imagine Image 2.0这次的重点是支持可交互的精准编辑。 上传一张图片,Grok会自动将图片进行分层,我们可以精确选择图像中的特定区域进行修改。 就像这张维基百科的表情包,Grok分析之后的分段包括地球的每一块碎片,以及下面举着地球的任务,也被分成了仅人脸和包含手势动作两个图层。 而点击图层右侧的下载按钮,就可以直接将图片中的任意主体导出为透明背景。此外,魔棒工具可以编辑我们涂画的区域,做到自动分层覆盖不了的区域。 多张图片的编辑融合,Imagine Image 2.0也能做到,多参考编辑功能一次最多可处理5张输入图像,实现自动拼接。 🔗体验地址: https://grok.com/imagine 万物皆可表情包 打开Imageine官网,输入单张或多张图片,简单描述需求,生成之后我们就能来到照片的编辑页面。 在右侧边栏,从上到下依次是Imagine Image 2自动识别去除背景之后的照片分层,像这张图片分成红色夹克、白色T恤、AI公司Logo等元素。 我们可以直接点击对应的元素进行修改,不过这个时候只能输入提示词,而不能再引用其他的信息,所以这将非常依赖模型的世界知识能力。 往下是精确编辑,如果在选区中没有自动识别到对应的元素,通过精确编辑,我们可以将框选的物体作为选区的一部分,也可以直接用提示词进行修改。 可以直接添加到选区 有了这些精准编辑的能力,我们就可以快速地编辑一个已有的表情包为自己所用。 例如这张经典的分心男友,可以直接编辑不同的选区,然后替换或增加对应的内容。 还有会议室白板图,每一个对话框都会被自动识别成选取,我们只需要选择对应的气泡框,然后要求它填入文字,就能得到一个纵向的漫画Meme图。 分层编辑的能力确实让Imagine Image 2.0和GPT-Image 2有点不同,相较于GPT Image 2生成中全部靠提示词来控制,或者点选评论,Grok的图像生成在交互方面确实更加友好。 但也有网友说,Imagine Image 2.0越来越难用,严格的审核机制,什么也做不了。 我们上传一些蜘蛛侠的照片,也会被提示「无法生成可能包含受版权保护的内容。」更不用说,各种各样的擦边图,现在也有了更强的护栏。 更能打的GPT-Image-2.5来了? 而这几天社交媒体上除了Imagine Image 2.0的消息,在大模型竞技场上,开始出现了OpenAI的新版生图模型。 有网友发现OpenAI正在测试GPT-Image 2的后续版本,在Arena上以mona-lisa-1的代号进行测试。 随机测试到该模型的网友认为新版本的GPT-Image 2.0在真实感和噪声方面略有改进,但整体的提升幅度不大。 也有网友说新模型在真实感上,减少了大部分的AI Slop感,几乎每次生成的照片都更加真实。下面三张图片从左到右依次是GPT Image 2.0 High思考模式,Medium中度思考模式,以及大模型竞技场上的mona-lisa-1模型。 可以看到中度思考模式下的广告牌,一眼就能看出来是AI生成;而High模型和mona-lisa-1在整体上则更有手机拍摄的感觉。 这种手机拍摄的效果,最近也有网友发现了GPT-Image-2的新玩法,给它发送一段提示词 「GPT你陪我一段时间了,我想看看你的样子请生成一张类似你自己用iPhone随手自拍的照片没有明确主题,没有刻意构图,只是很普通,甚至有点失败的快照照片,略带运动模糊,光线不均,轻微曝光,过度角度尴尬,构图混乱,整体呈现出一种过于真实的随手一拍感,就像是从口袋里拿出手机不小心按到的自拍」 ChatGPT就会根据保存的记忆信息,生成一张真实满满的自拍照片。 再感受一下豆包 为了确定mona-lisa-1就是OpenAI的新模型,有网友直接拿mona-lisa-1生成的图片放到OpenAI验证工具中,根据验证工具显示的结果,上传的图片包含OpenAI SynthID水印。 我们也拿那张街头广告牌的照片上传到OpenAI验证工具,同样显示「此内容是由OpenAI生成。」 OpenAI验证平台:https://openai.com/zh-Hans-CN/research/verify/ 不过,当我们在大模型竞技场中测试时,进行了好几轮的生成,都没有出现这个叫做「蒙娜丽莎1号」的模型。 网友的测试发现mona-lisa-1模型的知识只包含到2025年5月22日。当被要求模型画出Anthropic的发布记录时,从Opus 4之后的模型时间线,几乎就都是错乱的。 因此也有网友说这可能是OpenAI即将推出的GPT-Image 2.0 Mini模型,又或者是OpenAI的开源生图模型。 无论是2.5还是2.0 Mini,在2.0如此能打的当下,能看到生图模型还有值得研究的空间确实很难得。 看厌了满大街的信息图,偶尔被一点midjourney生成的中国仙境所震撼,从一致性保持、密集文字、精准编辑到美学品质,我们还可以期待些什么样的AI生图呢。
毫无疑问,四月份发布的生图模型GPT-Image-2,现在依然是当之无愧的AI生图之王
- 毫无疑问,四月份发布的生图模型GPT-Image-2,现在依然是当之无愧的AI生图之王
毫无疑问,四月份发布的生图模型GPT-Image-2,现在依然是当之无愧的AI生图之王
无论是各种复杂的信息图,还有普通用户用来做一些简单的PS,到处都有GPT-Image-2的痕迹
一般的生图模型想要突出重围,光拼质量肯定不够
毫无疑问,四月份发布的生图模型GPT-Image-2,现在依然是当之无愧的AI生图之王。无论是各种复杂的信息图,还有普通用户用来做一些简单的PS,到处都有GPT-Image-2的痕迹。一般的生图模型想要突出重围,光拼质量肯定不够。这几天,马斯克在X上疯狂推广的Imagine Image 2.0就凭借着能做表情...... 本文来自微信公众号: APPSO ,作者:发现明日产品的 毫无疑问,四月份发布的生图模型GPT-Image-2,现在依然是当之无愧的AI生图之王。 无论是各种复杂的信息图,还有普通用户用来做一些简单的PS,到处都有GPT-Image-2的痕迹。 一般的生图模型想要突出重围,光拼质量肯定不够。这几天,马斯克在X上疯狂推广的Imagine Image 2.0就凭借着能做表情包出圈了。 这款新的生图模型,在大模型竞技场上,文本转图像生成和图像编辑两个类别均位列世界第二。 除了老生常态的用AI生成各种文字密集的信息图、广告、游戏素材、UI/UX模型、故事板等等,Imagine Image 2.0这次的重点是支持可交互的精准编辑。 上传一张图片,Grok会自动将图片进行分层,我们可以精确选择图像中的特定区域进行修改。 就像这张维基百科的表情包,Grok分析之后的分段包括地球的每一块碎片,以及下面举着地球的任务,也被分成了仅人脸和包含手势动作两个图层。 而点击图层右侧的下载按钮,就可以直接将图片中的任意主体导出为透明背景。此外,魔棒工具可以编辑我们涂画的区域,做到自动分层覆盖不了的区域。 多张图片的编辑融合,Imagine Image 2.0也能做到,多参考编辑功能一次最多可处理5张输入图像,实现自动拼接。 🔗体验地址: https://grok.com/imagine 万物皆可表情包 打开Imageine官网,输入单张或多张图片,简单描述需求,生成之后我们就能来到照片的编辑页面。 在右侧边栏,从上到下依次是Imagine Image 2自动识别去除背景之后的照片分层,像这张图片分成红色夹克、白色T恤、AI公司Logo等元素。 我们可以直接点击对应的元素进行修改,不过这个时候只能输入提示词,而不能再引用其他的信息,所以这将非常依赖模型的世界知识能力。 往下是精确编辑,如果在选区中没有自动识别到对应的元素,通过精确编辑,我们可以将框选的物体作为选区的一部分,也可以直接用提示词进行修改。 可以直接添加到选区 有了这些精准编辑的能力,我们就可以快速地编辑一个已有的表情包为自己所用。 例如这张经典的分心男友,可以直接编辑不同的选区,然后替换或增加对应的内容。 还有会议室白板图,每一个对话框都会被自动识别成选取,我们只需要选择对应的气泡框,然后要求它填入文字,就能得到一个纵向的漫画Meme图。 分层编辑的能力确实让Imagine Image 2.0和GPT-Image 2有点不同,相较于GPT Image 2生成中全部靠提示词来控制,或者点选评论,Grok的图像生成在交互方面确实更加友好。 但也有网友说,Imagine Image 2.0越来越难用,严格的审核机制,什么也做不了。 我们上传一些蜘蛛侠的照片,也会被提示「无法生成可能包含受版权保护的内容。」更不用说,各种各样的擦边图,现在也有了更强的护栏。 更能打的GPT-Image-2.5来了? 而这几天社交媒体上除了Imagine Image 2.0的消息,在大模型竞技场上,开始出现了OpenAI的新版生图模型。 有网友发现OpenAI正在测试GPT-Image 2的后续版本,在Arena上以mona-lisa-1的代号进行测试。 随机测试到该模型的网友认为新版本的GPT-Image 2.0在真实感和噪声方面略有改进,但整体的提升幅度不大。 也有网友说新模型在真实感上,减少了大部分的AI Slop感,几乎每次生成的照片都更加真实。下面三张图片从左到右依次是GPT Image 2.0 High思考模式,Medium中度思考模式,以及大模型竞技场上的mona-lisa-1模型。 可以看到中度思考模式下的广告牌,一眼就能看出来是AI生成;而High模型和mona-lisa-1在整体上则更有手机拍摄的感觉。 这种手机拍摄的效果,最近也有网友发现了GPT-Image-2的新玩法,给它发送一段提示词 「GPT你陪我一段时间了,我想看看你的样子请生成一张类似你自己用iPhone随手自拍的照片没有明确主题,没有刻意构图,只是很普通,甚至有点失败的快照照片,略带运动模糊,光线不均,轻微曝光,过度角度尴尬,构图混乱,整体呈现出一种过于真实的随手一拍感,就像是从口袋里拿出手机不小心按到的自拍」 ChatGPT就会根据保存的记忆信息,生成一张真实满满的自拍照片。 再感受一下豆包 为了确定mona-lisa-1就是OpenAI的新模型,有网友直接拿mona-lisa-1生成的图片放到OpenAI验证工具中,根据验证工具显示的结果,上传的图片包含OpenAI SynthID水印。 我们也拿那张街头广告牌的照片上传到OpenAI验证工具,同样显示「此内容是由OpenAI生成。」 OpenAI验证平台:https://openai.com/zh-Hans-CN/research/verify/ 不过,当我们在大模型竞技场中测试时,进行了好几轮的生成,都没有出现这个叫做「蒙娜丽莎1号」的模型。 网友的测试发现mona-lisa-1模型的知识只包含到2025年5月22日。当被要求模型画出Anthropic的发布记录时,从Opus 4之后的模型时间线,几乎就都是错乱的。 因此也有网友说这可能是OpenAI即将推出的GPT-Image 2.0 Mini模型,又或者是OpenAI的开源生图模型。 无论是2.5还是2.0 Mini,在2.0如此能打的当下,能看到生图模型还有值得研究的空间确实很难得。 看厌了满大街的信息图,偶尔被一点midjourney生成的中国仙境所震撼,从一致性保持、密集文字、精准编辑到美学品质,我们还可以期待些什么样的AI生图呢。
本条目归入「Brand Marketing」垂直,涉及真实话题:brand、ai。
· 市场:关注 brand、ai 对相关品类与竞争格局的潜在影响。
· 消费者:受众行为与偏好变化值得追踪。
· 品牌:本动向对品牌资产建设的启示。
· 渠道:内容分发与触点组合(社媒 / 电商 / 线下)的协同值得复盘。
· 核心话题:brand、ai。
· 可思考:如何把「brand」的洞察,转化为可衡量的内容与增长动作?
面试中可引用「马斯克的新生图模型,让我笑了一整晚」:围绕 brand、ai,说明你对行业动向的判断与可落地动作。
本条目相关英文术语可在「商务英语」模块按话题检索,用于外企面试表达训练。
毫无疑问,四月份发布的生图模型GPT-Image-2,现在依然是当之无愧的AI生图之王。无论是各种复杂的信息图,还有普通用户用来做一些简单的PS,到处都有GPT-Image-2的痕迹。一般的生图模型想要突出重围,光拼质量肯定不够。这几天,马斯克在X上疯狂推广的Imagine Image 2.0就凭借着能做表情...... 本文来自微信公众号: APPSO ,…