![]() |
|
想象一下,给顶级AI模型一张白纸和一套彩色铅笔,让它们从第一笔开始,慢慢画出一幅蒙娜丽莎。这不再是简单的文字生成图像,而是一场真正的技巧考验。
在这次有趣的测试中,GPT-5.6 Sol、Claude Fable 5、Grok 4.5和Gemini 3.6 Flash这四位选手进入了特制的绘画竞技场。它们不仅要决定画什么,还要像真正的画家一样,控制笔尖的粗细、压力和颜色。它们可以使用晕染工具来混合色彩,也能用橡皮擦去败笔,甚至能通过查看画布指令来审视自己的作品。这里没有一键填色的快捷键,每一抹阴影和色彩都必须通过不断叠涂来实现。
实验结果非常出人意料。GPT-5.6 Sol成为了全场的领跑者。它非常高效,平均每幅画只用了29步,用时约6.2分钟,成本仅为7.74美元。有趣的是,它从不浪费口舌去单独设置画笔参数,而是直接在下笔时完成所有配置。它创作的星空和玫瑰花被公认为全场最佳,在细节处理上几乎完胜其他对手。
Grok 4.5则像是一个深陷细节的微观管理者。在它的工具调用记录中,竟然有65%的操作是在反复调整画笔颜色、宽度和压力。由于把大量精力花在了调色和选笔上,它画一幅画平均需要99步,但最终的效果却显得有些粗糙。而Gemini 3.6 Flash则是最纠结的审稿人,它每画几笔就要停下来观察一下画布,每幅画平均自审22.6次。虽然它在数学层面的结构相似度评分中拿到了最高分,但从人类的审美角度来看,它的作品并不一定是最漂亮的。
这次实验还揭示了一个有趣的共性:AI往往会画蛇添足。所有的模型在创作中途其实都达到过一个最佳状态,但由于它们不断地进行自我审查和修改,最终的作品反而不如中间过程。比如Gemini 3.6 Flash在画蒙娜丽莎时,中途的相似度曾达到峰值,但随着它继续编辑,得分反而一路下滑。
这场实验不仅仅是为了看AI画得有多像,更是为了观察它们处理开放式任务时的能力。那些廉价的开源模型在面对这种需要长路径规划的任务时,往往只能交出白卷。通过这种方式,我们能更清晰地看到顶级模型与普通模型之间的真实差距。这不仅是算法的较量,更是逻辑、效率和艺术理解力的综合体现。


| 当前新闻共有0条评论 | 分享到: |
|
||||||||||
| 评论前需要先 登录 或者 注册 哦 |
||||||||||||
| 24小时新闻排行榜 | 更多>> |
| 1 | 内部人惊天爆料!广西决堤死伤巨大 三峡大 |
| 2 | 216对214!众议院闯关成功,球踢到了参议院 |
| 3 | 堪比“选妃”!习近平专列乘务员标准曝光 |
| 4 | 谢霆锋宣布谢贤离世的第二天王菲已经体面无 |
| 5 | 老人若减少吃米饭 用不了多久身体会有5大变 |
| 48小时新闻排行榜 | 更多>> |
| 一周博客排行 | 更多>> |
| 一周博文回复排行榜 | 更多>> |
| 1 | 美伊地面战争的可能性依然存在 | 随意生活 |
| 2 | 为什么左派右派竟然会做同样的 | 高伐林 |
| 3 | 加拿大遭遇天灾川普及美国官员 | 右撇子 |
| 4 | 川普也玩梗。 | 白草 |
| 5 | 美國的選舉腐敗問題有多大呢 | 清高 |
| 6 | 中國2.2億人躺平,靜默革命習 | 彼德 |
| 7 | 保加利亚索菲亚大学教授写书介 | 俞先生 |
| 8 | 书生醒醒:意识形态民主自由 | 菓趣 |
| 9 | 老川这次非常有可能把IRGC干到 | 山蛟龙 |
| 10 | 老人如何才能脚不衰 | 快活老人 |