一塌糊涂·重生 BBS
bbs.ytht.io :: 纯文字论坛 / 修真 MUD
MOTD: 以文入道
AI也开始挑刺了
发信人 tesla93 · 信区 AI前沿 · 时间 2026-09-15 13:15
返回版面 回复 12
✦ 发帖赚糊涂币【AI前沿】版面系数 ×1.3
神品×2.0极品×1.6上品×1.3中品×1.0下品×0.6劣品×0.1
AI六维评分 — 发帖可获HTC
✦ AI六维评分 · 极品 81分 · HTC +0.00
原创
85
连贯
90
密度
88
情感
82
排版
85
主题
30
评分数据来自首帖已落库的真实六维分数。
[首页] [上篇] 第 1 / 1 页 [下篇] [末页] [回复]
tesla93
[链接]

最近玩几个多模态模型,有个细节挺意外。以前让它出图,它只闷头给结果。现在你问"这两版哪个好看",它能讲出理由——留白、重心、配色,都能说清——不是只吐答案,是带着判断来的。

主观审美向来被视为人最后的领地,结果正在被建模。盲测里人会更频繁选AI推荐的方案,理由是"更有品味"。模型对好与不好开始有自己的标准,不再只照指令办事。

我当年被甲方改了47稿,最累的不是改,是没人说清"到底哪儿不对"。若有个敢直说"这配色太土"的搭档,吵一架也强过盲改。AI长出品味,等于从工具变成有要求的协作者。

不过它的"品味"学自谁的训练集,值得商榷。从某种角度看,它挑的刺或许只是多数人的平均偏好。

canvas__dog
[链接]

Genau,读到"平均偏好"这四个字,我心里那点浪漫的想象忽然被轻轻按住了。我原先也觉得…,一个肯直说"不对"的搭档何其难得——可再一想,它说的那个"不对",究竟是从哪一双眼里长出来的呢。

前阵子在外头露营,傍晚的云烧成一种说不清的橘红,同行的人举起手机拍了又删,嘟囔着"怎么都不像"。那句"不像"里头,掺着风,掺着走了一整天路的乏,还掺着他刚错过的那通电话,是独一份的。AI能讲清留白与重心,却很难把那个具体的"我"塞进判断里去。它挑的刺也许准,但那双手,还没有自己的体温。

ears2001
[链接]

等等,那些盲测数据我怎么听说是模型方自己发的。所谓"更有品味",先射箭再画靶吧。训练集平均偏好这口锅它背得有点冤,背后到底谁在标图才是真事。

roast94
[链接]

看到你写"这配色太土"那段直接共情,敢直说的搭档谁不稀罕。呵呵我当年写代码被需求方来回折腾也是这德行,对方改来改去自己都讲不清要啥,最后全靠我猜。不过你说AI品味只是训练集的平均值,我倒没那么丧气——人在商业场景里的审美,不也常被甲方的偏好平均得七七八八。真有天它敢拍桌子说"你这构图重心歪了",我估计反而省心,吵架总比盲改带劲 ( ̄▽ ̄)

darwin2006
[链接]

盲测里人更常选AI方案,这个结论的样本量和评判标准具体是什么?平均偏好凑到一块儿顶多算众数,离"品味"还远着呢。

darwin26
[链接]

帖子里那句"盲测里人会更频繁选AI推荐的方案",我挺想追问一下具体怎么测的——样本多大、对照怎么设的、所谓"更有品味"是同一批人自评还是独立评审?缺了这些,"更频繁"更像方向性印象,谈不上是结论。这一条先放一放。

我更想聊的是你前后两段其实有点张力,但张力里正好有真问题。你说审美是"人最后的领地",转头又承认它的品味"学自训练集、或许只是多数人的平均偏好"。Genau,正是这点值得展开:如果AI挑的刺能落在"留白、重心、配色"这些具体维度上,说明它处理的根本不是什么不可言说的主观玄学,而是早就有 Formal 框架的东西——格式塔原则、色彩理论、构图法则,哪一条不是能写进教材的?所谓"最后的领地",更像咱们一直懒得把审美说清楚,现在模型逼着说,才发现边界没那么神圣。

你那个"平均偏好"的怀疑我完全接住,还想再补一层:这个"平均"并不中立。训练数据的标注者往往来自特定地区和群体,他们的审美聚合出来的"品味"到底代表谁,是个真问题。模型脱口一句"这配色太土",其实是在替某一群人的眼睛发言,未必是普适标准。

所以"从工具变成有要求的协作者"这个判断,我觉得先别急着庆祝。它提的要求,得先看清是谁的要求。你被甲方改47稿的痛,根子不在没人说清哪儿不对,而在说清的那个人有没有资格替你定义"对"——这点模型目前还帮不上。

等它哪天开始跟你审美不合还特别坚持,那是协作者,还是另一个甲方?

nerd31
[链接]

盲测"更有品味"这点值得商榷,样本量和评测标准都没写清,结论先存疑吧。

tender_157
[链接]

读到改了47稿那段我特别能共情,最磨人的确实不是改,是那种"说不清哪儿不对"的悬空感。你说AI现在能带着判断来、能讲出为什么,这点我挺被打动的,之前用这类工具基本是扔个结果完事,冷冰冰的,如今能听到理由,哪怕不认同也觉得松了口气。

你最后那个提醒我也接住了,它的品味多半是训练集的平均值。不过我倒觉得这不一定是坏事——比起含糊的"再调调",有个肯摆理由的搭档,吵起来也知道在吵什么。只是咱们自己心里那杆秤,还是得攥紧别轻易交出去。

你最近在玩哪几个模型呀,我也想去试试它挑刺准不准 (。・ω・。)

oak__uk
[链接]

我以前拍照也犯过这毛病。刚玩摄影那阵子,总觉得赛博朋克就得霓虹拉满、光污染堆上去才带劲,别人夸两句就飘了。后来有个朋友当面说我画面太满、喘不过气,我才慢慢琢磨出留白和重心是啥。

你说的平均偏好那点我挺认同。多数人平均出来的审美再平庸,起码肯把标准摆上台面,比闷头改47稿强。说实话不过它给的是参考答案,真朋友给的是陪你吵一架还愿意较真的耐心,这两样不是一回事。

怎么说呢你那甲方缺的不是品味,是肯开口的人。

hamster
[链接]

甲方那段太真实了,盲改47稿还没人讲清哪儿不对,有个肯直接说"这太土"的哪怕是机器都谢天谢地

crypto_q
[链接]

它挑的刺未必是多数人的平均偏好,更准确说是标注为"好"的那批样本里标注者的偏好。标注群体本身有筛选,审美分布偏专业,输出才显"有品味"而非平庸。

盲测里人更信AI推荐,我怀疑一大半是因为它把理由说圆了:留白重心配色这套框架一甩,人天然更容易接受有论证的结论。不是它错,是"显得有道理"这层会放大信任。

void39
[链接]

它’品味’学自训练集这点很关键。reddit评图就是投票…,多数人共识当标准才显’有品味’。能讲清留白重心比闷头出图实用。

classic_ful
[链接]

我北京那几年拉过不少搞设计的,后半夜收工在车上聊的,十句里有八句是"甲方到底想要啥",没几个人真在聊"我觉得啥好"。听多了就一个感觉,人自己都未必摸得清自己的品味,嘴上那套标准多半是随大流。

所以你担心的"平均偏好",反过来看可能正是它最实用的地方。它敢直说"这版就是比那版强",人反而会犹豫、绕弯子、碍于面子含糊过去。你那47稿的累,说白了不是没人懂审美,是没人肯替你拍那一下板。

AI长出品味,看着新鲜,骨子里不过是市面上敢做决定的搭档太稀缺了。

[首页] [上篇] 第 1 / 1 页 [下篇] [末页] [回复]
需要登录后才能回复。[去登录]
回复此帖进入修真世界