2026-10-02 02:25:00 作者:大讲堂
我上周找老陈拿修复好的老照片,推开门就看见他对着显示器拍桌子。
老陈干了十年照片修复,前两年赶AI的风口,把工作室从线下小门店搬进了老写字楼,本来想省点事,没想到麻烦一堆。电梯总是晃。
老陈的麻烦
最早用的开源AI修图模型,说起来神乎其神,实际用起来全是bug。我爷爷那张1960年的合影,背景是几棵悬铃木,叶子飘在他脸旁边,AI非把深色的叶脉当成脸上的皱纹,修完之后我爷爷看起来比实际年龄老了二十岁。
哦,这还是轻的。有次一个客人拿了张情侣照来,男生站在女生身后,头发被虚化了一块,AI直接把男生头发修成了女生的耳环。你说上哪说理去?
老陈那时候天天骂,说AI就是个没长眼睛的傻子,只会对着像素堆算法,根本不知道啥是重点啥是垃圾。
AI修图错误把树叶修成面部皱纹对比图
直到三个月前,他换了新的模型,核心加了自注意力机制。说实话,我第一次听这个词的时候,以为又是AI圈圈钱的新名词,不就是换个说法吹牛逼吗?
老陈直接给我拉了对比图。同一张照片,同一个输入,旧模型糊成一团的地方,新模型清清楚楚把人脸分出来,背景的树叶还是树叶,脸上的皱纹归皱纹,一点都不串。
你说神不神?
自注意力,其实就是”知道该往哪看”
我不懂复杂的公式,老陈给我解释得直白。你现在读这句话:“我把杯子放在桌子上。”你一眼就知道“放”这个动作的对象是杯子,不是桌子,对吧?放在十年前的AI,它不知道啊,它只能看见相邻的字,隔远一点的关系它抓不住。
自注意力厉害在哪?它会给每一块信息打分。哪块重要,分就打高,多给点权重;哪块不重要,分就打低,直接放过去。就说修图,脸肯定比背景的树叶重要啊,自注意力一眼就找准了脸的位置,自然不会乱改。
原来的卷积神经网络,是拿个小框子滑来滑去,一次只能看一小块,远一点的两个像素,它根本不知道它们之间有关系。自注意力不一样,它不管你隔得多远,只要有关系,就能把线牵上。
比如你写一篇长文章,开头说“今天下雨”,结尾说“所以我带了伞”,自注意力能把开头的下雨和结尾的伞连起来,原来的AI做不到,经常前言不搭后语。
Transformer自注意力权重热力图示例
不过话说回来,这个逻辑其实一点都不新鲜,这不就是我们人天天在用的吗?你走在街上,迎面走来你的心上人,你眼里只有她,旁边的车啊树啊广告牌啊,全都会自动虚化,这不就是你的大脑在给自己用自注意力吗?
说白了,自注意力就是让AI学会了知道哪些该重视,哪些可以放过。就这么简单一个改变,直接把AI从“凑数的”变成了“会思考的”。现在的聊天机器人,现在的AI画图,哪个背后不是自注意力撑着?
当自注意力照进普通人的生活
当自注意力照进普通人的生活
我在老陈工作室待了一下午,遇到一个来取照片的老太太,八十多了,背驼得厉害,手攥着布包,进门就问师傅,我那张集体照修好了吗?
那张照片是1965年她大学毕业的时候拍的,那时候她家里穷,穿了件打补丁的衣服,照相的时候主动站在了最边上,时间久了,边边角角发霉糊了一块,她自己找了好多人修,都修不好。
老陈把平板递过去,老太太眯着眼睛看了好久,手指颤巍巍点在屏幕上自己的脸,说“就是这个样子,就是这个样子,我都快忘了我那时候长什么样了。”
我站在旁边看着,突然有点鼻酸。你想啊,这张照片存了五十多年,那么多像素,那么多同学,那么多背景,AI用自注意力,一下子就抓住了老太太最在意的那一小块,那一小块对别人来说就是边角的糊像素,对她来说是整个青春啊。
老陈说,原来没AI的时候,他修一张这样的照片要花两三天,还要一点点擦,现在AI十几分钟就出初稿,他只要调调颜色就行。原来他一天下来累得腰都直不起来,满脑子都是像素,现在他有时间坐下来跟客人聊聊天,听听照片背后的故事。
好多人说AI会抢了手艺人的饭碗,我看不是。AI抢的是那些重复的、不用动脑子的活,把人从像素里解放出来,去关注人真正在意的东西。这不就是自注意力本来的意义吗?
走的时候雨停了,太阳从云里钻出来,落在写字楼楼下的共享单车车篮上,反光晃得我睁不开眼。我突然想,我们这一辈子,遇到过多少信息啊,从出生到现在,看过多少脸,走过多少路,听过多少话,真正留在我们记忆里的,不都是被我们自己的自注意力筛出来的那一点点吗?
AI学会了自注意力,它开始像人一样选择,一样聚焦。以后呢?它会不会也慢慢拥有自己的“记忆”?会不会也有它最在意的那一小块边角像素?
没人说得清。对吧。
免责声明:市场有风险,选择需谨慎!此文仅供参考,不作买卖依据。如有侵权请联系删除。
文章名称:自注意力:AI怎么学会像人一样"看花不是花"
文章链接:https://m.lfdjt.com/info_23_23530.html