巷口奶茶店的排队,居然藏着算力的秘密

上周六,0923,我在南京老门东排队买奶茶。 队伍拐了半个弯,前面的女生在吐槽,为什么生成个定制杯套要等十分钟。 老板擦着杯子喊,不是我网差,是算力不够啦,今天人多,都在排队等画。 突然就反应过来,我们天天听“算力”两个字,好多人到现在都没搞懂,它到底是个什么东西,偏要和我们喝杯奶茶都扯上关系。

奶茶店排队就是算力的本质

很多科普一上来就说,算力是设备处理数据的能力,太干了,记不住。 你就想你现在站的这个奶茶队。 每个做茶的师傅,一小时能做多少杯茶,开了几个做茶窗口,就是这家店的“出餐算力”。 人少的时候,点完单拿了就走,感觉不到。人一多,窗口少,师傅手慢,你就得站那晒十分钟太阳。 算力一模一样。 本质就是“同一时间能处理多少事,处理一件事要花多久”。大到超算中心算火箭轨道,小到你手机刷短视频给你推下一条,全靠算力排队。
南京老门东奶茶店点单排队场景
南京老门东奶茶店点单排队场景
就说这次的AI杯套,你上传一张你和老门东城墙的合影,AI要根据你的照片画一张带梧桐的定制图,这一件事,就要占掉一块计算资源,一百个人同时传,一百份任务一起挤,算力不够,可不就得排队吗?

我们抢不到的AI名额,到底是谁在卡算力

前半年大模型火的时候,好多新出的大模型排队几千人,等几个小时才能用上。 很多人骂服务商不行,其实真不是他们故意饥饿营销,是真没多余算力了。 说实话,我之前也误以为,算力就是堆越多芯片越好,芯片越先进算力越强。 后来才知道错得离谱。 你开奶茶店,一口气租了十个门面,招了十个做茶师傅,结果只有一个收银点单的位置,客人再多,一次也只能接一单,整体出餐速度还是上不去。 算力是一套完整的协同系统,不是堆芯片就能解决问题。从芯片的计算,到内存的中转,到网络的传输,任何一个环节慢了,整个系统的可用算力都会被卡住。
AI数据中心算力服务器集群机柜
AI数据中心算力服务器集群机柜
很多人还有个误区,觉得算力是给大企业、给科学家用的,和我们普通人没关系。 现在早就不是了。你刷短视频的人脸识别,你导航的实时路况计算,你用美颜相机修图,你打车的时候给你派单,全在耗算力。 只不过以前这些计算量小,分摊到每个用户身上感觉不到,现在AI出来了,生成一张图一次就要耗相当于刷一百条短视频的算力,可不就不够用了吗? 不过话说回来,现在的算力荒,一半是真需求涨得快,一半是真浪费。 我那天在南京的小型算力沙龙上听一个从业者说,国内不少新建的数据中心,利用率还不到一半,很多就是圈了地拿了政策,机器都没开满,白白耗着电。 可惜。

接下来的算力增量,其实藏在闲置里

接下来的算力增量,其实藏在闲置里
接下来的算力增量,其实藏在闲置里
现在所有人都在喊算力不够,要建新厂,要造新芯片,但是很少有人提,我们身边到处都是闲得发慌的算力。 你晚上睡觉的时候,你的游戏本的GPU,大部分时候是闲着的吧?你上班的时候,家里的智能电视、路由器,根本没在干活吧?很多互联网公司的服务器,白天跑满,晚上一半资源空着,就这么晾着。 这些碎得像掉在地上的奶茶珍珠一样的闲置算力,拼起来就是一笔超大的算力增量。 现在已经有公司在做这个事了,把分散的闲置算力聚在一起,给需要训练小模型、做AI推理的公司用,价格比买专门的算力便宜一半还多。 甚至还有人说,以后普通用户可以把自己设备的闲置算力挂出去,换点网费、换视频会员,不用花一分成本,就能赚点奶茶钱。 想想还挺有意思的对吧? 那天沙龙上那个做芯片的老大哥说的一句话我印象很深,他说现在所有人都挤破头抢最先进的芯片产能,好像不用最新的工艺就做不了算力。其实市面上大部分的AI应用,比如生成个杯套,算个门店的客流,用已经淘汰下来的成熟工艺芯片就完全够用,把这些存量芯片用起来,就能多出几倍的可用算力,根本没必要都去抢新的。 太对了。 我们现在讲算力,总觉得越新越大越好,忘了算力本来就是用来解决问题的,能低成本解决普通的小问题,比堆一堆高端芯片摆着看有用多了。 昨天拿到那个等了十分钟的AI杯套,画的是我站在梧桐树下,天是蓝的,城墙是灰的,杯套摸起来带着奶茶的温度,印着奶茶店的小logo。 没人会特意想,这张巴掌大的图,背后是上万个计算核心,排了半天队才挤出时间,一点点算出来每个像素点。 算力从来都不是飘在天上的概念,也不是数据中心里冰冷的机器。 它就是你排队手里那杯奶茶,就是你刷到的下一条短视频,就是你导航刚好避开的那场拥堵。 藏在看不见的地方,养着我们越来越懒也越来越有意思的生活。

作者|科技

排版|科技

审核|小准

免责声明:市场有风险,选择需谨慎!此文仅供参考,不作买卖依据。如有侵权请联系删除。
文章名称:巷口奶茶店的排队,居然藏着算力的秘密
文章链接:https://m.lfdjt.com/p/keji/a/5234.html