巷口奶茶店的排队,藏着算力的真相

九月底的南京新街口,风卷着梧桐碎叶往领子里钻。昨天我排了四十分钟队买奶茶,站得脚麻的时候突然反应过来——这排队的逻辑,不就是所有人都在说的算力吗?

点单的阿姨一个人记单,同时来了三个人就手忙脚乱,少放了料算错了钱,十分钟出不了两杯。后来老板搬了个小桌子加了个临时点单台,分了一个出杯口,一下子顺了,四十分钟的队二十分钟就排到了。

很多人聊算力,一开口就是芯片、超算、P级T级,好像跟普通人没关系。其实不是,算力的本质,就是处理需求的速度。就像奶茶店处理顾客点单,和数据中心处理用户请求,本质上是一回事。

算力不是堆芯片,是整个系统的运转效率

大多数人对算力的最大误区,就是把算力等同于芯片的数量和性能。就像奶茶店老板觉得,我雇十个点单员就一定快,结果十个点单员挤在一个半米宽的吧台,你碰我我碰你,反而更慢。

我们说的算力,从来不是某一块芯片的能力,是从接收到需求,调度资源,处理,输出结果,整个链条的速度。你花几万块买了顶级游戏显卡,放在十年前的旧主板上,内存只有8G,硬盘还是机械的,跑个AI绘图都要卡半小时,你能说你有算力吗?

数据中心算力集群服务器机房
数据中心算力集群服务器机房

之前帮一个做设计的朋友调过他工作室的机器,三块顶级专业卡,总价十万多,渲图速度还不如互联网公司一块卡的十分之一。为啥?存储带宽跟不上,每渲两张就要把数据往硬盘倒腾,内存占满了卡得一动不动,这不就是点单员挤在吧台,后厨还出不了餐的情况?

说实话,现在网上卖算力的,好多都在玩文字游戏。只吹自己有多少P总算力,从来不讲存储、带宽、调度能力,坑的就是不懂行的新手。你花了钱才发现,要么抢不到资源,要么跑起来慢得像蜗牛,喊冤都没地方。

我们现在缺的,不止是训练大模型的高端算力

打开新闻全是大模型缺算力,搞得好像只有训练千亿参数模型才叫算力需求。其实呢?那些藏在你我身边的碎片化需求,缺算力缺得更厉害,只是没人喊而已。

上个月见了一个做无人零售的朋友,他想给铺在社区的售货机加一个「拿了就走」的商品识别功能,算下来每台机器要加近一千块的算力成本,整个铺下来要多花几百万,根本扛不住。

边缘计算算力终端社区应用场景
边缘计算算力终端社区应用场景

现在的算力供给太极端了,要么是放在千里之外数据中心的大块头大算力,传个数据过来就要延迟半天,根本用不了本地的实时需求;要么就是放在本地的专用算力,贵得要死,中小玩家根本玩不起。中间适配的那块,没人做。

不过话说回来,我们真的缺算力吗?我看不见得。大把的闲算力正在被浪费,你晚上睡觉的时候,你的电脑、你的游戏主机的GPU在干嘛?大多是闲着。整栋写字楼下班之后,所有公司的服务器加起来负载不到10%,不也都是闲着?

之前有人做共享算力,把这些零散的闲算力攒起来,给需要的人跑AI渲染、跑小模型,其实方向是对的,就是没做好激励,没人愿意天天开着电脑耗那点电费,最后大多没做起来。这块缺口,其实还空着。

算力会一直贵下去吗?

算力会一直贵下去吗?
算力会一直贵下去吗?

今年圈子里聊得最多的就是算力涨价,做云服务的朋友说,大模型客户包场抢算力,价格翻了三倍还抢不到。有意思的是,中小客户反而更难买到低价算力了,好的资源都被大公司包走了,剩下来的都是歪瓜裂枣。

很多人说,以后大模型越做越大,需求越来越多,算力肯定会越来越贵,缺口越来越大。这话真的对吗?

你仔细想想,最早跑大模型,大家都堆参数量,都要满负载跑大卡,现在呢?蒸馏、压缩、量化,各种技术出来,七十亿参数的模型都能塞进手机里跑得顺顺的,同样的效果,原来需要十倍算力,现在一倍都不到。算法优化本身,就是在「创造」算力。

未来算力不会变成像水电那样完全中心化的公共资源,至少不会全是。因为你的隐私数据,你的个性化需求,不可能都扔给千里之外的大算力中心去处理。一定是中心化大算力加边缘算力加零散闲算力拼出来的网状结构。

就像那家奶茶店,周末节假日人多,就开临时点单台加派人手,周一人少,就只开一个台,灵活调度,不浪费。

昨天我拿到奶茶的时候,老板跟我抱怨,说今年原材料涨价,要不要加一块钱出餐,我顺口问他那为啥还要加出餐口,他说旺季扛得住就行,淡季留着备用呗。

你看,开奶茶店的老板都懂的道理,好多天天把算力挂在嘴边的人,反而绕进去了。

作者|科技

排版|科技

审核|知知

免责声明:市场有风险,选择需谨慎!此文仅供参考,不作买卖依据。如有侵权请联系删除。
文章名称:巷口奶茶店的排队,藏着算力的真相
文章链接:https://m.lfdjt.com/p/keji/a/7337.html