大语言模型:咖啡桌上聊出来的,不是黑魔法

九月二十三号,南京,新街口巷子里的老咖啡馆,空气里飘着桂花味和意式浓缩的苦,对面坐的朋友把笔记本往桌上一扣,骂了句脏话。说这礼拜接了三个需求,全要绑大语言模型,开水果店的要AI挑芒果,做民宿的要AI写欢迎词,连卖盐水鸭的都要整个智能推荐,说“不整AI,甲方说我们跟不上时代”。

别翻百科了,讲点你能听懂的

很多人一听大语言模型,就觉得是实验室里飘着蓝光的黑科技,一堆看不懂的公式堆出来的怪物。其实不是。说白了,它就是个特别会猜下半句的文字玩家。

你把从互联网诞生起,几乎所有能公开拿到的文字,书啊,博客啊,聊天记录啊,知乎回答啊,新闻啊,全喂给它,让它一遍一遍练:给你上文,你猜下一个字是什么。练个大几个月,它就摸透了中国人说话写字的规律,你说“今天南京天气”,它就知道你大概率要接“真好”或者“热死了”,你说“我要写一封请假条”,它就能顺着把剩下的话顺下来,连措辞都符合你要的语气。

大语言模型下一个字预测逻辑演示图
大语言模型下一个字预测逻辑演示图

你别不信,就这么简单。没有什么黑魔法,也没有什么觉醒的意识。它从来没有真正“理解”你说的话,它只是靠着统计规律,把最符合语境的字一个个拼出来给你。就这么回事。

戳破几个传得神乎其神的误区

戳破几个传得神乎其神的误区
戳破几个传得神乎其神的误区

第一个误区:大语言模型无所不能。不对。我前阵子帮朋友算个帐,三个大数字相乘,换了三个不同的大语言模型,结果出了四个不同的数,没一个对的。为啥?它本来就不是干计算的活儿啊,它的本职是拼文字,算术是顺路会的,真遇到复杂的,还不如你手机自带的计算器。还有人让它帮自己写毕业论文,结果它给你编参考文献,编得有模有样,你根本查不到,这不坑人吗。

第二个误区:大语言模型很快就要取代人了。拉倒吧。上次我让大语言模型写南京秋天的梧桐,写出来满篇都是“金黄的叶片落满中山路”,看起来很美,可它写不出来踩在落叶上那种软乎乎又带点嘎吱响的触感,写不出来风一吹叶子落在你咖啡杯沿的那种痒,这些东西,它没见过没感受过,怎么可能写得出来?它能拼出所有相关的形容词,可拼不出来你亲身站在中山路上吹过风的那个劲儿。

第三个误区:大语言模型就是某一两个海外产品,别的都不行。不对啊,现在国内好多团队做的模型,都挺好用的,更贴合咱们中国人的说话习惯,你要写个春节对联,改个婚宴请柬,国内的模型顺多了,别被营销号带节奏,觉得只有那一个才叫大语言模型。

冷静下来想想,它到底好用在哪

冷静下来想想,它到底好用在哪
冷静下来想想,它到底好用在哪

说实话,我一开始也烦,觉得什么都蹭大语言模型,都是割韭菜。不过话说回来,用了大半年,我发现它真的能帮你省好多破事。

比如我写专栏,要查好几年前的旧资料,以前我要打开五六个网页,翻半天,复制粘贴整理,一下午就没了。现在扔给大语言模型,让它帮我把这些资料里的核心观点整理成清晰的条目,五分钟就出来,我只要改改它错的地方,挑挑不对的信息,一两个小时就搞定了。这不香吗?

再比如,我朋友做行政,要写一堆乱七八糟的通知,一会是年会通知,一会是加班调休通知,以前写半天,现在把要求一说,大语言模型十分钟出三版,你挑一个改改称谓就能用,省下来的时间摸鱼喝奶茶不好吗?

它就是个帮你打杂的工具啊,对吧。你不会说打字机会取代作家,不会说计算器取代会计,大语言模型也一样,它取代不了会独立思考的人,只能帮你把那些重复的、碎得要死的破活干了,让你把时间留给真正要动脑子的事。

那天在咖啡馆,朋友最后叹了口气,说其实也不是不能加,就是甲方非要把它吹得神乎其神,好像加了就能上天,其实就是加个自动回应用户问题的聊天框,能省点客服的功夫而已。

我抿了一口冰咖啡,窗外飘过来一片梧桐叶,落在窗台上。你说这东西奇怪吗?其实不奇怪。就像当年互联网刚出来的时候,什么卖茶叶蛋的都要做个网站,现在不也冷静下来了?大语言模型也一样,现在吵得凶,再过个三五年,它就会变成所有产品里一个普通的功能,就像你现在手机里的输入法,你不会天天说我用了人工智能输入法你好厉害,你就是用它打字而已。

以后大语言模型也会这样,藏在你用的各个软件里,你感觉不到它的存在,但它帮你省了好多功夫。就像今天我出来喝咖啡,用大语言模型帮我写了个给家里的留言,几句话,说得比我自己写的还贴心,这不就够了吗?

它不是黑魔法,也不是洪水猛兽,就是个新工具而已。

哦对了,那天咖啡馆老板送的桂花糕,甜得刚刚好。

作者|科技

排版|科技

审核|阿辰

免责声明:市场有风险,选择需谨慎!此文仅供参考,不作买卖依据。如有侵权请联系删除。
文章名称:大语言模型:咖啡桌上聊出来的,不是黑魔法
文章链接:https://m.lfdjt.com/p/keji/a/2819.html