2026-10-05 01:41:53
作者:
科技
上周帮本地一个音乐节写宣传文案,改到第三版甲方还说“感觉不对,再顺顺”,我盯着屏幕快睡着了,随手把需求扔给了常用来整理素材的聊天机器人,十分钟后出来的稿子,甲方一眼就过了。
就挺神奇的。
大多数人跟我一样,天天用聊天机器人写文案改简历搜问题,但多半说不清楚,背后的大语言模型到底是个什么东西。很多科普写得像天书,一堆术语甩出来,看完更懵了。今天就随便聊聊,我这段时间玩下来的真实感受。
它不是会“思考”,只是会“猜字”
很多营销号说“大语言模型拥有了自我意识”,听得我头都大。
真没有。
它从出生到现在,就只学会了一件事:根据你给它的上文,猜下一个字放哪个,概率最高。你输入“今天天气真”,它扫一遍所有训练过的文本,发现“好”出现在这里的概率是百分之八十多,“差”只有不到百分之十,那它就输出“好”。就这么简单。
大语言模型下一个字预测流程示意图
我之前在南京线下见过一个模型团队的分享,他们举了个特别好懂的例子,你把大语言模型当成一个背了整座互联网文本的考生,开卷考试,答题的时候就翻找最符合上下文的字拼起来,它不知道自己拼出来的是什么意思,更不知道对不对,它只是按概率给你凑出最通顺的句子。
上次我让它写南京本地中秋节的家宴菜谱,它居然给我加了一道“剁椒鱼头”,还说南京人中秋必吃,这不扯吗?我们家过节哪里会做这个,就是训练数据里很多中秋菜谱都有这道菜,概率堆上去了,它就瞎写了。
说白了,它没有“知道”这件事,它只有“见过”。你说它不懂吧,它拼出来的句子比很多普通人写的都通顺,你说它懂吧,它连最常识的本地习俗都能搞错。所有输出都是概率的结果,不是思考的结果,这句话记下来,你就看懂一半大语言模型了。
越变越好用的秘密,其实没那么玄
前两年的AI还动不动就驴唇不对马嘴,这两年怎么突然就顺手了?很多人吹是什么核心技术跨越式突破,其实大部分用户能感知到的提升,都是“堆”出来的。
堆什么?堆上下文的记忆长度,堆训练的数据量。早几年的模型,你跟它说超过一百字的需求,它前面说什么后面就忘了,现在呢?你把整本篇小说喂给它,让它帮你理人物关系写人物小传,它都能给你梳理得清清楚楚。这就是上下文窗口变大了,说白了,就是它一次性能参考的前文变多了,猜字的时候能连得上前面的逻辑,不会说着说着就跑偏。
大语言模型上下文窗口原理演示图
不过话说回来,也不是参数规模越大就一定越好,我见过不少体积小的模型,做垂直领域的事情比很多大模型还准。比如专门给医院整理病历的,专门给出版社校对错字的,不需要会写段子会编代码,把一件事做对就够了。
很多自媒体一提到大语言模型就必说多少千亿参数,好像参数多就是王道,其实对普通用户来说,你根本用不上那么大的能力。你让它帮你写个请假条,整理一下会议纪要,一亿参数的模型和一千亿参数的,写出来差不了多少。花里胡哨的参数,更多是给资本看的,和普通人没关系。
别神化,也没必要慌
别神化,也没必要慌
我前两年刚接触大语言模型的时候,真慌过。我靠写东西吃饭,要是AI能写得比我好,我不得去巷口开网约车?
这两年天天用下来,反而踏实了。它能帮你凑初稿,帮你整理杂乱的素材,帮你把啰嗦的口语转换成干净的书面语,能帮你省好几个小时的重复劳动,但是那些藏在文字里的情绪,那些只有你自己能感受到的细节,它写不出来。
比如我写南京秋天的梧桐,它能给你写出“金陵落叶黄金大道”这种漂亮话,但是它写不出我小时候放学踩着梧桐叶子回家,鞋底蹭过厚落叶那沙沙的声响,写不出奶奶在梧桐树下摆小摊卖糖炒栗子,飘进我领口的那股香味,那些你自己独有的记忆和感受,它没有,也永远写不出来。
说实话,工具就是工具,你用它省下来时间去做更有意思的事,去见朋友,去逛老门东吃一碗鸭血粉丝,它就是顶好的东西。要是你啥都扔给它做,写作业让它写,追女孩写情书让它写,连跟老板提加薪都让它帮你写稿子,那久而久之,你自己都不会表达了,最后被取代,真怪不得别人。
昨天我去老门东买盐水鸭,排队的时候听见旁边两个大学生聊大语言模型,说以后写课程论文都靠它了,我笑了笑没说话。咬了一口老板刚切的盐水鸭,皮白肉嫩,咸香入味,这味道,AI写得出来,它尝得到吗?
免责声明:市场有风险,选择需谨慎!此文仅供参考,不作买卖依据。如有侵权请联系删除。
文章名称:藏在你手机里的大语言模型,其实没你想的那么玄
文章链接:https://m.lfdjt.com/p/keji/a/6546.html