2026-10-10 21:48:57
作者:
科技
早上赶去南京出差,打开地图搜“夫子庙附近好吃的盐水鸭”,出来的结果第一栏不是某篇攻略,是一张整整齐齐的信息卡,列着评分、营业时间、步行距离,甚至还有店家今日有没有休息。你点进去,还能看到其他食客拍的刚切好的鸭皮,油亮油亮的。
你没注意到吧。这背后干活的,就是知识图谱。
它不是堆知识,是织一张关系网
很多人听这名字,以为就是把各种知识点整理成一个大百科,存在数据库里。不对。它的核心从来不是“知识”,是“关系”。
每一个实体,不管是南京盐水鸭,还是夫子庙,还是某个具体的店家,都是网上的一个节点。节点和节点之间,用线连起来,线上写清楚是什么关系。比如“南京盐水鸭”和“金陵菜”的关系是“属于”,“章云板鸭店”和“南京秦淮区”的关系是“位于”,“章云板鸭店”和“南京盐水鸭”的关系是“主打”。就这么连来连去,就成了一张能读懂用户问题的网。
美食领域知识图谱节点关系示意图
换做以前的关键词搜索,你搜“夫子庙盐水鸭”,它只要看到网页里有这四个词就给你推,哪怕那个网页是讲“我去年去夫子庙玩,吃了盐水鸭拉肚子”,它也会给你排前面,因为关键词匹配上了。知识图谱不一样,它先看懂你要找的是“夫子庙附近售卖盐水鸭的店铺”,直接从网里把符合这个关系的节点拉出来给你,省得你自己翻。
你每天用的功能,大半都有它
别以为知识图谱只在搜索里用。你刷短视频,为什么你看了两条中山陵的红叶,接下来两三天刷到的全是南京秋景?你听歌,为什么你循环了三首民谣,给你推的全是同风格的独立音乐人,不是乱七八糟的流量歌?你点外卖,输地址输个“公司”,它直接跳出你写字楼的具体门牌号,不用你再翻一遍?这些全是知识图谱在牵线。它把你的行为、喜好、常用地点,全都做成节点连好了,知道什么和什么挨得近。
我之前帮朋友做过一个小型的古籍整理项目,把全唐诗里的人名、地名、典故全都做成知识图谱,你搜“李白去过的南京”,直接就能把所有提到李白在金陵活动的诗全都拎出来,换以前你得翻半年索引。
全唐诗知识图谱人名关联示意图
说实话,很多人刚接触这个概念,总觉得它高高在上,是实验室里的黑科技,其实早就在你手机里躺了五六年了,只是没声张罢了。
大模型时代,知识图谱没死
大模型时代,知识图谱没死
前两年大模型刚火起来的时候,到处都在说知识图谱要被淘汰了,大模型参数够多,什么知识都装得下,还要什么死板的节点关系。我一开始也信了。
直到上个月帮一个做政务查询的朋友改需求,他说客户要查“南京市所有注册资本超过一千万的高新技术企业”,大模型回答永远错,要么漏一半,要么把苏州的企业算进来,甚至编几个不存在的企业给你。为什么?大模型记的是概率,不是准确的关系。知识图谱不一样,每个企业的节点,都清清楚楚标了所属城市、注册资本、资质,一拉一个准,错都错不了。
大模型会“瞎编”,知识图谱不会。现在做得好的大模型应用,哪一个不是背后接了知识图谱做校正?你问的是事实类问题,大模型先去知识图谱里捞准确的结果,再组织语言给你,比纯大模型输出靠谱太多。
不过话说回来,很多人对知识图谱的误区真的挺深的。比如说,很多人觉得知识图谱越大越好,节点越多越厉害。我见过一个创业团队,爬了整个互联网,攒了几十亿个节点,到处吹自己的规模,结果一查,连“南京是江苏省会”都能搞混,把“南京”连到了错误的关系上,闹了大笑话。
节点再多有什么用?知识图谱的核心,永远是关系的准确性,不是规模。很多垂直领域的小知识图谱,比如专门给医院做的罕见病知识图谱,节点才几万,每个关系都是专家一条一条核对标出来的,帮医生快速找对诊疗方案,救的了人,比几十亿垃圾节点值钱一万倍都不止。
昨天我去盐水鸭店排队,前面的小姑娘拿着手机搜“盐水鸭怎么看新不新鲜”,手机直接弹出了五条判断标准,整整齐齐,没有乱七八糟的广告。她看完直接锁屏,不用点进任何网页。那一瞬间我就想到,这张看不见的网,早就把我们生活里乱七八糟的信息,理得顺顺当当了。
只是大多数时候,我们都没停下看看而已。对吧。
免责声明:市场有风险,选择需谨慎!此文仅供参考,不作买卖依据。如有侵权请联系删除。
文章名称:藏在手机里的知识图谱
文章链接:https://m.lfdjt.com/p/keji/a/8670.html