Warning: Undefined array key "wenan" in /www/wwwroot/suitangyanyi.com/jianzhan/app/show.php on line 46

Warning: Trying to access array offset on value of type null in /www/wwwroot/suitangyanyi.com/jianzhan/app/show.php on line 46
广泛应用到各个领域和行业-隋唐演义故事网-

{site_name}

{site_name}

🌜 搜索

广泛应用到各个领域和行业

▥ 𝄐 0
<br> <p>知识图谱&#xff0c;是<strong>结构化的语义知识库</strong>&#xff0c;用于迅速描述物理世界中的概念及其相互关系&#xff0c;通过知识图谱能够将Web上的信息**、数据以及链接关系聚集为知识&#xff0c;使信息资源更易于计算、理解以及评价&#xff0c;并能实现知识的快速响应和推理**。</p> <p>当下知识图谱已在工业领域得到了广泛应用&#xff0c;<strong>如搜索领域的Google搜索、百度搜索&#xff0c;社交领域的领英经济图谱&#xff0c;企业信息领域的天眼查企业图谱</strong>&#xff0c;电商领域的淘宝商品图谱&#xff0c;O2O领域的美团知识大脑&#xff0c;医疗领域的丁香园知识图谱&#xff0c;<strong>以及工业制造业知识图谱</strong>等。 在知识图谱技术发展初期&#xff0c;很多企业和科研机构会采用<strong>自顶向下的方式构建基础知识库</strong>&#xff0c;如 Freebase。随着<strong>自动知识抽取与加工技术的不断成熟</strong>&#xff0c;当前的知识图谱大多<strong>采用自底向上的方式构建</strong>&#xff0c;如 Google 的 Knowledge Vault 和微软的 【【微信】】 知识库。</p> <p>知识图谱的构<strong>建技术主要有自顶向下和自底向上两</strong>种。</p> <p>下图是典型的知识图谱样例示意图。可以看到&#xff0c;“图谱”中有<strong>很多节点&#xff0c;如果两个节点之间存在关系&#xff0c;他们就会被一条无向边连接在一起</strong>&#xff0c;这个节点我们称为实体&#xff08;Entity&#xff09;&#xff0c;<strong>节点之间的这条边&#xff0c;我们称为关系</strong>&#xff08;Relationship&#xff09;。 知识图谱的基本单位&#xff0c;就是“<strong>实体(Entity)-关系(Relationship)-实体(Entity)” 构成的三元组</strong>&#xff0c;这也是知识图谱的核心。</p> <p>知识图谱的原始数据类型一般来说有三类&#xff08;也是互联网上的三类原始数据&#xff09;: </p> <p>一般有两种选择&#xff1a;可以通<strong>过 RDF&#xff08;资源描述框架&#xff09;这样的规范存储格式来进行存储</strong>&#xff0c;比较常用的有 Jena等。</p> <p> 截止目前为止&#xff0c;看起来知<strong>识图谱主要是一堆三元组&#xff0c;那用关系数据库来存储可以</strong>吗&#xff1f;</p> <p>对&#xff0c;从技术上来说&#xff0c;<strong>用关系数据库来存储知识图谱&#xff08;尤其是简单结构的知识图谱&#xff09;&#xff0c;是完全没问题</strong>的。但一旦知<strong>识图谱变复杂&#xff0c;用传统的「关系数据存储」&#xff0c;查询效率会显著低于「图数据库</strong>」。在一些涉及到2,3度的关联查询场景&#xff0c;图数据库能把查询效率提升几千倍甚至几百万倍。</p> <p>而且基<strong>于图的存储在设计上会非常灵活&#xff0c;一般只需要局部的改动即可。当你的场景数据规模较大的时候&#xff0c;建议直接用图数据库</strong>来进行存储。</p> <p>在逻辑上&#xff0c;我们通常将知识图谱划分为两个层次**&#xff1a;数据层和模式层**。</p> <p>模式层&#xff1a;在<strong>数据层之上&#xff0c;是知识图谱的核心&#xff0c;存储经过提炼的知识&#xff0c;通常通过本体库来管理这一层</strong>&#xff08;本体库可以理解为面向对象里的“类”这样一个概念&#xff0c;本体库就储存着知识图谱的类&#xff09;。 数据层&#xff1a;<strong>存储真实的数据</strong>。 </p> <p>前面的内容说到了&#xff0c;知识图谱有<strong>自顶向下和自底向上两种构建方式</strong>&#xff0c;这里提到的构建技术主要是自底向上的构建技术</p> <p>如前所述&#xff0c;构建知识<strong>图谱是一个迭代更新的过程</strong>&#xff0c;根据知识获取的逻辑&#xff0c;每一轮迭代包含三个阶段&#xff1a;</p> <p><strong>信息抽取</strong>&#xff1a;从各种类型的数据源中提取出实体、属性以及实体间的相互关系&#xff0c;在此基础上形成本体化的知识表达。 <strong>知识融合</strong>&#xff1a;在获得新知识之后&#xff0c;需要对其进行整合&#xff0c;以消除矛盾和歧义&#xff0c;比如某些实体可能有多种表达&#xff0c;某个特定称谓也许对应于多个不同的实体等。 <strong>知识加工</strong>&#xff1a;对于经过融合的新知识&#xff0c;需要经过质量评估之后&#xff08;部分需要人工参与甄别&#xff09;&#xff0c;才能将合格的部分加入到知识库中&#xff0c;以确保知识库的质量。 </p> <p> 研究历史&#xff1a; ? <strong>人工构造语法和语义规则</strong>&#xff08;模式匹配&#xff09;。 ? 统计机器学习方法。 ? 基于特<strong>征向量或核函数的有监督</strong>学习方法。 ? 研究重点转向半监督和无监督。 ? 开始研<strong>究面向开放域的信息抽取</strong>方法。 ? 将面<strong>向开放域的信息抽取方法和面向封闭领域的</strong>传统方法结合。</p> <p>属性抽取的目标是<strong>从不同信息源中采集特定实体的属性信息</strong>&#xff0c;如针对某个公众人物&#xff0c;可以从网络公开信息中得到其昵称、<strong>生日、国籍、教育背景等信息</strong>。 研究历史&#xff1a; ? 将<strong>实体的属性视作实体与属性值之间的</strong>一种名词性关系&#xff0c;将属性抽取任务转化为关系抽取任务。 ? 基于<strong>规则和启发式算</strong>法&#xff0c;抽取结构化数据。 ? 基于<strong>百科类网站的半结构化数据&#xff0c;通过自动抽取生成训练语料&#xff0c;用于训练实体属性标注模型</strong>&#xff0c;然后将其应用于对非结构化数据的实体属性抽取。 ? 采用数<strong>据挖掘的方法直接从文本中挖掘实体属性和属性值之间的关系模式</strong>&#xff0c;据此实现对属性名和属性值在文本中的定位。</p> <p>通过信息抽取&#xff0c;我们就从<strong>原始的非结构化和半结构化数据中获取到了实体</strong>、关系以及实体的属性信息。如果我们将接下来的过程比喻成拼图的话&#xff0c;那么这些信息就是拼图碎片&#xff0c;散<strong>乱无章甚至还有从其他拼图里跑来的碎片、本身就是用来干扰我们拼图的错误碎片</strong>。</p> <p>也就是说**&#xff0c;拼图碎片&#xff08;信息&#xff09;之间的关系是扁平化的&#xff0c;缺乏层次性和逻辑性&#xff1b;拼图&#xff08;知识&#xff09;中还存在大量冗杂和错误的拼图碎片&#xff08;信息&#xff09;。那么如何解决这一问题&#xff0c;就是在知识融合<strong>这一步里我们需要做的了。 知识融合包括2部分内容</strong>&#xff1a;实体链接、知识合并**。</p> <p>实体链接&#xff08;【【淘密令】】&#xff09;是指对<strong>于从文本中抽取得到的实体对象</strong>&#xff0c;将其链<strong>接到知识库中对应的正确实体对象的操作</strong>。其基本思想是首<strong>先根据给定的实体指称项&#xff0c;从知识库中选出一组候选实体对象</strong>&#xff0c;然后通过相似度计算<strong>将指称项链接到正确的实体对象</strong>。 研究历史&#xff1a; ? 仅关注如何将<strong>从文本中抽取到的实体链接到知识库中&#xff0c;忽视了位于同一文档的实体间存在的语义联系</strong>&#xff1b; ? 开始关注利用<strong>实体的共现关系&#xff0c;同时将多个实体链接到知识库中。即集成实体链</strong>接&#xff08;【【淘密令】】【【微信】】&#xff09;。</p> <p> ? 实体消歧&#xff1a;是专门用于<strong>解决同名实体产生歧义问题的技术</strong>&#xff0c;通过实体消歧&#xff0c;就可以根据<strong>当前的语境&#xff0c;准确建立实体链接</strong>&#xff0c;实体消歧主要采用聚类法。其实也可以看做<strong>基于上下文的分类问题&#xff0c;类似于词性消歧和词义消歧</strong>。 ? 共指消解&#xff1a;主要用于<strong>解决多个指称对应同一实体对象的问题。在一次会话中&#xff0c;多个指称可能指向的是同一实体对象。利用共指消解技术&#xff0c;可以将这些指称项关联&#xff08;合并&#xff09;到正确的实体对象</strong>&#xff0c;由于该问题在信息检索和自然语言<strong>处理等领域具有特殊的重要性</strong>&#xff0c;吸引了大量的研究努力。共指消解还有一些其他的名字&#xff0c;比如对象<strong>对齐、实体匹配和实体同义</strong>。</p> <p>在前面的实体链接中&#xff0c;我们已经<strong>将实体链接到知识库中对应的正确实体对象那里去</strong>了&#xff0c;但需要注意的是&#xff0c;实体链接链接的是我<strong>们从半结构化数据和非结构化数据那里通过信息抽取提取出来的</strong>数据。</p> <p>那么除了半结构化数据和非结构化数据以外&#xff0c;我们还有个更方便的数据来源――<strong>―结构化数据&#xff0c;如外部知识库和关系数据库。对于这部分结构化数据的处理</strong>&#xff0c;就是我们知识融合的内容啦。</p> <p>一般来说知识融合主要分为两种&#xff1a;<strong>合并外部知识库&#xff0c;主要处理数据层和模式层的冲突</strong>&#xff1b;合并关系数据库&#xff0c;有RDB2RDF等方法。 </p> <p>经过刚才那一系列步骤&#xff0c;我们终于走到了知识加工这一步了&#xff01;在前面&#xff0c;我们已经通<strong>过信息抽取&#xff0c;从原始语料中提取出了实体、关系与属性等知识要素</strong>&#xff0c;并且经过知识融合&#xff0c;消除实体指称项与实体对象之间的歧义&#xff0c;得到一系列基本的事实表达。</p> <p>然而事实本身并不等于知识。要想最终获得结构化&#xff0c;网络化的知识体系&#xff0c;还需要经历知识加工的过程。知识加工主要包括3方面内容&#xff1a;<strong>本体抽取、知识推理和质量评估。</strong> </p> <p>本体&#xff08;ontology&#xff09;是指<strong>工人的概念集合、概念框架</strong>&#xff0c;如“人”、“事”、“物”等。本体可以<strong>采用人工编辑的方式</strong>手动构建&#xff08;借助本体编辑软件&#xff09;&#xff0c;也可以<strong>以数据驱动的自动化方式构建本体</strong>。因为人工方式工作量巨大&#xff0c;且很难找到符合要求的专家&#xff0c;因此当前主流的全局本体库产品&#xff0c;都是从一<strong>些面向特定领域的现有本体库出发&#xff0c;采用自动构建技术逐步扩展得到的</strong>。</p> <p>自动化本体构建过程包含三个阶段&#xff1a; <strong>实体并列关系相似度计算 → 实体上下位关系抽取 → 本体的生成</strong>。 </p> <p>在我们完成了本体构建这一步之后&#xff0c;一个知识图谱的雏形便已经搭建好了。但可能在这个时候&#xff0c;知识图谱之间大多数关系<strong>都是残缺的&#xff0c;缺失值非常严重</strong>&#xff0c;那么这个时候&#xff0c;我们就可以使<strong>用知识推理技术&#xff0c;去完成进一步的知识发现</strong>。 当然知识推理的对象也并不局限于实体间的关系&#xff0c;也可以是<strong>实体的属性值&#xff0c;本体的概念层次关系</strong>等。</p> <p><strong>推理属性值&#xff1a;已知某实体的生日属性</strong>&#xff0c;可以通过推理得到该实体的年龄属性&#xff1b; 推理概念&#xff1a;已知(老虎&#xff0c;科&#xff0c;猫科)和&#xff08;猫科&#xff0c;目&#xff0c;食肉目&#xff09;可以推出&#xff08;老虎&#xff0c;目&#xff0c;食肉目&#xff09; 这一块的算法主要可以分为3大类&#xff1a;<strong>基于知识表达的关系推理技术&#xff1b;基于概率图模型的关系推理技术路线示意图&#xff1b;基于深度学习的关系推理技术</strong>路线示意图。</p> <p>质量评估<strong>也是知识库构建技术的重要组成部</strong>分&#xff0c;这一部分存在的意义在于&#xff1a;可以对<strong>知识的可信度进</strong>行量化&#xff0c;通<strong>过舍弃置信度较低的知识来保障知识</strong>库的质量。</p> <br>..微信互助群2023免费进群二维码安全吗,微信互助群2023免费进群二维码安全吗,怎么查看淘宝助力,嗨!我们在2023年淘宝618 购物狂欢节淘宝助力任务平台里互助做任务,我觉得你也会喜欢。能不能请你加入我们的群?