| |
|
开发:
C++知识库
Java知识库
JavaScript
Python
PHP知识库
人工智能
区块链
大数据
移动开发
嵌入式
开发工具
数据结构与算法
开发测试
游戏开发
网络协议
系统运维
教程: HTML教程 CSS教程 JavaScript教程 Go语言教程 JQuery教程 VUE教程 VUE3教程 Bootstrap教程 SQL数据库教程 C语言教程 C++教程 Java教程 Python教程 Python3教程 C#教程 数码: 电脑 笔记本 显卡 显示器 固态硬盘 硬盘 耳机 手机 iphone vivo oppo 小米 华为 单反 装机 图拉丁 |
-> 人工智能 -> 基于多级注意力融合机制的藏文实体关系抽取 -> 正文阅读 |
|
[人工智能]基于多级注意力融合机制的藏文实体关系抽取 |
【摘 要】与中英文相比,藏文实体关系训练语料规模较小,传统有监督的学习方法难以获得较高的准确率。针对基于远程监督的实体关系抽取存在错误标记的问题,利用远程监督方法将知识库与文本对齐,构建藏文实体关系抽取的数据集,提出一个基于多级注意力融合机制的藏文实体关系抽取模型。在词级别引入自注意力机制来提取单词的内部特征,在句子级别引入注意力机制为每个实例分配权重,从而充分利用包含信息的句子,减少噪声实例的权重。同时引入联合评分函数,修正远程监督的错误标签,并将神经网络与支持向量机结合,实现藏文实体关系分类。实验结果表明,提出的模型有效提高了藏文实体关系抽取的准确率,且优于基线模型效果。 【关键词】藏文 ; 实体关系抽取 ; 多级注意力融合机制 ; 支持向量机 1 引言实体关系抽取从无结构化文本中自动抽取实体对之间的语义关系,并构建结构化的知识,为知识图谱、问答系统等研究提供重要的支撑。相比于语料丰富的中英文领域,藏文实体关系训练语料规模较小,传统有监督的学习方法难以获得较高的准确率。为了解决训练语料不足的问题,Mintz M等人提出了利用远程监督自动生成训练语料的方法,其主要思想是对齐知识库和文本,将对齐后的句子构建成实体关系抽取的训练数据,并用其训练关系抽取器,预测文本中实体对之间的关系。 基于远程监督的方法可以为藏文实体关系抽取自动标注大规模的数据,然而,在远程监督方法中,假设对于知识库中的三元组<e1,r,e2>,文本中所有出现了实体e1和e2的句子都被认为是关系r的训练数据,这样会导致假设性太强,不可避免地出现错误标记的问题,影响实体关系抽取的准确率。 本文基于远程监督方法 |
|
|
上一篇文章 下一篇文章 查看所有文章 |
|
开发:
C++知识库
Java知识库
JavaScript
Python
PHP知识库
人工智能
区块链
大数据
移动开发
嵌入式
开发工具
数据结构与算法
开发测试
游戏开发
网络协议
系统运维
教程: HTML教程 CSS教程 JavaScript教程 Go语言教程 JQuery教程 VUE教程 VUE3教程 Bootstrap教程 SQL数据库教程 C语言教程 C++教程 Java教程 Python教程 Python3教程 C#教程 数码: 电脑 笔记本 显卡 显示器 固态硬盘 硬盘 耳机 手机 iphone vivo oppo 小米 华为 单反 装机 图拉丁 |
360图书馆 购物 三丰科技 阅读网 日历 万年历 2024年11日历 | -2024/11/25 20:35:04- |
|
网站联系: qq:121756557 email:121756557@qq.com IT数码 |