您好,欢迎访问北京市农林科学院 机构知识库!

基于BERT的多特征融合农业命名实体识别

文献类型: 中文期刊

作者: 赵鹏飞 1 ; 赵春江 1 ; 吴华瑞 2 ; 王维 2 ;

作者机构: 1.山西农业大学工学院

2.国家农业信息化工程技术研究中心

关键词: 农业;命名实体识别;文本;BERT;词典特征;BiLSTM

期刊名称: 农业工程学报

ISSN: 1002-6819

年卷期: 2022 年 38 卷 003 期

页码: 112-118

收录情况: EI ; 北大核心 ; CSCD

摘要: 命名实体识别是农业文本信息抽取的重要环节,针对实体识别过程中局部上下文特征缺失、字向量表征单一、罕见实体识别率低等问题,提出一种融合BERT(Bidirectional Encoder Representations from Transformers,转换器的双向编码器表征量)字级特征与外部词典特征的命名实体识别方法.通过BERT预训练模型,融合左右两侧语境信息,增强字的语义表示,缓解一词多义的问题;自建农业领域词典,引入双向最大匹配策略,获取分布式词典特征表示,提高模型对罕见或未知实体的识别准确率;利用双向长短时记忆(Bi-directional Long-short Term Memory,BiLSTM)网络获取序列特征矩阵,并通过条件随机场(Conditional Random Field,CRF)模型生成全局最优序列.结合领域专家知识,构建农业语料集,包含5295条标注语料,5类农业实体.模型在语料集上准确率为94.84%、召回率为95.23%、F1值为95.03%.研究结果表明,该方法能够有效识别农业领域命名实体,识别精准度优于其他模型,具有明显的优势.

  • 相关文献
作者其他论文 更多>>