自然语言处理包括机器翻译、自然语言理解、语音自动识别与合成、文字自动识别、计算机辅助教学、信息检索、文本自动分类、自动文摘,还有文本中的信息提取、互联网上的智能搜索,以及各种电子词典和术语数据库的处理。应用在图谱系统中是知识抽取和知识挖掘的重要支撑。
在系统中应用自然语言处理,通过将字典导入处理系统,进行机器学习,摘取新闻、电子文档、数据库等资料中的关键词及指向内容,并通过NPL算法自动识别,对数据进行标注和匹配字典的规范格式,形成和原有数据相同的特性,自动导入图数据库中。
目前开发遇到如下瓶颈
(1)模式匹配技术。
(2)语法驱动的分析技术。
(3)格框架约束分析技术。