基于Markov的概念自动抽取算法
来源期刊:软件工程2013年第10期
论文作者:宋元海
文章页码:31 - 61
关键词:马尔克夫;概念;转移概率;概念抽取;规则;
摘 要:提出了一种概念自动抽取算法,该算法的目的是从英文文本中抽取出由多个单词组成的概念。文中首先证明了概念的抽取过程是一个多个状态的齐次Markov链,然后给出了具体的抽取过程,即,如果多步转移概率达到所给定的阈值,则将这多个状态,即多个单词,看作是一个概念。为了对算法进行性能测试,借助网络爬虫,从网络中获取有关计算机领域的文本文档,采用本文算法进行概念抽取,结果显示该算法优于其他算法。
宋元海
兖州矿区职工大学
摘 要:提出了一种概念自动抽取算法,该算法的目的是从英文文本中抽取出由多个单词组成的概念。文中首先证明了概念的抽取过程是一个多个状态的齐次Markov链,然后给出了具体的抽取过程,即,如果多步转移概率达到所给定的阈值,则将这多个状态,即多个单词,看作是一个概念。为了对算法进行性能测试,借助网络爬虫,从网络中获取有关计算机领域的文本文档,采用本文算法进行概念抽取,结果显示该算法优于其他算法。
关键词:马尔克夫;概念;转移概率;概念抽取;规则;