基于MDL聚类的无导词义消歧

被引:2
作者
陈浩 [1 ]
何婷婷 [1 ]
姬东鸿 [2 ]
机构
[1] 华中师范大学计算机科学系
[2] 新加坡信息通讯研究所
关键词
词义消歧; hownet; 二阶上下文,MDL;
D O I
暂无
中图分类号
TP391.1 [文字信息处理];
学科分类号
摘要
无导词义消歧避免了人工词义标注的巨大工作量,可以适应大规模的多义词消歧工作,具有广阔的应用前景.提出了 一种无导词义消歧的方法.该方法以hownet词库为词典,采用二阶上下文构造上下文向量,使用MDL算法进行聚类,最后通 过计算相似度来进行词义的排歧.实验是在抽取术语的基础上进行的,在8个汉语高频多义词的测试中取得了平均准确率81. 12%的较好的效果.
引用
收藏
页码:1846 / 1849
页数:4
相关论文
共 3 条
[1]   基于MDL原理与混合遗传算法的Bayesian网络结构学习 [J].
彭青松 ;
张佑生 ;
汪荣贵 ;
钱隆 ;
骆祥峰 .
微电子学与计算机, 2002, (07) :27-29
[2]   基于向量空间模型中义项词语的无导词义消歧 [J].
鲁松 ;
白硕 ;
黄雄 .
软件学报, 2002, (06) :1082-1089
[3]   基于向量空间模型的有导词义消歧 [J].
鲁松 ;
白硕 ;
黄雄 ;
张健 .
计算机研究与发展, 2001, (06) :662-667