
基于三种模型的同义词提取:实现HTTP中描述的算法
5星
- 浏览量: 0
- 大小:None
- 文件类型:None
简介:
本文探讨了在HTTP框架下,通过三种不同的模型来实现同义词抽取的算法。文中详细描述了每种方法的具体实施步骤和实验结果,并分析比较它们的效果与效率。
使用三种模型进行同义词提取的实现描述如下:
1. 使用Wordnet生成22000个同义词、2000个反义词以及80000个不相关的词语。
2. 训练单词向量,每个单词映射到一个50维的向量中。
3. 生成训练数据:将每对同义词标记为1,将每对抗义词或无关词标记为-1。对于每一对词语,特征维度为250维,由x1、x2、x1*x2、|x1-x2|和x1+x2的组合构成。
4. 将数据集划分为训练集和测试集,其中33%的数据用于训练,67%的数据用于测试。
全部评论 (0)
还没有任何评论哟~


