1. 首页
  2. 编程语言
  3. 其他
  4. 论文研究基于PTM潜在Dirichlet分配的少量标记样本文本分类.pdf

论文研究基于PTM潜在Dirichlet分配的少量标记样本文本分类.pdf

上传者: 2020-02-14 05:46:23上传 UNKONW文件 1011KB 热度 19次
针对现实文本分类环境下通常仅有少量标记样本而影响分类精度的问题,提出了一种基于概率主题模型潜在Dirichlet分配的分类算法。借助标准词频逆文档频率函数将每个文档表示成术语权重向量;利用概率主题模型预处理以简化文档,并从文档中提取术语;再利用潜在Dirichlet分配模型进行关系学习,构建基于图的分类器完成分类。在公开的Reuters-21578资源库上的分类实验评估了该方法的有效性,相比分类效果较好的支持向量机,该方法在大部分情况下能够取得更高的分类精度。
下载地址
用户评论