加入收藏 | 设为首页 | 会员中心 | 我要投稿 李大同 (https://www.lidatong.com.cn/)- 科技、建站、经验、云计算、5G、大数据,站长网!
当前位置: 首页 > 综合聚焦 > 资源网站 > 资源 > 正文

nlp – 潜在Dirichlet分配与文档聚类之间的关系

发布时间:2020-12-14 16:35:48 所属栏目:资源 来源:网络整理
导读:我想澄清潜在的Dirichlet分配(LDA)与文档聚类的通用任务之间的关系. LDA分析倾向于输出每个文档的主题比例.如果我的理解是正确的,这不是文档聚类的直接结果.但是,我们可以将此概率比例视为每个文档的特征代表.之后,我们可以根据LDA分析生成的特征配置调用其
我想澄清潜在的Dirichlet分配(LDA)与文档聚类的通用任务之间的关系.

LDA分析倾向于输出每个文档的主题比例.如果我的理解是正确的,这不是文档聚类的直接结果.但是,我们可以将此概率比例视为每个文档的特征代表.之后,我们可以根据LDA分析生成的特征配置调用其他已建立的聚类方法.

我的理解是否正确?谢谢.

解决方法

是的,您可以将LDA的输出视为文档的功能;这正是Blei,Ng和Jordan在 paper that introduced LDA中所做的事情.他们这样做是为了分类,但对于聚类来说,程序是一样的.

(在机器学习术语中,LDA的这种使用被称为维数减少,因为它将特征空间的维数从| V |,词汇量大小减少到用户选择的某些k个主题.)

(编辑:李大同)

【声明】本站内容均来自网络,其相关言论仅代表作者个人观点,不代表本站立场。若无意侵犯到您的权利,请及时与联系站长删除相关内容!

    推荐文章
      热点阅读