您好,欢迎光临本网站![请登录][注册会员]  

搜索资源列表

  1. 一种面向科技项目文本的相似度度量方法

  2. 现有的文本相似度度量方法主要采用TF-IDF方法,把文本建模为词频向量,但未考虑文本的结构特征。现将文本的结构特征和TF-IDF方法进行融合,提出了一种面向科技项目文本的相似度度量方法。该方法首先对文本进行预处理,其次根据文本的结构特征提取模块文本,然后使用TF-IDF方法提取每个模块文本的TOP-N关键词, 作为模块文本的特征向量表示,最后使用余弦聚类计算文本的相似度。实验结果表明,在电力行业的科技项目文档数据集上,所提方法优于TF-IDF方法。
  3. 所属分类:其它

    • 发布日期:2020-10-15
    • 文件大小:49152
    • 提供者:weixin_38659248