• Complex
  • Title
  • Keyword
  • Abstract
  • Scholars
  • Journal
  • ISSN
  • Conference
搜索

Author:

蒋强荣 (蒋强荣.) | 宋烈金 (宋烈金.)

Indexed by:

CQVIP

Abstract:

在文本分类研究中,向量空间模型具有表示形式简单的特点,但只能表示特征词的词频信息而忽视了特征词间的结构信息和语义语序信息,所以可能导致不同文档被表示为相同向量.针对这种问题,本文采用图结构模型表示文本,把文本表示成一个有向图(简称文本图),可有效解决结构化信息缺失的问题.本文将图核技术应用于文本分类,提出适用于文本图之间的相似度计算的图核算法——间隔通路核,然后利用支持向量机对文本进行分类.在文本集上的实验结果表明:与向量空间模型相比,间隔通路核相比于其他核函数的分类准确率更高,所以间隔通路核是一种很好的图结构相似性计算算法,能广泛应用于文本分类中.

Keyword:

向量空间模型 文本分类 支持向量机 图结构 间隔通路核

Author Community:

  • [ 1 ] [蒋强荣]北京工业大学
  • [ 2 ] [宋烈金]北京工业大学

Reprint Author's Address:

Email:

Show more details

Related Keywords:

Related Article:

Source :

计算机与现代化

ISSN: 1006-2475

Year: 2017

Issue: 11

Page: 13-16,61

Cited Count:

WoS CC Cited Count: 0

SCOPUS Cited Count:

ESI Highly Cited Papers on the List: 0 Unfold All

WanFang Cited Count: 2

Chinese Cited Count:

30 Days PV: 17

Online/Total:312/10585889
Address:BJUT Library(100 Pingleyuan,Chaoyang District,Beijing 100124, China Post Code:100124) Contact Us:010-67392185
Copyright:BJUT Library Technical Support:Beijing Aegean Software Co., Ltd.