X为了获得更好的用户体验,请使用火狐、谷歌、360浏览器极速模式或IE8及以上版本的浏览器
帮助中心 | 关于我们
欢迎来到辽阳市科技创新服务平台,请 登录 | 注册
尊敬的 , 欢迎光临!  [会员中心]  [退出登录]
当前位置: 首页 >  科技成果  > 详细页

[00251690]一种基于词袋模型的文本表示的处理方法

交易价格: 面议

所属行业: 其他电子信息

类型: 发明专利

技术成熟度: 正在研发

专利所属地:中国

专利号:CN201710569638.0

交易方式: 技术转让 技术转让 技术入股

联系人: 科小易

进入空间

所在地:福建厦门市

服务承诺
产权明晰
资料保密
对所交付的所有资料进行保密
如实描述
|
收藏
|

技术详细介绍

本发明属于计算机应用领域,公开了一种基于词袋模型的文本表示的处理方法,本方法对采集到的文本数据集进行分词,去停顿词,去低频词,特征选择等处理过程;然后运用空间向量模型表示处理后的文本;同时对处理后的文本运用神经网络的方法训练词向量;根据词向量的相似性修改词袋模型的特征词的权重,得到新的文本表示模型。用以处理文本表示问题,提高了分类的准确性。
本发明属于计算机应用领域,公开了一种基于词袋模型的文本表示的处理方法,本方法对采集到的文本数据集进行分词,去停顿词,去低频词,特征选择等处理过程;然后运用空间向量模型表示处理后的文本;同时对处理后的文本运用神经网络的方法训练词向量;根据词向量的相似性修改词袋模型的特征词的权重,得到新的文本表示模型。用以处理文本表示问题,提高了分类的准确性。

推荐服务:

主办单位:辽阳市科学技术局

技术支持单位:科易网

辽ICP备16017206号-1

辽公网安备 21100302203138号

关于我们

平台简介

联系我们

客服咨询

400-649-1633

工作日:08:30-21:00

节假日:08:30-12:00

13:30-17:30