数据分享|R语言SVM支持向量机、文本挖掘新闻语料情感情绪分类和词云可视化
全文链接:http://tecdat.cn/?p=32032
支持向量机(SVM)是一种机器学习方法,基于结构风险最小化原则,即通过少量样本数据,得到尽可能多的样本数据(点击文末“阅读原文”获取完整代码数据)。
相关视频
支持向量机对线性问题进行处理,能解决非线性分类问题。本文介绍了R语言中的 SVM工具箱及其支持向量机(SVM)方法,并将其应用于文本情感分析领域,结果表明,该方法是有效的。在此基础上,对文本挖掘新闻语料进行情感分类和词云可视化,从视觉上对文本进行情感分析。
语料是从yahoo Qimo上爬的新闻语料,一共49000篇(查看文末了解数据免费获取方式),每篇包含题目、新闻内容、评论、读者投票结果(投票选择依次为:实用,感人、开心、超扯、无聊、害怕、难过、火大)以及总投票个数。
数据概览
以第一个预料为例
对其分词提取关键词
查看工作目录下所有的文件
获取分类号
词性分类
绘制词汇图
点击标题查阅往期内容
01
02
03
04
准备训练集和测试集
训练SVM
现在我们在训练集上使用来训练线性SVM
预测数据
预测的数据
查看分类混淆矩阵
数据获取
本文中分析的数据会员群,扫描下面二维码即可加群!
获取全文完整代码数据资料。
本文选自《R语言SVM支持向量机、文本挖掘新闻语料情感情绪分类和词云可视化》。
点击标题查阅往期内容
上一篇:原创三年级语文下册,学生正式学习新课前,先整体把握这些内容
下一篇:世界上最大的蝙蝠,飞行时宛如翼龙再现,现在仍是东南亚常见美食
最近更新成人教育
- 职业教育产教融合赋能提升
- 腾讯健康:联手迈瑞医疗助推行业高质量普惠发展
- 儿童友好|“红色传承”——金华市站前小学五年级秋季研学活动
- 考生、家长速看!云南省2024年高考11月5日起报名
- 巢湖市城乡公交线路优化调整 10月20日起实施
- 自贡自流井区:密切家校合作 家校共育连心桥
- 防拐骗、防暴力、防意外……武昌水果湖二小这样教学生自护自救
- 七险二金!云南省属国有企业招人啦
- 烟台市区七个口袋公园年底全部交付
- 24日至25日,北京南部、天津、河北中部局地可达重度霾
- 自考学位证申请的条件是什么?
- 投资160亿元!德欧中心四川
- 贵州税务:加计扣除优惠政策对支持我省企业投入研发、鼓励科技创新起到重要作用
- 高通骁龙 8cx Gen 4 处理器跑分曝光,多核成绩逼近苹果 M2
- 法律职业资格考试主观题考试益阳考区首次开考
- 初级会计证考试都是选择题吗?
- 大国粮仓装满优质粮
- 把课间还给学生,“圈养”并非长久之计
- 江门鹤山:“全链条”保障好“舌尖上的安全”
- 第十届晋江市中小学生“泉州南少林五祖拳健身操”会操比赛圆满落下帷幕
- 北京市开展2023年度公开遴选和公开选调公务员工作
- 防范电信网络诈骗共建平安和谐校园
- 台庆74周年,广东广播电视台开展中医药文化进社区公益活动
- 原创CBA前三轮排名!郭士强压制老东家,新疆上升8位,北控连败露底牌
- 50%职场人群多受腱鞘炎困扰 使用人体工学键鼠有助于预防腱鞘