ICode9

精准搜索请尝试: 精确搜索
首页 > 其他分享> 文章详细

R语言文本分析

2022-02-24 00:00:52  阅读:241  来源: 互联网

标签:分析 语言 library 来源于 html 文本


R code来源于政府报告词云图[1]

分析的网络文本来源于政府工作报告(文字实录)[2]

R语言分析如下:

library(jiebaR)
library(tidyverse)
library(rvest)
library(wordcloud2)

url <- "http://www.gov.cn/premier/2020-05/22/content_5513757.htm"
text <- url %>%
  read_html(encoding="utf-8") %>%
  html_nodes("div.pages_content") %>%
  html_text()

stopwords_CN <- c("被","怎么","还是","多少","得", "吗","给",
                  "年","月","还","个","能", "日","什么","做","没","啊",
                  "的", "了", "在", "是", "我", "有", "和", "就","不",
                  "人", "都", "一", "一个", "上", "也", "很", "到", "说",
                  "要", "去", "你","会", "着", 

标签:分析,语言,library,来源于,html,文本
来源: https://blog.csdn.net/Mrrunsen/article/details/123102111

本站声明: 1. iCode9 技术分享网(下文简称本站)提供的所有内容,仅供技术学习、探讨和分享;
2. 关于本站的所有留言、评论、转载及引用,纯属内容发起人的个人观点,与本站观点和立场无关;
3. 关于本站的所有言论和文字,纯属内容发起人的个人观点,与本站观点和立场无关;
4. 本站文章均是网友提供,不完全保证技术分享内容的完整性、准确性、时效性、风险性和版权归属;如您发现该文章侵犯了您的权益,可联系我们第一时间进行删除;
5. 本站为非盈利性的个人网站,所有内容不会用来进行牟利,也不会利用任何形式的广告来间接获益,纯粹是为了广大技术爱好者提供技术内容和技术思想的分享性交流网站。

专注分享技术,共同学习,共同进步。侵权联系[81616952@qq.com]

Copyright (C)ICode9.com, All Rights Reserved.

ICode9版权所有