Python练习——短评爬虫-词云-数据整理
发布时间
阅读量:
阅读量
环境
import requests # 爬取网页
from bs4 import BeautifulSoup # 清洗网页
import jieba # 中文分词
import matplotlib.pyplot as plt # 绘图
from wordcloud import WordCloud,ImageColorGenerator # 创建词云
from gensim.models import Word2Vec # 分词结果向量化
流程图

源码,只展示了核心代码,每个脚本都是独立的
通过爬取豆瓣平台的内容,可获取电影短评信息,具体操作为爬取前十页的评论数据(由于未登录状态存在访问限制,因此仅能获取前十页内容,总字数超过九千字)。
import requests
from bs4 import Beautifu
全部评论 (0)
还没有任何评论哟~
