Advertisement

Python研究四大名著(一)

阅读量:

项目起因及意义

最初,在知乎上看到一篇内容引人入胜的文章。([用Python分析《红楼梦》](https://zhuanlan.zhuishu.com/p/29209681?utm_source=qq&utm_medium=social))这篇内容较为冗长。文章主要采用了若干方法来探讨红楼前后部分是否由同一作者完成。尽管文章配上了部分代码片段。我也萌生了亲自尝试的想法。但目前我的知识储备和实践经验尚显不足……加上刚学Python……所以打算先参考该书中关于《三国演义》的人物出场统计实例来进行实践。

前期准备

在《三国》的故事中涉及的人物众多,在对这些角色的行为模式进行分析时需要对人物出场次数进行统计。对于中文文本进行词频分析时必须先完成分词处理,在这里我们将使用jieba这个第三方Python库来辅助处理。关于下载方式的具体说明超出了当前讨论范围,《三国演义》的数字化版本通常可以通过网络平台获取,并且操作简便。

项目进行

  1. 将文本数据导入pycharm
复制代码
    import jieba
    txt = open("三国演义.txt", "r", encoding="gb18030").read()

![这里写图片描述](https://ad.itadn.com/c/weblog/blog-img/images/2

全部评论 (0)

还没有任何评论哟~