Python自学课程内容:第20次课程 - 爬取东方财富网股票数据(用Python编写爬虫)
发布时间
阅读量:
阅读量
两天前,我掌握了正则表达式以及网页抓取技术的基础知识,并将其与之前在UI界面设计中积累的知识经验相结合,开发了一个用于股票数据查询的小工具。然而目前仍不具备数据分析功能;最初尝试使用了在一些网络资源中获取的网址链接(如http://quote.eastmoney.com/stocklist.html),用于进行股票信息的采集工作。
import re
import urllib
import urllib.request
def getpage(path):
data=urllib.request.urlopen(path).read().decode('utf-8')
return data
#find没有括号抓取全部,有括号抓取括号内,内容有括号转义字符\( \)
def getcode(data):
regex_str="<li><a href=\"list,([6|9]\d{5}).html\">"
#regex_str="<li><a href=\"list,hk([0-9]\d{4}).html\">\D\d{5}\D(.*?)<"
pat=re.compile(regex_str) #预编译
codelist=pat.findall(data)
ret
全部评论 (0)
还没有任何评论哟~
