网站建设 >

查看其它板块

怎么在Python3使用正则表达式爬取数据-创新互联

这篇文章给大家介绍怎么在Python3使用正则表达式爬取数据，内容非常详细，感兴趣的小伙伴们可以参考借鉴，希望对大家能有所帮助。

做网站、网站建设介绍好的网站是理念、设计和技术的结合。成都创新互联拥有的网站设计理念、多方位的设计风格、经验丰富的设计团队。提供PC端+手机端网站建设，用营销思维进行网站设计、采用先进技术开源代码、注重用户体验与SEO基础，将技术与创意整合到网站之中，以契合客户的方式做到创意性的视觉化效果。

代码如下：

# -*- coding:utf-8 -*-
from urllib import request as urllib2
import re
# 利用正则表达式爬取内涵段子
url = r'http://www.neihanpa.com/article/list_5_{}.html'
headers = {
  'User-Agent':'Mozilla/5.0 (Windows NT 10.0; Win64; x64; rv:57.0) Gecko/20100101 Firefox/57.0',
}
file_name = '内涵段子.txt'
for page in range(2):
# 2表示页数，可以自行调整
  fullurl = url.format(str(page+1))
  request = urllib2.Request(url=fullurl, headers=headers)
  response = urllib2.urlopen(request)
  html = response.read().decode('gbk')
  # re.S 如果没有re.S 则是只匹配一行有没有符合规则的字符串，如果没有则下一行重新匹配
  # 如果加上re.S 则是将所有的字符串作为一个整体进行匹配
  pattern = re.compile(r'(.*?)

',re.S) duanzis = pattern.findall(html) for duanzi in duanzis: duanzi = duanzi.replace('

','').replace('

','').replace('','\n').replace('“','').replace('&rdquo','').replace('…','') try: # 将爬取的段子写入文件 file = open(file_name,'a',encoding='utf-8') file.write('\n'.join(duanzi.split())) file.close() except OSError as e: print(e)

关于怎么在Python3使用正则表达式爬取数据就分享到这里了，希望以上内容可以对大家有一定的帮助，可以学到更多知识。如果觉得文章不错，可以把它分享出去让更多的人看到。

新闻标题：怎么在Python3使用正则表达式爬取数据-创新互联
网站路径：http://cdkjz.cn/article/dpcdhe.html

返回首页了解更多建站资讯

多年建站经验

多一份参考，总有益处

联系快上网，免费获得专属《策划方案》及报价

咨询相关问题或预约面谈，可以通过以下方式与我们联系

大客户专线成都：13518219792 座机：028-86922220

在线咨询提交需求

友情链接交换友情链接

卡多尼人工智普能电气成都网站推广梓潼网站制作公司中国电信西部信息中心机房手机网站制作消防工程域名注册成都品牌网站建设门店招牌设计安装

成都网站建设公司地址：成都市青羊区太升南路288号锦天国际A座10层建设咨询028-86922220

专家团队为您提供成都网站建设,成都网站设计,成都品牌网站设计,成都营销型网站制作等服务,成都建网站就找快上网！ | 成都网站建设哪家好？ | 网站建设地图

网站建设

网站推广

案例

方案

电商网站开发

微信小程序

我们

联系

精准传达 • 有效沟通

查看其它板块

怎么在Python3使用正则表达式爬取数据-创新互联

多一份参考，总有益处

联系快上网，免费获得专属《策划方案》及报价

大客户专线成都：13518219792 座机：028-86922220

友情链接交换友情链接

网络推广

Network promotion

网站方案

Solution

电商网站开发

E-commerce & System

我们

About Us

联系

Contact Us

精准传达 • 有效沟通

查看其它板块

怎么在Python3使用正则表达式爬取数据-创新互联

相关资讯

东方甄选将首次启动自有App直播

seo简单吗?新手能快速学会seo技术吗?

企业建站域名怎么选?建站域名选择四原则

.vip域名怎么样.vip域名注册价值大不大

如果做好一名SEOSEO优化得有这几点觉悟

域名和网址是什么关系？有什么区别？

LG当众质疑三星怎么回事？LG当众质疑三星什么缘由？

什么是云服务器？云服务器概念如何解读？

多一份参考，总有益处

联系快上网，免费获得专属《策划方案》及报价

大客户专线 成都：13518219792 座机：028-86922220

友情链接 交换友情链接

大客户专线成都：13518219792 座机：028-86922220

友情链接交换友情链接