从品牌网站建设到网络营销策划,从策略到执行的一站式服务
这篇文章主要讲解了“怎么利用Python爬取网页内容”,文中的讲解内容简单清晰,易于学习与理解,下面请大家跟着小编的思路慢慢深入,一起来研究和学习“怎么利用Python爬取网页内容”吧!
公司专注于为企业提供成都网站制作、成都网站设计、微信公众号开发、商城开发,微信平台小程序开发,软件定制网站设计等一站式互联网企业服务。凭借多年丰富的经验,我们会仔细了解各客户的需求而做出多方面的分析、设计、整合,为客户设计出具风格及创意性的商业解决方案,成都创新互联更提供一系列网站制作和网站推广的服务。
编写执行代码
首先,你要安装requests和BeautifulSoup4,然后执行如下代码. import requests from bs4 import BeautifulSoup iurl = 'http://news.sina.com.cn/c/nd/2017-08-03/doc-ifyitapp0128744.shtml' res = requests.get(iurl) res.encoding = 'utf-8' #print(len(res.text)) soup = BeautifulSoup(res.text,'html.parser') #标题 H1 = soup.select('#artibodyTitle')[0].text #来源 time_source = soup.select('.time-source')[0].text #来源 origin = soup.select('#artibody p')[0].text.strip() #原标题 oriTitle = soup.select('#artibody p')[1].text.strip() #内容 raw_content = soup.select('#artibody p')[2:19] content = [] for paragraph in raw_content: content.append(paragraph.text.strip()) '@'.join(content) #责任编辑 ae = soup.select('.article-editor')[0].text
感谢各位的阅读,以上就是“怎么利用Python爬取网页内容”的内容了,经过本文的学习后,相信大家对怎么利用Python爬取网页内容这一问题有了更深刻的体会,具体使用情况还需要大家实践验证。这里是创新互联,小编将为大家推送更多相关知识点的文章,欢迎关注!
成都网站建设公司地址:成都市青羊区太升南路288号锦天国际A座10层 建设咨询028-86922220
成都快上网科技有限公司-四川网站建设设计公司 | 蜀ICP备19037934号 Copyright 2020,ALL Rights Reserved cdkjz.cn | 成都网站建设 | © Copyright 2020版权所有.
专家团队为您提供成都网站建设,成都网站设计,成都品牌网站设计,成都营销型网站制作等服务,成都建网站就找快上网! | 成都网站建设哪家好? | 网站建设地图