网站建设 >

查看其它板块

python爬虫中ip代理池如何使用

这篇文章给大家分享的是有关python爬虫中ip代理池如何使用的内容。小编觉得挺实用的，因此分享给大家做个参考，一起跟随小编过来看看吧。

耿马网站制作公司哪家好，找创新互联公司！从网页设计、网站建设、微信开发、APP开发、响应式网站开发等网站项目制作，到程序开发，运营维护。创新互联公司从2013年成立到现在10年的时间，我们拥有了丰富的建站经验和运维经验，来保证我们的工作的顺利进行。专注于网站建设就选创新互联公司。

说明

1、利用for循环爬取所有代理IP。查看网页源代码，发现所有的IP和端口都在第二和第三个td下，结合BeautifulSoup可以方便地抓取信息。

2、检查IP的可用程度。IP是否可用，取决于连接代理后2秒内是否可以打开页面。

如果可以，认为IP是可用的，添加到list中备用。

实例

import urllib2
from bs4 import BeautifulSoup
import csv
 
 
 
 
def IPspider(numpage):
    csvfile = file('ips.csv', 'wb')  
    writer = csv.writer(csvfile)
    url='http://www.xicidaili.com/nn/'
    user_agent='IP'
    headers={'User-agent':user_agent}
    for num in xrange(1,numpage+1):
        ipurl=url+str(num)
        print 'Now downloading the '+str(num*100)+' ips'
        request=urllib2.Request(ipurl,headers=headers)
        content=urllib2.urlopen(request).read()
        bs=BeautifulSoup(content,'html.parser')
        res=bs.find_all('tr')
        for item in res:
            try:
                temp=[]
                tds=item.find_all('td')
                temp.append(tds[1].text.encode('utf-8'))
                temp.append(tds[2].text.encode('utf-8'))
                writer.writerow(temp)
            except IndexError:
                    pass
            
#假设爬取前十页所有的IP和端口
IPspider(10)

感谢各位的阅读！关于“python爬虫中ip代理池如何使用”这篇文章就分享到这里了，希望以上内容可以对大家有一定的帮助，让大家可以学到更多知识，如果觉得文章不错，可以把它分享出去让更多的人看到吧！

文章题目：python爬虫中ip代理池如何使用
文章来源：http://cdkjz.cn/article/pohpcp.html

返回首页了解更多建站资讯

多年建站经验

多一份参考，总有益处

联系快上网，免费获得专属《策划方案》及报价

咨询相关问题或预约面谈，可以通过以下方式与我们联系

大客户专线成都：13518219792 座机：028-86922220

在线咨询提交需求

友情链接交换友情链接

高防服务器租用成都企业网站建设公司网站收录重庆小程序开发公司成都制作网站成都网站推广公司成都小程序开发重庆外贸网站建设网站SEO优化网站ssl证书

成都网站建设公司地址：成都市青羊区太升南路288号锦天国际A座10层建设咨询028-86922220

专家团队为您提供成都网站建设,成都网站设计,成都品牌网站设计,成都营销型网站制作等服务,成都建网站就找快上网！ | 成都网站建设哪家好？ | 网站建设地图

网站建设

网站推广

案例

方案

电商网站开发

微信小程序

我们

联系

精准传达 • 有效沟通

查看其它板块

python爬虫中ip代理池如何使用

多一份参考，总有益处

联系快上网，免费获得专属《策划方案》及报价

大客户专线成都：13518219792 座机：028-86922220

友情链接交换友情链接

网络推广

Network promotion

网站方案

Solution

电商网站开发

E-commerce & System

我们

About Us

联系

Contact Us

精准传达 • 有效沟通

查看其它板块

python爬虫中ip代理池如何使用

相关资讯

帝国cms开启投稿 帝国cms开启投稿 安全吗

手动输入java的代码 手动输入java的代码有哪些

腾讯云服务器学生国外 腾讯云国外服务器需要备案吗

mysql怎么让数据唯一 mysql 设置唯一索引

wordpress缩略 wordpress缩略图为原图

服务器一般装什么系统安全 服务器一般装什么系统安全好

vb.net等于 vbnet single

vb.net窗体界面开发 vbs窗体

多一份参考，总有益处

联系快上网，免费获得专属《策划方案》及报价

大客户专线 成都：13518219792 座机：028-86922220

友情链接 交换友情链接

帝国cms开启投稿帝国cms开启投稿安全吗

手动输入java的代码手动输入java的代码有哪些

腾讯云服务器学生国外腾讯云国外服务器需要备案吗

服务器一般装什么系统安全服务器一般装什么系统安全好

大客户专线成都：13518219792 座机：028-86922220

友情链接交换友情链接