重庆分公司,新征程启航
为企业提供网站建设、域名注册、服务器等服务
小编给大家分享一下cookie怎么在python爬虫中响应网页,希望大家阅读完这篇文章后大所收获,下面让我们一起去探讨吧!
成都创新互联长期为上千余家客户提供的网站建设服务,团队从业经验10年,关注不同地域、不同群体,并针对不同对象提供差异化的产品和服务;打造开放共赢平台,与合作伙伴共同营造健康的互联网生态环境。为吴川企业提供专业的成都网站建设、做网站,吴川网站改版等技术服务。拥有10余年丰富建站经验和众多成功案例,为您定制开发。Cookie,指某些网站为了辨别用户身份、进行session跟踪而储存在用户本地终端上的数据(通常经过加密)
比如说有些网站需要登录后才能访问某个页面,在登录之前,你想抓取某个页面内容是不允许的。那么我们可以利用Urllib2库保存我们登录的Cookie,然后再抓取其他页面就达到目的了。
从响应中获取cookie
我们就可以先访问该站的某个页,建立了session连接之后,获取cookie,再伪造头进行访问。
>>> from bs4Test import * >>> s = requests.session() >>> s.get("/tupian/20230522/BOListing.xhtml >>> print(s.cookies) # 下面是打印结果 , http://www.gebiz.gov.sg/>, http://www.gebiz.gov.sg/>]>
最后拼接cookie串
cook_value = '' for x in cook: cook_value += x.name + '=' + x.value + ';' cook_value = cook_value[:len(cook_value)-1] print(cook_value) #打印结果 __cfduid=d9ed16845e45ce7496268e8b2293dadc81456745242;BIGipServerPTN2_PRD_Pool=18964640.47873.0000;wlsessionid=nUIsyGBSLqjakq4P5dEDh5TNUJBYtw4nIpxkyITzrj2A5CalOWZ9!-936114045
看完了这篇文章,相信你对cookie怎么在python爬虫中响应网页有了一定的了解,想了解更多相关知识,欢迎关注创新互联行业资讯频道,感谢各位的阅读!