Python爬虫之BeautifulSoup和requests的使用
2018-06-18 03:29:06来源:未知 阅读 ()
requests,Python HTTP 请求库,相当于 Android 的 Retrofit,它的功能包括 Keep-Alive 和连接池、Cookie 持久化、内容自动解压、HTTP 代理、SSL 认证、连接超时、Session 等很多特性,同时兼容 Python2 和 Python3。
第三方库的安装:
pip install urllib
pip install requests
小爬虫代码如下:
# -* - coding: UTF-8 -* -
#导入第三方库
import urllib
from bs4 import BeautifulSoup
import requests
url='https://www.phb123.com/junshi/lishi/9679_2.html'
local="E:\\py\\imgs\\" #保存图片的文件夹
html_doc=requests.get(url).text
soup=BeautifulSoup(html_doc,'lxml') #解析 html_doc
contens=soup.find_all('center')
x=1
for con in contens:
imgs=con.find_all('img') #获取center标签下的img标签
for img in imgs:
urllib.request.urlretrieve(img['src'], local + '%s.jpg' % (x))
x =x+1
标签:
版权申明:本站文章部分自网络,如有侵权,请联系:west999com@outlook.com
特别注意:本站所有转载文章言论不代表本站观点,本站所提供的摄影照片,插画,设计作品,如需使用,请与原作者联系,版权归原作者所有
- python3基础之“术语表(2)” 2019-08-13
- python3 之 字符串编码小结(Unicode、utf-8、gbk、gb2312等 2019-08-13
- Python3安装impala 2019-08-13
- 小白如何入门 Python 爬虫? 2019-08-13
- python_字符串方法 2019-08-13
IDC资讯: 主机资讯 注册资讯 托管资讯 vps资讯 网站建设
网站运营: 建站经验 策划盈利 搜索优化 网站推广 免费资源
网络编程: Asp.Net编程 Asp编程 Php编程 Xml编程 Access Mssql Mysql 其它
服务器技术: Web服务器 Ftp服务器 Mail服务器 Dns服务器 安全防护
软件技巧: 其它软件 Word Excel Powerpoint Ghost Vista QQ空间 QQ FlashGet 迅雷
网页制作: FrontPages Dreamweaver Javascript css photoshop fireworks Flash