首页软件开发代码讲解 Python 正文

我要投稿

基于python实现获取网页图片过程解析

自学编程网 Python

2020-09-29 0 445

环境：python3，要安装bs4这个第三方库

获取请求头的方法

这里使用的是Chrome浏览器。

打开你想查询的网站，按F12，或者鼠标右键一下选择检查。会弹出如下的审查元素页面：

基于python实现获取网页图片过程解析

然后点击上方选项中的Network选项：

基于python实现获取网页图片过程解析

此时在按Ctrl+R:

基于python实现获取网页图片过程解析

选择下方框中的第一个，单击：

基于python实现获取网页图片过程解析

选择Headers选项，其中就会有Request Headers，包括你需要的信息。

介绍：这个程序是用来批量获取网页的图片，用于新手入门

注意：由于是入门的程序在获取某些网页的图片时会出问题！！！！！

import os
import urllib.request
from bs4 import BeautifulSoup
# 网址
url = \"http://www2017.tyut.edu.cn/\"
# 建立请求对象
request = urllib.request.Request(url)
# 加入请求头（一定要换成自己的！！！！）
request.add_header(\'User-Agent\', \'Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/81.0.4044.138 Safari/537.36\')
# 获取请求
code = urllib.request.urlopen(request)
# 得到html代码
html = code.read().decode(\'utf-8\')
# 将html的标签转成对象（方便后面的操作）
bs = BeautifulSoup(html, \'html.parser\')
# 提取所有的img标签
imagesUrl = bs.find_all(\'img\')
sources = []
# 建立存放的路径（路径一定要存在！！！！！！）
filepath = os.getcwd() + \'\\\\images\\\\\'
def createFile(path: str, fpath):
  urllib.request.urlretrieve(path, fpath)
# 获取图片的路径(网址+img标签的src属性的值)
for img in imagesUrl:
  sources.append(url + str(img.get(\'src\')))
for src in sources:
  # 用split是防止请求带参
  baseName = os.path.basename(src).split(\'?\')
  # 图片名
  fileName = filepath + baseName[0]
  print(\"url=\" + src, \"filename=\" + fileName)
  createFile(src, fileName)
print(\'这次您一共下载了图片\' + str(len(sources)) + \'张\')

以上就是本文的全部内容，希望对大家的学习有所帮助，也希望大家多多支持自学编程网。

收藏 (0) 点赞 (0)

遇见资源网 Python 基于python实现获取网页图片过程解析 http://www.ox520.com/25564.html

Python 网页图片获取

自学编程网

解决python虚拟环境切换无效的问题

上一篇：解决python虚拟环境切换无效的问题

python中有函数重载吗

下一篇： python中有函数重载吗

常见问题

相关文章

python利用socket实现udp文件传输功能

python利用socket实现udp文件传输功能

Python

自学编程网

2年前 325

Python实现批量压缩文件/文件夹zipfile的使用

Python实现批量压缩文件/文件夹zipfile的使用

Python

自学编程网

2年前 542

python实现TCP文件接收发送

python实现TCP文件接收发送

Python

自学编程网

2年前 718

Python使用turtle模块绘制爱心图案

Python使用turtle模块绘制爱心图案

Python

自学编程网

2年前 388

猜你喜欢

python利用socket实现udp文件传输功能 2023-01-31
Python实现批量压缩文件/文件夹zipfile的使用 2023-01-31
python实现TCP文件接收发送 2023-01-31
Python使用turtle模块绘制爱心图案 2023-01-13
浅谈Python的字典键名可以是哪些类型 2023-01-13
Python日期时间模块arrow的具体使用 2023-01-13
python利用Appium实现自动控制移动设备并提取数据功能 2023-01-13
python用folium绘制地图并设置弹窗效果 2023-01-13
Python 面向对象编程的三大特性之继承 2023-01-13
利用Python快速绘制海报地图 2023-01-13

发表评论

暂无评论

官方客服团队

为您解决烦忧 - 24小时在线专业服务

联系官方团队在线提交工单

自学编程网

QQ 微信

微博

9875
文章
5,524,953
浏览
收藏
0
评论
23133
标签
19
分类

进主页

TA的动态

2023-03-16 一篇文章带你了解如何正确使用java线程池
2023-03-16 JAVA jvm系列--java内存区域
2023-03-16 JAVA代码块你了解吗
2023-03-16 超详细讲解Java线程池
2023-03-16 java Long类型转为String类型的两种方式及区别说明

总裁主题

分享最新WordPress教程共同学习，共同进步，共同成长！

热门文章

热门评论

如遇问题，请联系客服
联系客服请注明来意高端主题开发
微信公众号

总裁主题·高端主题
返回顶部