Pythonpython 采集斗图啦xpathimport requests; import re; import os; import parsel; # 1.请求网页 header = { "user-agent":'Mozilla/5.0 (Macintosh; Intel Mac OS X 10_15_5) AppleWebKit/537.36 (KHTML, like Gecko) Chrom作者王明昌发布时间2020-07-29复制import requests; import re; import os; import parsel; # 1.请求网页 header = { "user-agent":'Mozilla/5.0 (Macintosh; Intel Mac OS X 10_15_5) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/69.0.3497.100 Safari/537.36' } response = requests.get('https://www.doutula.com/photo/list/',headers=header) html = response.text # 2.解析网页 selector = parsel.Selector(html) # print(selector) dir_name = 'doutu_list' if not os.path.exists(dir_name): os.mkdir(dir_name) result_list = selector.xpath('//a[@class="col-xs-6 col-sm-3"]') for result in result_list: title = result.xpath('./img/@alt').get() img_url = result.xpath('./img/@data-original').get() ext = img_url.split('.')[-1] file_name = title+'.'+ext print(title,img_url) # 保存 response = requests.get(img_url,headers=header) with open(dir_name+'/'+file_name,'wb') as f: f.write(response.content)
2019-10-05python request模块sign token获取不到可测试手机端 百度翻译(案例) import requests header = { 'user-agent': 'Mozilla/5.0 (Linux; Android
2019-10-05python 案例itchat 查看手机微信中用户比例 import itchat import pandas as pd # Python抓取微信好友数量、性别、城市分布,以及将py文件打包成exe. #https:
2019-10-05python连接mysql数据库安装 安装 pip3 install pymysql python3 import pymysql python2 import MySQLdb 操作sql 增 import pymysql conn
2019-10-05python 通用爬虫(百度贴吧)import requests class TiebaSpider(): def __init__(self,tieba_name): self.tieba_name = tieba_name pri
2018-12-25Python | 从零学习pythonmac下载/安装环境 https://www.python.org/downloads/release/python-372/ 测试是否安装(命令行) python3 //mac自带python2 出
2020-07-29python 采集唯美girlimport requests; import re; import os; # 1.请求网页 header = { "user-agent":'Mozilla/5.0 (Macintosh; Int