当前位置: 首页 > news >正文

专业风水网站建设百度快照投诉

专业风水网站建设,百度快照投诉,珠三角做网站,广州企业100强名单相信大家应该都写过爬虫,简单的爬虫只需要使用 requests 即可。遇到复杂的爬虫,就需要在程序里面加上请求头和参数信息。类似这种:我们一般的步骤是,先到浏览器的网络请求中找到我们需要的请求,然后将请求头和参数信息…

相信大家应该都写过爬虫,简单的爬虫只需要使用 requests 即可。遇到复杂的爬虫,就需要在程序里面加上请求头和参数信息。类似这种:

我们一般的步骤是,先到浏览器的网络请求中找到我们需要的请求,然后将请求头和参数信息一项项复制到程序中:

每次都需要这样操作,比较麻烦,而且有时候还容易搞错。

今天给大家介绍一个神器,可以自动地将浏览器的请求头信息解析为我们爬虫需要的代码。

安装

首先,我们需要安装这个神器:

pip install filestools -U

也可以使用阿里云加速:

pip install filestools --index-url=http://mirrors.aliyun.com/pypi/simple -U

当然,如果你想下载最新版本,可以用下面命令:

pip install filestools --index-url https://pypi.org/simple/ -U

使用

这款神器的使用也很简单。

第一步是利用浏览器的功能从网络里面复制我们需要的请求头信息:

接着将复制的内容粘贴到我们的转换程序里面:

from curl2py.curlParseTool import curlCmdGenPyScriptcurl_cmd = """curl 'http://www.shixi.com/search/index?key=python'
-H 'Connection: keep-alive'
-H 'Cache-Control: max-age=0'
-H 'Upgrade-Insecure-Requests: 1'
-H 'User-Agent: Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/91.0.4472.124 Safari/537.36'
-H 'Accept: text/html,application/xhtml+xml,application/xml;q=0.9,image/avif,image/webp,image/apng,*/*;q=0.8,application/signed-exchange;v=b3;q=0.9'
-H 'Referer: http://www.shixi.com/'
-H 'Accept-Language: zh-CN,zh;q=0.9'
-H 'Cookie: UM_distinctid=17a50a2c8ea537-046c01e944e72f-6373267-100200-17a50a2c8eb4ff; PHPSESSID=rpprvtdrcrvt54fkr7msgcde17; CNZZDATA1261027457=1711789791-1624850487-https%253A%252F%252Fwww.baidu.com%252F%7C1627741311; Hm_lvt_536f42de0bcce9241264ac5d50172db7=1627741268; Hm_lpvt_536f42de0bcce9241264ac5d50172db7=1627741334'
--compressed
--insecure"""output = curlCmdGenPyScript(curl_cmd)
print(output)

就是放到 curl_cmd 这里。

最后运行程序,我们就可以在输出窗口获得代码如下:

import requests
import jsonheaders = {"Connection": "keep-alive","Cache-Control": "max-age=0","Upgrade-Insecure-Requests": "1","User-Agent": "Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/91.0.4472.124 Safari/537.36","Accept": "text/html,application/xhtml+xml,application/xml;q=0.9,image/avif,image/webp,image/apng,*/*;q=0.8,application/signed-exchange;v=b3;q=0.9","Referer": "http://www.shixi.com/","Accept-Language": "zh-CN,zh;q=0.9"
}
cookies = {"UM_distinctid": "17a50a2c8ea537-046c01e944e72f-6373267-100200-17a50a2c8eb4ff","PHPSESSID": "rpprvtdrcrvt54fkr7msgcde17","CNZZDATA1261027457": "1711789791-1624850487-https%253A%252F%252Fwww.baidu.com%252F%7C1627741311","Hm_lvt_536f42de0bcce9241264ac5d50172db7": "1627741268","Hm_lpvt_536f42de0bcce9241264ac5d50172db7": "1627741334"
}
params = {"key": "python"
}res = requests.get("http://www.shixi.com/search/index",params=params,headers=headers,cookies=cookies
)
print(res.text)

将这些代码根据需要复制到爬虫程序即可。

总结

这其实是一个很简单的程序,但是可以解决我们写代码过程中的一个痛点,提高我们写代码的效率。

http://www.hengruixuexiao.com/news/19491.html

相关文章:

  • 天津品牌网站设计近期舆情热点事件
  • 做网站开发没有人带如何做网页
  • 承接网站建设 优帮云昆明百度推广开户
  • 内蒙古住房和城乡建设网站长春seo排名公司
  • 风讯网站内容管理系统做网络推广怎么找客户
  • 网站为什么做站外推广有链接的网站
  • 小荷特卖的网站谁做的瑞昌网络推广
  • 制作公司网页图片南通关键词优化平台
  • 国外做兼职的网站有哪些营销推广的形式包括
  • 定制网站建设和运营手机如何制作自己的网站
  • 东莞营销型网站建设找火速seo排名优化公司哪家好
  • 南海做网站百度贴吧人工客服电话
  • 企业网站特点分析与描述网站一键生成
  • 南宫企业做网站友情链接多少钱一个
  • 柳州企业 商家应该如何做网站邯郸网站建设优化
  • 网站每年都要续费吗天津百度整站优化服务
  • 自己家的电脑做网站需要备案没品牌营销策划方案
  • 做一个商务平台网站的费用百度官网下载
  • 网站源码文件安装教程最好的网络营销软件
  • 网站空间如何使用网站建设培训机构
  • 网站收录有什么好处百度 个人中心首页
  • 企业网站建设方案机构网站流量分析的指标有哪些
  • 交互式多媒体网站开发优化百度百科
  • 济南一哥网站建设公司网站优化排名优化
  • 上海华亮建设集团网站网站设计方案模板
  • 泊头做网站电话免费网站推广软件
  • 动态网站怎么做网站如何做推广
  • 做一下网站需要什么网站seo基础优化
  • solidworks永久免费版武汉百度推广seo
  • 上虞网站建设公司最近国内新闻