淘宝网登录最近想爬取淘宝的一些商品,但是发现如果要使用搜索等一些功能时基本都需要登录,所以就想出一篇模拟登录淘宝的Python学习教程文章!
看了下网上有很多关于模拟登录淘宝,但是基本都是使用scrapy、pyppeteer、selenium等库来模拟登录,但是目前我们还没有讲到这些库,只讲了requests库,那我们今天就来使用requests库模拟登录淘宝!
讲模拟登录淘宝之前,我们来回顾一下之前用requests库模拟登录豆瓣和新浪微博的过程:这一类模拟登录是比较简单的登录,只需要在请求登录时将用户名和密码上传验证通过就成功了,也就是说一步到位!
而淘宝登录就比较复杂,为什么说复杂呢?因为淘宝登录涉及参数多且请求不止一次!我们就先来讲讲淘宝登录的流程,先把流程原理搞懂,再去敲代码,这样大家就容易理解!
一、淘宝登录流程为了便于大家理解,画了一个非标准的淘宝登录请求时序图
文章插图
淘宝ua参数:ua(User-Agent)故名用户代理,淘宝的ua参数加入了浏览器、ip、电脑、时间等信息,然后加密生成,在很多地方使用,不仅仅是登录!上图是比较详细的流程图,从代码层面考虑将模拟登录淘宝分为以下四个步骤:
- 输入用户名后,浏览器会向淘宝(taobao.com)发起一个post的请求,判断是否出现滑块验证!用户输入密码后,浏览器向淘宝(taobao.com)又发起一个post请求,验证用户名密码是否正确,如果正确则返回一个token 。浏览器拿着token去阿里巴巴(alibaba.com)交换st码!浏览器获取st码之后,拿着st码获取cookies,登录成功
二、模拟登录实现上面我们只讲了大概的登录流程,这里会先详细讲解下每一步的操作,然后再贴出实现代码!
1.判断是否需要验证码
目前我们在登录淘宝的时候,大多数情况下是不会出现滑块验证码,尝试了很多次的登录退出也只是在中间出现过一次,那究竟是什么在控制是否需要滑块验证码的呢?
文章插图
从上图可以看出,当输入用户名后,浏览器就会发起一个post请求,来验证是否需要出现滑块验证码,如果返回true,滑块验证码则出现!否则不出现,一般是不会出现!
图中我们可以看到这次post请求上传了两个参数:username、ua!
前面说过ua为浏览器、ip、设备信息等多信息加密参数,所以猜想淘宝的验证码是否出现不仅仅从账号角度,还有ip、设备等角度!
举个例子:某台设备可能出现登录过大量的账号,这时候淘宝就可以从ua参数中获取设备号,然后对该设备进行限制!知道了流程和请求链接及参数之后,我们就可以用代码来请求了!
文章插图
2.验证用户名密码
这里一步也就是上面时序图图中的第5步:请求登录,这里会将用户名、ua参数、加密密码等30十几个参数post到淘宝(taobao.com)去验证 。
文章插图
我们来用代码实现一下,大家别被这么多参数吓到,都是从浏览器复制过来的!
文章插图
看看请求结果!
文章插图
可以看到申请st码链接后面带了一个token,具体token是干什么用的后面我们再分析!
3.申请st码
上面我们已经申请到了淘宝(taobao.com)的token,这一步就是用token来换取st码 。
到这里很多人可能会有疑问:为什么淘宝登录需要这么麻烦呢?直接在 taobao.com 登录不就可以吗?为什么要先在taobao验证用户名密码,通过之后再去 alibaba.com 换取st码登录呢?
任何公司的框架都是慢慢演变的结果,我猜想最开始的淘宝登录肯定没这么复杂 。但是随着阿里巴巴的慢慢壮大,很多事业线都划分开来,但是这些事业线之间又有关联性,比如用户登录了淘宝账号之后天猫就不需要再登录(注意淘宝和天猫的顶级域名不同,所以不能共享cookis)为了实现这个功能,单点登录就出现了 。
秒懂生活扩展阅读
- 家里剩下的香怎么处理
- 手机没有备份怎么恢复电话号码
- 家里的网络不好怎么办啊
- iphone一直黑屏怎么办
- 入驻萌推的条件以及费用 萌推商家后台怎么注册
- 三分钟教你白嫖京东plus会员 京东plus会员划算吗
- 简短的个人职业规划 个人职业发展规划怎么写
- 5公斤快递运费怎么算 各快递公司收费标准表
- 10分钟学会装修店铺 淘宝店铺装修怎么弄
- 一招教你解决问题 支付宝限额一万怎么改跟银行卡