Python解决反爬机制_滑块解锁的思路以及踩的坑+心得_一蓑烟雨任平生

本文主要是介绍Python解决反爬机制_滑块解锁的思路以及踩的坑+心得_一蓑烟雨任平生,希望对大家解决编程问题提供一定的参考价值,需要的开发者们随着小编来一起学习吧!

文章目录

  • 前言
  • 目标
    • 滑块解锁分三种
      • 1.每次验证的第一个图都是定死的
      • 2.验证滑块不通过图片不变
      • 3.无论你验证成功失败,你拉一次图片位置变一次
  • 一、下载滑块与背景图
    • 1.利用canvas标签下载图片(此路不通)
    • 2.利用selenium的电脑截图下载图片(此路不通)
    • 3.利用selenium的鼠标下载图片(成功)
  • 二、计算滑块到空缺的距离
    • 1.第一种方法对比像素(此路不通)
    • 2.第二种方法对比滑块和背景(成功)
    • 3.第二种方法增强版
  • 三、模仿人为滑动破解
    • 1.计算出速度
    • 2.网上失败代码不粘贴了
  • 总结


前言

网上的的滑块解锁图形,五花八门,十个里面九个瘫,步步都是坑


目标

目标很简单,就是把滑块放进缺少的图片中

在这里插入图片描述


滑块解锁分三种

1.每次验证的第一个图都是定死的

也就是说,访问第一次之后,直接F12算出面积,直接把长度放入代码中即可

2.验证滑块不通过图片不变

这种的话,比较第一种较难点,思路很简单,就是设置一个长度,不断的递增就可以了,比如第一个图可能要求拉15cm也可能是拉33cm才可以,但是我就从3cm开始测试就可以了,3cm不行6cm,6cm不行9cm,反正没刷新图片15cm永远都在那里等着我

3.无论你验证成功失败,你拉一次图片位置变一次

这就是今天的反爬虫机制最高的境界,时时刻刻变位置,前两种的思路都不可以用了,只能计算出长度进行拉取,这也就是这篇博客要讲解的重头戏


一、下载滑块与背景图

1.利用canvas标签下载图片(此路不通)

这是大佬地址,我看了他的博客,只感觉在纸上谈兵,还对骂了一番

附上大佬的代码

def download_yzm(self):js = '''return document.getElementById('puzzle-lost').toDataURL()'''base64str = self.driver.execute_script(js)resultstr = base64str.strip("data:image/png;base64")resultstr = resultstr[1:]imagedata = base64.b64decode(resultstr)file = open('./bg.png', "wb")file.write(imagedata)file.close()

首先,不看别的,只看到js里面有return 我就知道会报错了,我很纳闷他试了没


在console里面执行js不知道哪个前端加过return才会有数据显示??


他没有实践,所以没有考虑很多问题,比如canvas下载图片地址toDataURL是存在跨域问题的,又比如每次图片滑动的距离并不是写死的,背景图会时时刻刻变化的,所以写代码还是多动手比较好


2.利用selenium的电脑截图下载图片(此路不通)

#移动前获取滑块那部分页面上的图片用selenium截图的形式
driver.find_elements_by_xpath('//*[@class="yidun_bg-img"]')[1].screenshot('0.png')
bg_act = cv.imread('0.png')
bg_act_height, bg_act_width = bg_act.shape[0],bg_act.shape[1]
bg = cv.imread('bg_img.png')
bg_height, bg_width = bg.shape[0],bg.shape[1]
block = cv.imread('img.png', -1)
scale = bg_act_height * 1.0 / bg_height
scale1 = bg_act_width * 1.0 / bg_width
block_act = cv.resize(block, (0,0), fx = scale, fy=scale)print('scale: ', scale, scale1)
x1,x2 =get_image_deviation(bg, block)
x1 = int(x1*scale)
print("x1x2=", x1, x2)#部分代码
ActionChains(滑块元素).move_by_offset(xoffset= 移动上面生成的距离, yoffset=0).perform()#第一次移动后二次识别部分代码driver.find_elements_by_xpath('//*[@class="yidun_bg-img"]')[1].screenshot('bg1.png')
bg_act1 = cv.imread('bg1.png')
x3,x4=get_image_deviation(bg_act1, block_act)print("x3x4=", x3, x4)
time.sleep(5)
ActionChains(driver).move_by_offset(xoffset= x1-x3, yoffset=0).perform()

两次图片匹配,识别率来完成,我呵呵了,这个鬼才也算有想法的,不断匹配识别来达到目的,但是电脑截图下来的图片你存哪里了,不保存放内存中自己消化了?图片不变化的话,或许你这种方法有点用

3.利用selenium的鼠标下载图片(成功)

这个就6的狠了,人为的进行打开网页点击保存图片,这里保存图片参看我另外一篇博客,网上很多文章也不行,自己摸索出来的最终解决方案

Python selenium自动化脚本右键保存图片_一蓑烟雨任平生

保存并不算很难,也就耗用了我两小时研究,网上天花乱坠,没营养的代码一堆一堆的,走了很多弯路,这里保存之后命名图片名称是一个难点,毕竟锁定IP并不是锁定一次滑动验证码就可以了,会频繁的锁定,所以要频繁的滑动解锁,这里重点讲解下selenium的删除和命名文件

直接上代码啊

def rnameFile():# 查找文件path = "E:\\xiazai"#这是你浏览器下载地址# os.listdir()方法,列出来所有文件# 返回path指定的文件夹包含的文件或文件夹的名字的列表files = os.listdir(path)# 主逻辑# 删除该文件os.remove("E:\\xiazai\\bg.png")print('删除北京成功')# 删除该文件os.remove("E:\\xiazai\\huakuai.png")print('删除滑块图片成功')# 对于批量的操作,使用FOR循环for f in files:# 调试代码的方法:关键地方打上print语句,判断这一步是不是执行成功print(f)if "1" in f and f.endswith(".png"):# 这里应该打印下载(1).pngprint("原来的文件名字是:{}".format(f))# 找到老的文件所在的位置old_file = os.path.join(path, f)print("old_file is {}".format(old_file))# 指定新文件的位置,如果没有使用这个方法,则新文件名生成在本项目的目录中new_file = os.path.join(path, "bg.png")print("File will be renamed as:{}".format(new_file))os.rename(old_file, new_file)print("修改后的文件名是:{}".format(f))elif "下载" in f and f.endswith(".png"):# 这里应该打印下载.pngprint("原来的文件名字是:{}".format(f))# 找到老的文件所在的位置old_file = os.path.join(path, f)print("old_file is {}".format(old_file))# 指定新文件的位置,如果没有使用这个方法,则新文件名生成在本项目的目录中new_file = os.path.join(path, "huakuai.png")print("File will be renamed as:{}".format(new_file))os.rename(old_file, new_file)print("修改后的文件名是:{}".format(f))if __name__ == '__main__':rnameFile()

二、计算滑块到空缺的距离

1.第一种方法对比像素(此路不通)

#.缺口图片匹配缺口所在图片那一行图片可以提高他识别率
def get_image_deviation():##读取滑块图block = cv.imread("img.png", -1) #完整图片有个缺口backimg = cv.imread("bg_img.png") #缺口图片# block = cv.resize(block, (240, 480))# backimg = cv.resize(block, (240, 480))##灰度化gray_backimg = cv.cvtColor(backimg, cv.COLOR_RGB2GRAY)blockWidth, blockHeight = block.shape[1], block.shape[0]##识别滑块图前景###由于滑块图为带透明的png,可根据透明通道来判断前景位置##识别物体框,生成blockmaskleft = blockWidthright = 0top = blockHeightbottom = 0for i in range(0, blockHeight):for j in range(0, blockWidth):if block[i, j, 3] > 0:if j <= left:left = jif j >= right:right = jif i <= top:top = iif i >= bottom:bottom = iblockBox = block[top:bottom, left:right]blockBox_width, blockBox_height = blockBox.shape[1], blockBox.shape[0]print(blockBox_width)blockMask = np.zeros([blockBox_height, blockBox_width], np.uint8)for i in range(0, blockBox_height):for j in range(0, blockBox_width):if blockBox[i, j, 3] > 0:blockMask[i, j] = 255blockBox = cv.cvtColor(blockBox, cv.COLOR_RGBA2GRAY)##由于边界点存在光照影响,为了避免边界点对匹配的影响,进行腐蚀操作kernel = np.ones((3, 3), np.uint8)blockMask = cv.erode(blockMask, kernel, iterations=1).astype(np.float32)backgroundROI = gray_backimg[top:bottom, :]##将backgroundROI、blockBox都转化成float型blockBox = (blockBox * 1.0).astype(np.float32)backgroundROI = (backgroundROI * 1.0).astype(np.float32)##使用cv的res = cv.matchTemplate(backgroundROI, blockBox, cv.TM_CCORR_NORMED, mask=blockMask)loc = cv.minMaxLoc(res)print("loc==", loc[3][0])locs = (loc[3][0])return locs

上面代码走不通,这就是没营养的东西

2.第二种方法对比滑块和背景(成功)

# -*- coding: utf-8 -*-
"""
@Time : ${DATE} ${TIME}
@Auth : 一蓑烟雨任平生
@File :${NAME}.py
@IDE :${PRODUCT_NAME}
@Motto:ABC(Always Be Coding)"""
import cv2def FindPic(bg, huakuai):"""找出图像中最佳匹配位置:param bg: 你下载的背景图:param huakuai: 滑块的图片:return: 滑动距离"""target_rgb = cv2.imread(bg)target_gray = cv2.cvtColor(target_rgb, cv2.COLOR_BGR2GRAY)template_rgb = cv2.imread(huakuai, 0)res = cv2.matchTemplate(target_gray, template_rgb, cv2.TM_CCOEFF_NORMED)value = cv2.minMaxLoc(res)return str(value).split('(')[3].split(',')[0]

3.第二种方法增强版

## 计算距离
def FindPic(bg, huakuai):'''bg: 背景图片tp: 缺口图片'''# 读取背景图片和缺口图片bg_img = cv2.imread(bg)  # 背景图片tp_img = cv2.imread(huakuai)  # 缺口图片# 识别图片边缘bg_edge = cv2.Canny(bg_img, 100, 200)tp_edge = cv2.Canny(tp_img, 100, 200)# 转换图片格式bg_pic = cv2.cvtColor(bg_edge, cv2.COLOR_GRAY2RGB)tp_pic = cv2.cvtColor(tp_edge, cv2.COLOR_GRAY2RGB)# 缺口匹配res = cv2.matchTemplate(bg_pic, tp_pic, cv2.TM_CCOEFF_NORMED)min_val, max_val, min_loc, max_loc = cv2.minMaxLoc(res)  # 寻找最优匹配# 绘制方框th, tw = tp_pic.shape[:2]tl = max_loc  # 左上角点的坐标br = (tl[0] + tw, tl[1] + th)  # 右下角点的坐标cv2.rectangle(bg_img, tl, br, (0, 0, 255), 2)  # 绘制矩形print(tl[0])# 返回缺口的X坐标return tl[0]

12行代码搞完不香吗?非要搞100多行代码吓唬我啊

三、模仿人为滑动破解

1.计算出速度

这里只要学着人为的开始时候加速,然后减速放进去就OK了

def get_tracks(distance, rate=0.6, t=0.2, v=0):"""将distance分割成小段的距离:param distance: 总距离:param rate: 加速减速的临界比例:param a1: 加速度:param a2: 减速度:param t: 单位时间:param t: 初始速度:return: 小段的距离集合"""tracks = []# 加速减速的临界值mid = rate * distance# 当前位移s = 0# 循环while s < distance:# 初始速度v0 = vif s < mid:a = 40else:a = -3# 计算当前t时间段走的距离s0 = v0 * t + 0.5 * a * t * t# 计算当前速度v = v0 + a * t# 四舍五入距离,因为像素没有小数tracks.append(round(s0))# 计算当前距离s += s0return tracks

2.网上失败代码不粘贴了

这里就不在列举网上那些闪电滑块,蜗牛滑块的代码了,我累了


总结

我个人原因太懒,不喜欢写代码一大堆一大堆的,只要能实现效果,越少越好,一行能解决的事情绝对不用10行,这就是我,懒人一个,烂人一个
在这里插入图片描述

这篇关于Python解决反爬机制_滑块解锁的思路以及踩的坑+心得_一蓑烟雨任平生的文章就介绍到这儿,希望我们推荐的文章对编程师们有所帮助!


原文地址:https://blog.csdn.net/Jaeger_Java/article/details/112313815
本文来自互联网用户投稿,该文观点仅代表作者本人,不代表本站立场。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如若转载,请注明出处:http://www.chinasem.cn/article/312783

相关文章

一文全面详解Python变量作用域

《一文全面详解Python变量作用域》变量作用域是Python中非常重要的概念,它决定了在哪里可以访问变量,下面我将用通俗易懂的方式,结合代码示例和图表,带你全面了解Python变量作用域,需要的朋友... 目录一、什么是变量作用域?二、python的四种作用域作用域查找顺序图示三、各作用域详解1. 局部作

Python主动抛出异常的各种用法和场景分析

《Python主动抛出异常的各种用法和场景分析》在Python中,我们不仅可以捕获和处理异常,还可以主动抛出异常,也就是以类的方式自定义错误的类型和提示信息,这在编程中非常有用,下面我将详细解释主动抛... 目录一、为什么要主动抛出异常?二、基本语法:raise关键字基本示例三、raise的多种用法1. 抛

MySQL 设置AUTO_INCREMENT 无效的问题解决

《MySQL设置AUTO_INCREMENT无效的问题解决》本文主要介绍了MySQL设置AUTO_INCREMENT无效的问题解决,文中通过示例代码介绍的非常详细,对大家的学习或者工作具有一定的参... 目录快速设置mysql的auto_increment参数一、修改 AUTO_INCREMENT 的值。

Python基于微信OCR引擎实现高效图片文字识别

《Python基于微信OCR引擎实现高效图片文字识别》这篇文章主要为大家详细介绍了一款基于微信OCR引擎的图片文字识别桌面应用开发全过程,可以实现从图片拖拽识别到文字提取,感兴趣的小伙伴可以跟随小编一... 目录一、项目概述1.1 开发背景1.2 技术选型1.3 核心优势二、功能详解2.1 核心功能模块2.

关于跨域无效的问题及解决(java后端方案)

《关于跨域无效的问题及解决(java后端方案)》:本文主要介绍关于跨域无效的问题及解决(java后端方案),具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑完全的地方,望不吝赐教... 目录通用后端跨域方法1、@CrossOrigin 注解2、springboot2.0 实现WebMvcConfig

Redis过期删除机制与内存淘汰策略的解析指南

《Redis过期删除机制与内存淘汰策略的解析指南》在使用Redis构建缓存系统时,很多开发者只设置了EXPIRE但却忽略了背后Redis的过期删除机制与内存淘汰策略,下面小编就来和大家详细介绍一下... 目录1、简述2、Redis http://www.chinasem.cn的过期删除策略(Key Expir

基于Python实现一个简单的题库与在线考试系统

《基于Python实现一个简单的题库与在线考试系统》在当今信息化教育时代,在线学习与考试系统已成为教育技术领域的重要组成部分,本文就来介绍一下如何使用Python和PyQt5框架开发一个名为白泽题库系... 目录概述功能特点界面展示系统架构设计类结构图Excel题库填写格式模板题库题目填写格式表核心数据结构

Go语言中泄漏缓冲区的问题解决

《Go语言中泄漏缓冲区的问题解决》缓冲区是一种常见的数据结构,常被用于在不同的并发单元之间传递数据,然而,若缓冲区使用不当,就可能引发泄漏缓冲区问题,本文就来介绍一下问题的解决,感兴趣的可以了解一下... 目录引言泄漏缓冲区的基本概念代码示例:泄漏缓冲区的产生项目场景:Web 服务器中的请求缓冲场景描述代码

Python使用smtplib库开发一个邮件自动发送工具

《Python使用smtplib库开发一个邮件自动发送工具》在现代软件开发中,自动化邮件发送是一个非常实用的功能,无论是系统通知、营销邮件、还是日常工作报告,Python的smtplib库都能帮助我们... 目录代码实现与知识点解析1. 导入必要的库2. 配置邮件服务器参数3. 创建邮件发送类4. 实现邮件

解决JSONField、JsonProperty不生效的问题

《解决JSONField、JsonProperty不生效的问题》:本文主要介绍解决JSONField、JsonProperty不生效的问题,具有很好的参考价值,希望对大家有所帮助,如有错误或未考虑... 目录jsONField、JsonProperty不生效javascript问题排查总结JSONField