当前位置: 首页 > news >正文

网站模板组件电子商务网站建设含义

网站模板组件,电子商务网站建设含义,外国做电子产品网站有哪些,做公司网站公司由于最近比较忙#xff0c;所以本周搞了一个相对简单的验证码#xff0c;就是抖音Tiktok的滑块验证码#xff0c;这也是接到客户的一个需求。这种验证码通常在电脑端登录抖音、巨量引擎的的时候出现。 首先看一下最终的效果#xff1a; 验证码识别过程 1、利用爬虫采集图…由于最近比较忙所以本周搞了一个相对简单的验证码就是抖音Tiktok的滑块验证码这也是接到客户的一个需求。这种验证码通常在电脑端登录抖音、巨量引擎的的时候出现。 首先看一下最终的效果 验证码识别过程 1、利用爬虫采集图像 由于是识别滑块缺口位置分析了一下大图已经包含了滑块缺口的位置信息所以这里只需要采集大图就够了。不需要小图进行比对这样可以简单一点。 1采集大图 2、人工标记 为了保障识别的精度这里需要进行大量的人工标记最好将误差控制在1-2像素以内这样训练出来的识别模型效果才好。 3、训练模型 4、测试验证 我们将训练好的模型用100张图片来进行测试发现全部都能正确识别位置所以正确率接近100%。因为100张测试图片比较少所以保守估计正确率应该在99%左右。 如果再想提升正确率可以再增加训练的数据量就需要再投入大量人力这个投入与提升产出比需要自己权衡。 5、实战测试 这里我就直接上代码就是文章开通动图的演示效果。我也将模型封装成了免费的接口给感兴趣的小伙伴调用得塔云 __author__ dengxinyanimport io import time import json import requests import urllib import random import base64 from io import BytesIO from PIL import Image, ImageDraw, ImageFont from selenium import webdriver from selenium.webdriver.support.wait import WebDriverWait from selenium.webdriver.common.action_chains import ActionChains from selenium.webdriver.common.keys import Keys from selenium.webdriver import ChromeOptions from selenium.webdriver import FirefoxOptions# PIL图片保存为base64编码 def PIL_base64(img, codingutf-8):img_format img.formatif img_format None:img_format JPEGformat_str JPEGif png img_format.lower():format_str PNGif gif img_format.lower():format_str gifif img.mode P:img img.convert(RGB)if img.mode RGBA:format_str PNGimg_format PNGoutput_buffer BytesIO()# img.save(output_buffer, formatformat_str)img.save(output_buffer, quality100, formatformat_str)byte_data output_buffer.getvalue()base64_str data:image/ img_format.lower() ;base64, base64.b64encode(byte_data).decode(coding)return base64_str# 验证码识别接口 def shibie(img):url http://www.detayun.cn/openapi/verify_code_identify/data {# 用户的keykey:nWrzPFUgFuqXQrCJJUME,# 验证码类型verify_idf_id:6,# 样例图片img_base64:PIL_base64(img),img_byte: None,# 中文点选空间语义类型验证码的文本描述这里缺省为空字符串words:}header {Content-Type: application/json}# 发送请求调用接口response requests.post(urlurl, jsondata, headersheader)print(response.text)return response.json()def run(headlessFalse):# 配置参数options FirefoxOptions()if headless:options.add_argument(--headless)else:options.add_argument(--window-size100,100)options.add_argument(--disable-blink-featuresAutomationControlled)options.add_argument(--disable-dev-shm-usage)options.set_preference(general.useragent.override, Mozilla/5.0 (Windows NT 10.0; Win64; x64) AppleWebKit/537.36 (KHTML, like Gecko) Chrome/92.0.4515.107 Safari/537.36)driver webdriver.Firefox(executable_pathrF:\验证码项目\小红书旋转验证码\webdriver\geckodriver.exe, optionsoptions)# 伪装浏览器driver.execute_script(Object.defineProperty(navigator, webdriver, {get: () false,});)navigator_webdriver driver.execute_script(return navigator.webdriver)driver.execute_script(Object.defineProperty(navigator, plugins, {get: () [1, 2, 3, 4, 5],});)plugins_length driver.execute_script(return navigator.plugins.length)# 发送请求driver.get(https://business.oceanengine.com/login?appKey51)# 等待【请输入邮箱】元素出现WebDriverWait(driver, 20).until(lambda x: x.find_element_by_xpath(//input[placeholder请输入邮箱]))# 找到【请输入邮箱】元素tag1 driver.find_element_by_xpath(//input[placeholder请输入邮箱])# 点击【请输入邮箱】元素tag1.click()# 输入邮箱tag1.send_keys(123451111qq.com)# 等待【密码】元素出现WebDriverWait(driver, 20).until(lambda x: x.find_element_by_xpath(//input[placeholder密码]))# 找到【密码】元素tag2 driver.find_element_by_xpath(//input[placeholder密码])# 点击【密码】元素tag2.click()# 输入密码tag2.send_keys(13611112222)# 等待【用户协议】元素出现WebDriverWait(driver, 20).until(lambda x: x.find_element_by_xpath(//div[classaccount-center-agreement-check]))# 找到【用户协议】元素tag3 driver.find_element_by_xpath(//div[classaccount-center-agreement-check])# 点击【用户协议】元素tag3.click()# 等待【登录】元素出现WebDriverWait(driver, 20).until(lambda x: x.find_element_by_xpath(//button[classace-ui-btn account-center-action-button active ace-ui-btn-primary]))# 找到【登录】元素tag4 driver.find_element_by_xpath(//button[classace-ui-btn account-center-action-button active ace-ui-btn-primary])# 点击【登录】元素tag4.click()# 可能一次不成功需要多次滑动for i in range(5):# 等待【验证码大图】元素出现WebDriverWait(driver, 20).until(lambda x: x.find_element_by_xpath(//img[idcaptcha-verify-image]))# 找到【验证码大图】元素tag5 driver.find_element_by_xpath(//img[idcaptcha-verify-image])# 获取图像链接img_url tag5.get_attribute(src)print(img_url)header {Host: p9-catpcha.byteimg.com,User-Agent: Mozilla/5.0 (Windows NT 10.0; Win64; x64; rv:72.0) Gecko/20100101 Firefox/72.0,Accept: text/html,application/xhtmlxml,application/xml;q0.9,image/webp,*/*;q0.8,Accept-Language: zh-CN,zh;q0.8,zh-TW;q0.7,zh-HK;q0.5,en-US;q0.3,en;q0.2,Accept-Encoding: gzip, deflate, br,Connection: keep-alive,Upgrade-Insecure-Requests: 1,}# 下载图片response requests.get(urlimg_url)img Image.open(BytesIO(response.content))y shibie(img)# 获得滑动像素距离y int(str(y[data][res_str]).replace(滑动,).replace(px,))# 等待【滑块】元素出现WebDriverWait(driver, 20).until(lambda x: x.find_element_by_xpath(//div[classsecsdk-captcha-drag-icon sc-kEYyzF fiQtnm]))# 找到【滑块】元素tag6 driver.find_element_by_xpath(//div[classsecsdk-captcha-drag-icon sc-kEYyzF fiQtnm])# 滑动滑块action ActionChains(driver)action.click_and_hold(tag6).perform()time.sleep(1)# 计算实际滑动距离 像素距离 * 滑动系数move_x y * 0.61# 滑动1直接滑动action.move_by_offset(move_x 20, 5)time.sleep(0.5)action.move_by_offset(-10, -15)time.sleep(0.5)action.move_by_offset(-10, 10)# 滑动2分段滑动# n (random.randint(5, 8))# move_x move_x / n# for i in range(n):# action.move_by_offset(move_x, 5)# time.sleep(0.5)time.sleep(1)# 释放鼠标action.release().perform()time.sleep(2)# 判断是否滑动成功try:# 等待【错误提示】元素出现WebDriverWait(driver, 5).until(lambda x: x.find_element_by_xpath(//div[classsc-htoDjs jwiskW]))# 等待【刷新】元素出现WebDriverWait(driver, 20).until(lambda x: x.find_element_by_xpath(//span[classsecsdk_captcha_refresh--text sc-bwzfXH gBXrMn]))# 找到【刷新】元素tag7 driver.find_element_by_xpath(//span[classsecsdk_captcha_refresh--text sc-bwzfXH gBXrMn])# 点击【刷新】元素tag7.click()time.sleep(1)except:breakif __name__ __main__:run(headlessFalse)6、总结分析 1抖音图片标注工作比较复杂我统计了一下背景图的种类超过800中所以给标注、识别增加了一定难度 2抖音的滑动轨迹检测比较厉害直接滑动到位完全无法通过分段轨迹也很难通过。所以我首先滑过再返回对齐这样就能完美一次通过验证最前面动图就是这样的效果 3抖音页面有很强的反爬措施检测我使用 selenium 始终无法通过验证始终不会条验证码。这一点如何防检测 selenium 也请各位大神指点。所以我代码使用的巨量引擎巨量引擎是字节跳动旗下的品牌网站进行的测试 各位大神也请指出我的不足或者有其他建议都可以给我留言或私信我谢谢指点。
http://www.hkea.cn/news/14544682/

相关文章:

  • 杭州做网站需要多少钱nginx和wordpress
  • 企业如何注册网站wordpress段子模板
  • 有的域名怎样做网站期末网站设计做什么网站比较好
  • 太原百度推广制作个性商城网站网站左侧导航代码
  • 重庆建站服务商wordpress全站注明
  • 爱站网ip反域名查询宝安区做网站
  • 徐州做网站的公司企业网站系统设计与实现
  • 网站推广都有哪些微商网站
  • 电商平台网站建设网站跳转站代码
  • 移动网站 制作建设企业网站的
  • 网站改版 数据迁移wordpress付费汉化主题
  • 温州做外贸网站湖南建设局网站
  • seo竞争对手网站分析沈阳网势科技有限公司怎么样
  • wordpress图片整站如何用手机做网站
  • 郑州网站建设求职简历做网站怎么云存储
  • 网站备案号密码网站建设网站徒手整形
  • 建设邮费自己的网站 要不要购买服务器的wordpress 置顶
  • 基于asp网站开发 论文有人知道网站怎么做吗
  • dedecms三合一网站源码笑话网站源码下载
  • 网站程上传php网站开发小程序
  • 网站建设 实施计划网站建设沟通
  • 网站建设的合理建议南通网站制作公司
  • 知名网站建设制作阳江招聘网最新招聘2023
  • 网站一元空间有哪些呀帮忙建网站的人
  • 电子商务网站建设功能wordpress 变更域名
  • 修机械师怎么做我小样网站角仰望阿里云 企业 网站
  • 做网站需要学什么软件wordpress 文章调用
  • 本地网站怎么建设怎么申请小程序流程
  • sns社交网站三原网站开发
  • 网站建设 应酷wordpress关于