1.若想识别登录验证码,需要安装:Tesseract-OCR,其下载地址为:http://jaist.dl.sourceforge.net/project/tesseract-ocr-alt/tesseract-ocr-setup-3.02.02.exe,安装后一直下一步即可。

2.前提:

A==已安装PIL(3.6版本为Pillow)

B==电脑已安装Tesseract-OCR

C==若使用工具为Pycharm,须在Pycharm - setting引入pytesseract包

3.代码如下所示:

from selenium import webdriver
import time
import unittest
from PIL import Image
from PIL import ImageEnhance
import pytesseract driver = webdriver.Ie()
driver.get('https://passport.baidu.com/?getpassindex')
driver.implicitly_wait(3) driver.maximize_window()
driver.save_screenshot('E:\\password.png') #截取当前网页,该网页有我们需要的验证码
imagelement = driver.find_element_by_xpath(".//*[@id='forgotsel']/div/div[3]/img") location = imagelement.location #获取验证码的x,y轴坐标
size = imagelement.size #获取验证码的长宽 coderange=(int(location['x']),int(location['y']),int(location['x']+size['width']),
int(location['y']+size['height'])) #写成我们需要截取的位置坐标 i = Image.open('E:\\password.png') #打开截图
fram4 = i.crop(coderange) #使用Image的crop函数,从截图中再次截取我们需要的区域
fram4.save('E:\\fram4.png') i2 = Image.open('E:\\fram4.png')
imgry = i2.convert('L')
sharpness = ImageEnhance.Contrast(imgry) #对比度增强 i3 = sharpness.enhance(3.0) #3.0为图像的饱和度
i3.save('E:\\image_code.png') i4 = Image.open('E:\\image_code.png')
text = pytesseract.image_to_string(i2).strip() #使用image_to_string识别验证码
print(text)

4.编写代码成功后,右键运行后报错,报错信息如下:

5.查阅资料后,其解决方法如下:找到pytesseract.py文件,修改内容如下所示:

再次运行成功(注:个人觉得OCR后的验证码不够清晰)

参考博客为:https://www.cnblogs.com/VseYoung/p/code.html

最新文章

  1. cssReset - css初始化
  2. Python 基礎 - 文件操作_v2
  3. 用GO扫描图片像素,复制图片
  4. Python全栈考试-部分试题(精选)
  5. background-position控制背景位置
  6. IOS-MVC的使用
  7. 再谈this
  8. Linux 查看端口被占用情况
  9. Unix网络编程(迭代服务器)
  10. Spring @ResponseBody只能返回String类型数据解决办法
  11. JAVA NIO系列(三) Buffer 解读
  12. 黑马程序员——JAVA基础之常用DOS命令和环境变量的配置
  13. A Bug
  14. Android读取网络图片
  15. smarty的学习计划(1)
  16. iOS UIAlertView 文字对其方式 文字大小 设置方法
  17. Strategic Game
  18. python学习交流 - 匿名函数
  19. 如何一步一步新建一个Owin项目
  20. C#轻量级通通讯组件StriveEngine —— C/S通信开源demo(2) —— 使用二进制协议 (附源码)

热门文章

  1. idea maven install时,打包找不到微服务common中公用的包
  2. Cannot locate the chosen ObjectFactory implementation: spring
  3. BZOJ 1026 windy数 (数位DP)
  4. yii2出现的400错误
  5. 淘宝TDDL配置以及使用
  6. LeetCode OJ:Reorder List(重序链表)
  7. js判断是否是移动端(触摸屏)或者是PC
  8. C++实现设计模式之 —策略与简单工程结合
  9. Servlet自动加载
  10. (转)JAVA正则表达式语法大全