利用selenium自动化访问网站并简单使用pytesseract识别验证码
本篇博客主要是记录一下使用Python的selenium库的过程,以及识别验证码时遇到的小坑。我先来列举几个可供学习的文档,主要分为两类。
一类是学习selenium自动化访问网站: Selenium with Python Selenium Python 文档 Selenium Documentation
一类是识别验证码相关: tesseract
目标站点是YunFile网盘,我想要自动普通下载给出的某个文件,比如这个url:http://tadown.com/fs/1q8q3_d3a51081cBEFF986/ 代码如下:
from PIL import Image, Image[......]<p class="read-more"><a href="https://blog.davidblus.top/2018/05/27/li_yong_selenium/">继续阅读</a></p> 
