关于selenium遇到控件的问题

常规的网页抓取或者设计简单的js加密都可以很好的用http客户端模拟出来

但是如果安全性高一些的网站,比如银行、酒店信息、某些工商网站的信息,这些站点的反扒措施往往做的比较好,其中一种比较头疼的方式就是控件问题了,很多银行都使用了安全控件的加密措施

模拟请求的话,无法定位到input输入框,即便用selenium也无法定位

这里就涉及到windows的机制了,windows中每个窗口对象都有一个句柄标识符,用整型来标识不同的句柄,可以调用win32的库去通过句柄,定位到控件框

from ctypes import windll

u32 = windll.LoadLibrary('user32.dll')

注意user32.dll文件,windows系统自带的调用接口,里面的一些api,可以通过句柄定位到对应的输入框

切换输入框的api:

      def switch_to_hwnd(hwnd):
        assert type(hwnd) == int
        u32.SwitchToThisWindow(hwnd, True)

其中hwnd为int类型,表示定位的句柄框

以上解决了第一个难题,接下来试着向控件框中输入字符,就麻烦了,selenium的driver.send_keys方法只能向普通的dom输入框输入字符,无法输入控件

这里就需要键盘模拟程序来解决问题了,windows自带了一个软件盘,尝试调用自带软键盘输入,控件框并不能接收到字符,应该是一种安全措施,普通的输入无法向输入框中输入字符

推荐的方案是,调用winIO库,使用更加底层的机制,该库是c++实现的,python有对应的封装:
https://pypi.org/project/rabird.winio/
pypi有具体的使用方法

pypi给出示例代码也很清晰,接口基本上已经封装好了

  def key_press(scancode, press_time=0.2):
    key_down(scancode)
    time.sleep(press_time)
    key_up(scancode)

调用这个函数就可以,其中scancode是键盘信号映射,推荐把它放到字典中调用,可以从网上搜索到:

WIO_CODE = {
  'backspace': 0x0E, 'tab': 0x0F, 'enter': 0x1C, 'caps_lock': 0x3A, 'esc': 0x01,
  'spacebar': 0x39, '0': 0x0B, '1': 0x02, '2': 0x03,  '3': 0x04, '4': 0x05,
  '5': 0x06, '6': 0x07, '7': 0x08, '8': 0x09, '9': 0x0A, 'a': 0x1E, 'b': 0x30,
  'c': 0x2E, 'd': 0x20, 'e': 0x12, 'f': 0x21, 'g': 0x22, 'h': 0x23, 'i': 0x17,
  'j': 0x24, 'k': 0x25, 'l': 0x26, 'm': 0x32, 'n': 0x31, 'o': 0x18, 'p': 0x19,
  'q': 0x10, 'r': 0x13, 's': 0x1F, 't': 0x14, 'u': 0x16, 'v': 0x2F, 'w': 0x11,
  'x': 0x2D, 'y': 0x15, 'z': 0x2C, 'F1': 0x3B, 'F2': 0x3C, 'F3': 0x3D,
  'F4': 0x3E,'F5': 0x3F, 'F6': 0x40, 'F7': 0x41, 'F8': 0x42, 'F9': 0x43, 
  'F10': 0x44, 'F11': 0x57, 'F12': 0x58, 'num_lock': 0x45, 'scroll_lock': 0x46, 
  'left_shift': 0x2A, 'right_shift ': 0x36,'left_control': 0x1D, ',': 0x33,
  '-': 0x0C,'.': 0x34, '/': 0x35, '`': 0x29, ';': 0x27,  '[': 0x1A,']': 0x1B,
}

遍历要输入的字符串,调用key_press方法即可,大写字母输入要press一下CapsLock, 可以封装一下具体输入方法:

def input_key(element):
    upper = 'QWERTYUIOPASDFGHJKLZXCVBNM'
    # key_press(WIO_CODE['left_shift'])
    if element in upper:
        key_press(WIO_CODE['caps_lock'])
        time.sleep(0.1)
        key_press(WIO_CODE[element.lower()])
        time.sleep(0.1)
        key_press(WIO_CODE['caps_lock'])
    else:
        if element not in WIO_CODE:
            print('error input char')
            return False
        key_press(WIO_CODE[element])
        time.sleep(0.1)
    return True

这样,基本的问题就都解决啦

©著作权归作者所有,转载或内容合作请联系作者
  • 序言:七十年代末,一起剥皮案震惊了整个滨河市,随后出现的几起案子,更是在滨河造成了极大的恐慌,老刑警刘岩,带你破解...
    沈念sama阅读 216,919评论 6 502
  • 序言:滨河连续发生了三起死亡事件,死亡现场离奇诡异,居然都是意外死亡,警方通过查阅死者的电脑和手机,发现死者居然都...
    沈念sama阅读 92,567评论 3 392
  • 文/潘晓璐 我一进店门,熙熙楼的掌柜王于贵愁眉苦脸地迎上来,“玉大人,你说我怎么就摊上这事。” “怎么了?”我有些...
    开封第一讲书人阅读 163,316评论 0 353
  • 文/不坏的土叔 我叫张陵,是天一观的道长。 经常有香客问我,道长,这世上最难降的妖魔是什么? 我笑而不...
    开封第一讲书人阅读 58,294评论 1 292
  • 正文 为了忘掉前任,我火速办了婚礼,结果婚礼上,老公的妹妹穿的比我还像新娘。我一直安慰自己,他们只是感情好,可当我...
    茶点故事阅读 67,318评论 6 390
  • 文/花漫 我一把揭开白布。 她就那样静静地躺着,像睡着了一般。 火红的嫁衣衬着肌肤如雪。 梳的纹丝不乱的头发上,一...
    开封第一讲书人阅读 51,245评论 1 299
  • 那天,我揣着相机与录音,去河边找鬼。 笑死,一个胖子当着我的面吹牛,可吹牛的内容都是我干的。 我是一名探鬼主播,决...
    沈念sama阅读 40,120评论 3 418
  • 文/苍兰香墨 我猛地睁开眼,长吁一口气:“原来是场噩梦啊……” “哼!你这毒妇竟也来了?” 一声冷哼从身侧响起,我...
    开封第一讲书人阅读 38,964评论 0 275
  • 序言:老挝万荣一对情侣失踪,失踪者是张志新(化名)和其女友刘颖,没想到半个月后,有当地人在树林里发现了一具尸体,经...
    沈念sama阅读 45,376评论 1 313
  • 正文 独居荒郊野岭守林人离奇死亡,尸身上长有42处带血的脓包…… 初始之章·张勋 以下内容为张勋视角 年9月15日...
    茶点故事阅读 37,592评论 2 333
  • 正文 我和宋清朗相恋三年,在试婚纱的时候发现自己被绿了。 大学时的朋友给我发了我未婚夫和他白月光在一起吃饭的照片。...
    茶点故事阅读 39,764评论 1 348
  • 序言:一个原本活蹦乱跳的男人离奇死亡,死状恐怖,灵堂内的尸体忽然破棺而出,到底是诈尸还是另有隐情,我是刑警宁泽,带...
    沈念sama阅读 35,460评论 5 344
  • 正文 年R本政府宣布,位于F岛的核电站,受9级特大地震影响,放射性物质发生泄漏。R本人自食恶果不足惜,却给世界环境...
    茶点故事阅读 41,070评论 3 327
  • 文/蒙蒙 一、第九天 我趴在偏房一处隐蔽的房顶上张望。 院中可真热闹,春花似锦、人声如沸。这庄子的主人今日做“春日...
    开封第一讲书人阅读 31,697评论 0 22
  • 文/苍兰香墨 我抬头看了看天上的太阳。三九已至,却和暖如春,着一层夹袄步出监牢的瞬间,已是汗流浃背。 一阵脚步声响...
    开封第一讲书人阅读 32,846评论 1 269
  • 我被黑心中介骗来泰国打工, 没想到刚下飞机就差点儿被人妖公主榨干…… 1. 我叫王不留,地道东北人。 一个月前我还...
    沈念sama阅读 47,819评论 2 370
  • 正文 我出身青楼,却偏偏与公主长得像,于是被迫代替她去往敌国和亲。 传闻我的和亲对象是个残疾皇子,可洞房花烛夜当晚...
    茶点故事阅读 44,665评论 2 354

推荐阅读更多精彩内容

  • Android 自定义View的各种姿势1 Activity的显示之ViewRootImpl详解 Activity...
    passiontim阅读 172,088评论 25 707
  • 洞见SELENIUM自动化测试 写在最前面:目前自动化测试并不属于新鲜的事物,或者说自动化测试的各种方法论已经层出...
    厲铆兄阅读 6,728评论 3 47
  • 2017年11月21日,这是我第三次来到肇庆,不变的是这座城市给予我的无奈,改变了的是自己的心境,曾经我觉得朝九晚...
    蔡牧桐阅读 475评论 0 0
  • 当校领导宣布开幕式正式结束,运动会正式开始的时候,我的泪唰的一下就出来了,强忍到结束跑出会场,笑着跟一曼说,咱们终...
    满嘴胡话_阅读 910评论 10 11
  • 很早就醒来 梦到和他一起工作 他被我吓跑了 跑的离我好远 一条信息后 就再也找不到人影 我害怕 惊醒
    我是你饱饱阅读 139评论 0 0