最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

Selenium 模擬瀏覽器動態(tài)加載頁面的實現(xiàn)方法

 更新時間:2018年05月16日 09:39:51   作者:mmc2015  
這篇文章主要介紹了Selenium 模擬瀏覽器動態(tài)加載頁面的實現(xiàn)方法,小編覺得挺不錯的,現(xiàn)在分享給大家,也給大家做個參考。一起跟隨小編過來看看吧

相信爬取大公司的數(shù)據(jù)時,常常會遇到頁面信息動態(tài)加載的問題,

如果僅僅使用content = urllib2.urlopen(URL).read(),估計信息是獲取不全的,這時候就需要模擬瀏覽器加載頁面的過程,

selenium提供了方便的方法,我也是菜鳥,試了很多種方式,下面提供覺得最靠譜的(已經(jīng)證明對于爬取新浪微博的topic、twitter under topic完全沒問題)。

至于下面的browser變量是什么,看前面的幾篇文章。

首先是請求對應(yīng)的URL:

right_URL = URL.split("from")[0] + "current_page="+str(current_page) + "&since_id="+str(since_id) + "&page="+str(page_index) + "#Pl_Third_App__"+str(Pl_Third_App) 
print right_URL 
try: 
browser.get(right_URL) 
print "loading more, sleep 3 seconds ... 0" 
time.sleep(3) # NO need for this sleep, but we add ... 
browser = selenuim_loading_more(browser, method_index=0) 
except: 
print "one exception happen ==> get_tweeter_under_topic 2 ..." 
pass 

然后模擬瀏覽器,加載更多(推薦使用method_index=0,已經(jīng)證明比其他好用很多):

def selenuim_loading_more(browser, method_index=0): 
  if method_index==0: 
    browser.implicitly_wait(3) # 為了快速滑動,先設(shè)置超時時間為1秒 
    # while True: 
    for i in range(1, 4): # at most 3 times 
      print "loading more, window.scrollTo bettom for the", i,"time ..." 
      browser.execute_script("window.scrollTo(0,document.body.scrollHeight);") 
      try: 
        # 定位頁面底部的換頁tab 
        browser.find_element_by_css_selector("div[class='W_pages']") 
        break # 如果沒拋出異常就說明找到了底部標(biāo)志,跳出循環(huán) 
      except NoSuchElementException: 
        pass # 拋出異常說明沒找到底部標(biāo)志,繼續(xù)向下滑動 
    browser.implicitly_wait(4) # 將超時時間改回10秒 
  elif method_index==1: 
    browser.find_element_by_css_selector("div[class='empty_con clearfix']").click() # loading more 
    print "loading more, sleep 4 seconds ... 1" 
    time.sleep(4) 
    browser.find_element_by_css_selector("div[class='empty_con clearfix']").click() # loading more 
    print "loading more, sleep 3 seconds ... 2" 
    time.sleep(2) 
  elif method_index==2: 
    load_more_1 = browser.find_element_by_css_selector("div[class='empty_con clearfix']") # loading more         
    ActionChains(browser).click(load_more_1).perform() 
    print "loading more, sleep 4 seconds ... 1" 
    time.sleep(4) 
    load_more_2 = browser.find_element_by_css_selector("div[class='empty_con clearfix']") # loading more         
    ActionChains(browser).click(load_more_2).perform() 
    print "loading more, sleep 3 seconds ... 2" 
    time.sleep(2) 
  elif method_index==3: 
    print "loading more, sleep 4 seconds ... 1" 
    element = WebDriverWait(browser, 4).until( 
      EC.element_to_be_clickable((By.CSS_SELECTOR, "div[class='empty_con clearfix']")) 
    ) 
    element.click() 
    print "loading more, sleep 2 seconds ... 2" 
    WebDriverWait(browser, 2).until( 
      EC.element_to_be_clickable((By.CSS_SELECTOR, "div[class='empty_con clearfix']")) 
    ).click() 
  return browser 

以上就是本文的全部內(nèi)容,希望對大家的學(xué)習(xí)有所幫助,也希望大家多多支持腳本之家。

相關(guān)文章

  • Python實現(xiàn)JSON反序列化類對象的示例

    Python實現(xiàn)JSON反序列化類對象的示例

    本篇文章主要介紹了Python實現(xiàn)JSON反序列化類對象的示例,小編覺得挺不錯的,現(xiàn)在分享給大家,也給大家做個參考。一起跟隨小編過來看看吧
    2018-01-01
  • Python創(chuàng)建SQL數(shù)據(jù)庫流程逐步講解

    Python創(chuàng)建SQL數(shù)據(jù)庫流程逐步講解

    會寫SQL很重要,能高效地查詢數(shù)據(jù)庫被認(rèn)為是數(shù)據(jù)分析師/科學(xué)家最基本的技能之一。SQL不僅重要,而且非常常用,文中通過示例代碼介紹的非常詳細(xì),對大家的學(xué)習(xí)或者工作具有一定的參考學(xué)習(xí)價值,需要的朋友們下面隨著小編來一起學(xué)習(xí)吧
    2022-09-09
  • python數(shù)字圖像處理之邊緣輪廓檢測

    python數(shù)字圖像處理之邊緣輪廓檢測

    這篇文章主要介紹了python數(shù)字圖像處理之邊緣輪廓檢測示例詳解,有需要的朋友可以借鑒參考下,希望能夠有所幫助,祝大家多多進(jìn)步,早日升職加薪
    2022-06-06
  • 如何用python編寫一個生成春聯(lián)軟件

    如何用python編寫一個生成春聯(lián)軟件

    大家好,本篇文章主要講的是如何用python編寫一個生成春聯(lián)軟件,感興趣的同學(xué)趕快來看一看吧,對你有幫助的話記得收藏一下
    2022-01-01
  • Centos部署django服務(wù)nginx+uwsgi的方法

    Centos部署django服務(wù)nginx+uwsgi的方法

    這篇文章主要介紹了Centos部署django服務(wù)nginx+uwsgi的方法,小編覺得挺不錯的,現(xiàn)在分享給大家,也給大家做個參考。一起跟隨小編過來看看吧
    2019-01-01
  • Python使用PyPDF2庫實現(xiàn)向PDF文件中插入內(nèi)容

    Python使用PyPDF2庫實現(xiàn)向PDF文件中插入內(nèi)容

    Python的PyPDF2庫是一個強(qiáng)大的工具,它允許我們方便地操作PDF文件,包括合并、拆分、旋轉(zhuǎn)頁面等操作,下面我們就來看看如何使用PyPDF2庫實現(xiàn)向PDF文件中插入內(nèi)容吧
    2024-04-04
  • 1分鐘快速生成用于網(wǎng)頁內(nèi)容提取的xslt

    1分鐘快速生成用于網(wǎng)頁內(nèi)容提取的xslt

    這篇文章主要教大家如何1分鐘快速生成用于網(wǎng)頁內(nèi)容提取的xslt,具有一定的參考價值,感興趣的小伙伴們可以參考一下
    2018-02-02
  • Django實現(xiàn)靜態(tài)文件緩存到云服務(wù)的操作方法

    Django實現(xiàn)靜態(tài)文件緩存到云服務(wù)的操作方法

    這篇文章主要介紹了Django實現(xiàn)靜態(tài)文件緩存到云服務(wù)的操作方法,本文給大家介紹的非常詳細(xì),對大家的學(xué)習(xí)或工作具有一定的參考借鑒價值,需要的朋友可以參考下
    2021-08-08
  • python使用socket連接遠(yuǎn)程服務(wù)器的方法

    python使用socket連接遠(yuǎn)程服務(wù)器的方法

    這篇文章主要介紹了python使用socket連接遠(yuǎn)程服務(wù)器的方法,涉及Python中socket通信的基本技巧,具有一定參考借鑒價值,需要的朋友可以參考下
    2015-04-04
  • python批量修改圖片大小的方法

    python批量修改圖片大小的方法

    這篇文章主要為大家詳細(xì)介紹了python批量修改圖片大小的方法,具有一定的參考價值,感興趣的小伙伴們可以參考一下
    2018-07-07

最新評論

海阳市| 蕲春县| 锡林浩特市| 平谷区| 连平县| 诏安县| 应用必备| 潜山县| 府谷县| 黑水县| 兴安盟| 佛山市| 新河县| 霍邱县| 南召县| 文水县| 卢湾区| 长岛县| 乌拉特后旗| 建湖县| 松溪县| 云林县| 和平区| 邹城市| 兴文县| 渝北区| 高安市| 准格尔旗| 伊吾县| 保山市| 二连浩特市| 天津市| 广东省| 正阳县| 阜城县| 荣昌县| 赤峰市| 满城县| 汪清县| 新乡县| 东宁县|