最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

python實現selenium網絡爬蟲的方法小結

 更新時間:2021年03月11日 11:45:36   作者:不想打代碼了  
這篇文章主要介紹了python實現selenium網絡爬蟲的方法小結,本文給大家介紹的非常詳細,對大家的學習或工作具有一定的參考借鑒價值,需要的朋友可以參考下

selenium最初是一個自動化測試工具,而爬蟲中使用它主要是為了解決requests無法直接執(zhí)行JavaScript代碼的問題,selenium本質是通過驅動瀏覽器,完全模擬瀏覽器的操作,比如跳轉、輸入、點擊、下拉等,來拿到網頁渲染之后的結果,可支持多種瀏覽器,這里只用到谷歌瀏覽器。

1.selenium初始化

方法一:會打開網頁

# 該方法會打開goole網頁
from selenium import webdriver
url = '網址'
driver = webdriver.Chrome()
driver.get(url)
driver.maximize_window() # 實現窗口最大化

方法二:不會打開網頁

# 該方法會隱式打開goole網頁
from selenium import webdriver
url = '網址'
driver = webdriver.ChromeOptions()
driver.add_argument("headless")
driver = webdriver.Chrome(options=driver)
driver.get(url)

driver = webdriver.Chrome()出錯是因為沒有chromedriver.exe這個文件

2.元素定位

在selenium中,可以有多種方法對元素進行定位,個人通常喜歡用Xpath和selector來定位元素,這樣就不用一個一個的去找節(jié)點,直接在網頁上定位到元素復制就行。

driver.find_element_by_id() # 通過元素ID定位
driver.find_element_by_name() # 通過元素Name定位
driver.find_element_by_class_name() # 通過類名定位
driver.find_element_by_tag_name() # 通過元素TagName定位
driver.find_element_by_link_text() # 通過文本內容定位
driver.find_element_by_partial_link_text()
driver.find_element_by_xpath() # 通過Xpath語法定位
driver.find_element_by_css_selector() # 通過選擇器定位

注:若尋找多個元素,要記得用復數來選擇(element改為elements)

# 例如
[i.text for i in driver.find_elements_by_xpath()]

3.建立點擊事件

因為有些網站的需求,需建立點擊事件,
如下圖的這種時間選擇,需要設置點擊和輸入內容,設置的方法也很簡單。

driver.find_element_by_css_selector('').click() # 點擊
driver.find_element_by_css_selector('').send_keys('2021-3-9') # 輸入內容

4.切換窗口

有些網站點擊之后會產生新窗口,這時就需要進行窗口的切換才能進行元素定位

win = driver.window_handles # 獲取當前瀏覽器的所有窗口
driver.switch_to.window(win[-1]) # 切換到最后打開的窗口
driver.close() # 關閉當前窗口
driver.switch_to.window(win[0]) # 切換到最初的窗口

5.iframe問題

有些網站會采用iframe來編寫頁面,這時就需要進入到iframe才可以獲取元素,一般有多少個iframe就需要進入多少個iframe。

# 有兩個iframe,需逐步進入
iframe1 = driver.find_element_by_xpath('')
driver.switch_to.frame(iframe1)
iframe2 = driver.find_element_by_xpath('')
driver.switch_to.frame(iframe2)

到此這篇關于python實現selenium網絡爬蟲的文章就介紹到這了,更多相關python selenium網絡爬蟲內容請搜索腳本之家以前的文章或繼續(xù)瀏覽下面的相關文章希望大家以后多多支持腳本之家!

相關文章

  • python list排序的兩種方法及實例講解

    python list排序的兩種方法及實例講解

    本文主要介紹了python list排序的兩種方法及實例講解。具有很好的參考價值,下面跟著小編一起來看下吧
    2017-03-03
  • TensorFlow MNIST手寫數據集的實現方法

    TensorFlow MNIST手寫數據集的實現方法

    MNIST數據集中包含了各種各樣的手寫數字圖片,這篇文章主要介紹了TensorFlow MNIST手寫數據集的實現方法,需要的朋友可以參考下
    2020-02-02
  • Django app配置多個數據庫代碼實例

    Django app配置多個數據庫代碼實例

    這篇文章主要介紹了Django app配置多個數據庫代碼實例,文中通過示例代碼介紹的非常詳細,對大家的學習或者工作具有一定的參考學習價值,需要的朋友可以參考下
    2019-12-12
  • 使用 setuptools 在 Python 中安裝 egg 文件

    使用 setuptools 在 Python 中安裝 egg 

    Eggs 是 Python 中以前使用的一種分發(fā)格式,它包含特定項目所需的信息,從依賴項到環(huán)境變量,在本文中,我們將討論如何在 Python 中安裝 egg 文件,以及可用于實現此操作的工具,感興趣的朋友一起看看吧
    2023-08-08
  • Python 中Operator模塊的使用

    Python 中Operator模塊的使用

    這篇文章主要介紹了Python 中Operator模塊的使用,幫助大家更好的理解和使用python,感興趣的朋友可以了解下
    2021-01-01
  • django-filter和普通查詢的例子

    django-filter和普通查詢的例子

    今天小編就為大家分享一篇django-filter和普通查詢的例子,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧
    2019-08-08
  • python用列表生成式寫嵌套循環(huán)的方法

    python用列表生成式寫嵌套循環(huán)的方法

    今天小編就為大家分享一篇python用列表生成式寫嵌套循環(huán)的方法,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧
    2018-11-11
  • 關于CUDA out of memory的解決方案

    關于CUDA out of memory的解決方案

    這篇文章主要介紹了關于CUDA out of memory的解決方案,具有很好的參考價值,希望對大家有所幫助。如有錯誤或未考慮完全的地方,望不吝賜教
    2023-02-02
  • Python機器學習logistic回歸代碼解析

    Python機器學習logistic回歸代碼解析

    這篇文章主要介紹了Python機器學習logistic回歸代碼解析,具有一定借鑒價值,需要的朋友可以參考下
    2018-01-01
  • Python手動實現Hough圓變換的示例代碼

    Python手動實現Hough圓變換的示例代碼

    Hough圓變換的原理相信大家都非常清楚了,但是手動實現的比較少。這篇文章將為大家介紹手動實現Hough圓變換的示例代碼,需要的可以了解一下
    2022-01-01

最新評論

西宁市| 河源市| 柳州市| 新绛县| 阳泉市| 石林| 阿坝| 徐闻县| 乐清市| 象山县| 马关县| 平果县| 固镇县| 奈曼旗| 湖州市| 甘洛县| 北辰区| 金山区| 丘北县| 思南县| 拜城县| 长治市| 池州市| 南丹县| 连山| 伊春市| 武汉市| 治多县| 韩城市| 论坛| 嘉兴市| 酉阳| 乃东县| 凯里市| 奉节县| 台江县| 如东县| 依兰县| 昌宁县| 黄平县| 襄汾县|