最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

python簡單爬蟲--get方式詳解

 更新時(shí)間:2021年09月09日 11:18:27   作者:趙趙要加油啊  
本篇文章介紹了python爬蟲中g(shù)et和post方法介紹以及cookie作用,對(duì)此有興趣的朋友學(xué)習(xí)下,希望能夠給你帶來幫助

簡單爬蟲可以劃分為get、post格式。其中,get是單方面的獲取資源,而post存在交互,如翻譯中需要文字輸入。本文主要描述簡單的get爬蟲。

環(huán)境準(zhǔn)備

安裝第三方庫

pip install requests
pip install bs4
pip install lxml

進(jìn)行爬蟲

1.獲取網(wǎng)頁數(shù)據(jù)。

import requests
from bs4 import BeautifulSoup
url = "https://cn.bing.com/search?q=爬蟲CSDN&qs=n&form=QBRE&sp=-1&pq=爬蟲csdn&sc=5-6&sk=&cvid=0B13B88D8F444A0182A4A6C36E463179/"
response = requests.get(self.url)

2.解析網(wǎng)頁數(shù)據(jù)

soup = BeautifulSoup(response.text, 'lxml')

3.選取目標(biāo)數(shù)據(jù)。此處key 依據(jù)源代碼目標(biāo)標(biāo)題的位置確定。首先進(jìn)入開發(fā)者模式,后查看目標(biāo)在html中的位置,右擊選擇“復(fù)制selector”,見下圖。

在這里插入圖片描述

key = "#b_results > li > div.b_title > h2 > a"
soup.select(key)

4.清洗數(shù)據(jù)

result = {}
for i, item in enumerate(data):
     result.update({
         f'title_{i}': item.get_text(),
         f'url_{i}': item.get('href')
     })
 print(result)

參考

鏈接:http://www.fzitv.net/article/152560.htm

總結(jié)

本篇文章就到這里了,希望能夠給你帶來幫助,也希望您能夠多多關(guān)注腳本之家的更多內(nèi)容!

相關(guān)文章

最新評(píng)論

景德镇市| 六盘水市| 金湖县| 茌平县| 巴塘县| 无极县| 小金县| 普安县| 探索| 托克逊县| 江安县| 林甸县| 博湖县| 浮山县| 湖州市| 灌阳县| 临漳县| 惠安县| 西华县| 忻城县| 马龙县| 凌云县| 自治县| 盐边县| 安龙县| 新宁县| 汝南县| 象山县| 磐石市| 额敏县| 中江县| 临朐县| 新沂市| 洪泽县| 阿坝| 平乐县| 海宁市| 洛川县| 墨脱县| 遂川县| 塘沽区|