最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

Python使用requests及BeautifulSoup構(gòu)建爬蟲實例代碼

 更新時間:2018年01月24日 11:11:13   作者:sober_qianyang  
這篇文章主要介紹了Python使用requests及BeautifulSoup構(gòu)建爬蟲,介紹了具體操作步驟和實例代碼等相關內(nèi)容,小編覺得還是挺不錯的,這里分享給大家,需要的朋友可以參考下

本文研究的主要是Python使用requests及BeautifulSoup構(gòu)建一個網(wǎng)絡爬蟲,具體步驟如下。

功能說明

在Python下面可使用requests模塊請求某個url獲取響應的html文件,接著使用BeautifulSoup解析某個html。

案例

假設我要http://maoyan.com/board/4貓眼電影的top100電影的相關信息,如下截圖:

獲取電影的標題及url。

安裝requests和BeautifulSoup

使用pip工具安裝這兩個工具。

pip install requests

pip install beautifulsoup4

程序

__author__ = 'Qian Yang'
# -*- coding:utf-8 -*-
import requests
from bs4 import BeautifulSoup
def get_one_page(url):
  response= requests.get(url)
  if response.status_code == 200:
    return response.content.decode("utf8","ignore").encode("gbk","ignore")
#采用BeautifulSoup解析
def bs4_paraser(html):
  all_value = []
  value = {}
  soup = BeautifulSoup(html,'html.parser')
  # 獲取每一個電影
  all_div_item = soup.find_all('div', attrs={'class': 'movie-item-info'})
  for r in all_div_item:
    # 獲取電影的名稱和url
    title = r.find_all(name="p",attrs={"class":"name"})[0].string
    movie_url = r.find_all('p', attrs={'class': 'name'})[0].a['href']
    value['title'] = title
    value['movie_url'] = movie_url
    all_value.append(value)
    value = {}
  return all_value

def main():
  url = 'http://maoyan.com/board/4'
  html = get_one_page(url)
  all_value = bs4_paraser(html)
  print(all_value)

if __name__ == '__main__':
  main()

代碼測試可用,實現(xiàn)效果:

總結(jié)

以上就是本文關于Python使用requests及BeautifulSoup構(gòu)建爬蟲實例代碼的全部內(nèi)容,希望對大家有所幫助。感興趣的朋友可以繼續(xù)參閱本站其他相關專題,如有不足之處,歡迎留言指出。感謝朋友們對本站的支持!

相關文章

  • 探索python?dask靈活的并行計算庫應用場景示例

    探索python?dask靈活的并行計算庫應用場景示例

    這篇文章主要介紹了探索python?dask靈活的并行計算庫應用場景示例,Dask?是?Python?中的一個靈活的并行計算庫,允許用戶利用?CPU?內(nèi)核的強大功能,對大于內(nèi)存的數(shù)據(jù)集執(zhí)行分布式計算
    2024-01-01
  • python進度條顯示之tqmd模塊

    python進度條顯示之tqmd模塊

    這篇文章主要介紹了python進度條顯示之tqmd模塊,本文通過實例代碼給大家介紹的非常詳細,對大家的學習或工作具有一定的參考借鑒價值,需要的朋友可以參考下
    2020-08-08
  • python實現(xiàn)在sqlite動態(tài)創(chuàng)建表的方法

    python實現(xiàn)在sqlite動態(tài)創(chuàng)建表的方法

    這篇文章主要介紹了python實現(xiàn)在sqlite動態(tài)創(chuàng)建表的方法,涉及Python操作SQLite數(shù)據(jù)庫創(chuàng)建數(shù)據(jù)表的技巧,具有一定參考借鑒價值,需要的朋友可以參考下
    2015-05-05
  • python實現(xiàn)每天定時發(fā)送郵件的流程步驟

    python實現(xiàn)每天定時發(fā)送郵件的流程步驟

    這篇文章主要介紹了python實現(xiàn)每天定時發(fā)送郵件的流程步驟,要編寫一個用于自動發(fā)送每日電子郵件報告的 Python 腳本,并配置它在每天的特定時間發(fā)送電子郵件,文中給大家介紹了詳細步驟和示例代碼,需要的朋友可以參考下
    2024-08-08
  • Python模塊的加載講解

    Python模塊的加載講解

    今天小編就為大家分享一篇關于Python模塊的加載講解,小編覺得內(nèi)容挺不錯的,現(xiàn)在分享給大家,具有很好的參考價值,需要的朋友一起跟隨小編來看看吧
    2019-01-01
  • pytorch+lstm實現(xiàn)的pos示例

    pytorch+lstm實現(xiàn)的pos示例

    今天小編就為大家分享一篇pytorch+lstm實現(xiàn)的pos示例,具有很好的參考價值,希望對大家有所幫助。一起跟隨小編過來看看吧
    2020-01-01
  • Python實現(xiàn)層次分析法及自調(diào)節(jié)層次分析法的示例

    Python實現(xiàn)層次分析法及自調(diào)節(jié)層次分析法的示例

    這篇文章主要介紹了Python實現(xiàn)層次分析法及自調(diào)節(jié)層次分析法的示例,文中通過示例代碼介紹的非常詳細,對大家的學習或者工作具有一定的參考學習價值,需要的朋友們下面隨著小編來一起學習學習吧
    2021-04-04
  • python實戰(zhàn)之德州撲克第三步-比較大小

    python實戰(zhàn)之德州撲克第三步-比較大小

    這篇文章主要介紹了python實戰(zhàn)之德州撲克第三步-比較大小,穩(wěn)中有非常詳細的代碼示例,對正在學習python的小伙伴們有很好地幫助,需要的朋友可以參考下
    2021-04-04
  • Python?PaddleNLP開源實現(xiàn)快遞單信息抽取

    Python?PaddleNLP開源實現(xiàn)快遞單信息抽取

    這篇文章主要為大家介紹了Python?PaddleNLP開源項目實現(xiàn)對快遞單信息抽取,有需要的朋友可以借鑒參考下,希望能夠有所幫助,祝大家多多進步,早日升職加薪
    2022-06-06
  • python利用platform模塊獲取系統(tǒng)信息

    python利用platform模塊獲取系統(tǒng)信息

    這篇文章主要介紹了python利用platform模塊獲取系統(tǒng)信息,幫助大家更好的理解和使用python,感興趣的朋友可以了解下
    2020-10-10

最新評論

福泉市| 湛江市| 柏乡县| 宣恩县| 贵南县| 亚东县| 怀仁县| 惠州市| 周口市| 亳州市| 南通市| 南昌市| 襄汾县| 新平| 达拉特旗| 温州市| 宁海县| 独山县| 嵊泗县| 上栗县| 年辖:市辖区| 独山县| 长丰县| 黔东| 名山县| 衡阳县| 广饶县| 泽普县| 马尔康县| 龙川县| 南靖县| 保山市| 灵川县| 余干县| 巴林右旗| 苗栗县| 永修县| 巨鹿县| 湘潭市| 神农架林区| 梓潼县|