最新国产好看的视频,伊人天堂AV在线,国产Aaaaaa视频,蜜臀视频在线观看一区,人妻av色图,密臀久久久精品影片,青青视频免费观看毛片,久草在线观看视,国产三级精品色情在线

Python之ThreadPoolExecutor線程池問題

 更新時間:2023年03月14日 10:16:22   作者:程序猿-張益達  
這篇文章主要介紹了Python之ThreadPoolExecutor線程池問題,具有很好的參考價值,希望對大家有所幫助。如有錯誤或未考慮完全的地方,望不吝賜教

概念

Python中已經(jīng)有了threading模塊,為什么還需要線程池呢,線程池又是什么東西呢?

以爬蟲為例,需要控制同時爬取的線程數(shù),例子中創(chuàng)建了20個線程,而同時只允許3個線程在運行,但是20個線程都需要創(chuàng)建和銷毀,線程的創(chuàng)建是需要消耗系統(tǒng)資源的,有沒有更好的方案呢?

其實只需要三個線程就行了,每個線程各分配一個任務,剩下的任務排隊等待,當某個線程完成了任務的時候,排隊任務就可以安排給這個線程繼續(xù)執(zhí)行。

這就是線程池的思想(當然沒這么簡單),但是自己編寫線程池很難寫的比較完美,還需要考慮復雜情況下的線程同步,很容易發(fā)生死鎖。

Python3.2開始,標準庫為我們提供了concurrent.futures模塊,它提供了ThreadPoolExecutorProcessPoolExecutor兩個類,實現(xiàn)了對threadingmultiprocessing的進一步抽象(這里主要關注線程池),不僅可以幫我們自動調(diào)度線程,還可以做到:

  • 主線程可以獲取某一個線程(或者任務的)的狀態(tài),以及返回值。
  • 當一個線程完成的時候,主線程能夠立即知道。
  • 讓多線程和多進程的編碼接口一致。

實例

簡單使用

from concurrent.futures import ThreadPoolExecutor
import time
 
# 參數(shù)times用來模擬網(wǎng)絡請求的時間
def get_html(times):
    time.sleep(times)
    print("get page {}s finished".format(times))
    return times
 
executor = ThreadPoolExecutor(max_workers=2)
# 通過submit函數(shù)提交執(zhí)行的函數(shù)到線程池中,submit函數(shù)立即返回,不阻塞
task1 = executor.submit(get_html, (3))
task2 = executor.submit(get_html, (2))
# done方法用于判定某個任務是否完成
print(task1.done())
# cancel方法用于取消某個任務,該任務沒有放入線程池中才能取消成功
print(task2.cancel())
time.sleep(4)
print(task1.done())
# result方法可以獲取task的執(zhí)行結果
print(task1.result())
 
# 執(zhí)行結果
# False  # 表明task1未執(zhí)行完成
# False  # 表明task2取消失敗,因為已經(jīng)放入了線程池中
# get page 2s finished
# get page 3s finished
# True  # 由于在get page 3s finished之后才打印,所以此時task1必然完成了
# 3     # 得到task1的任務返回值

ThreadPoolExecutor構造實例的時候,傳入max_workers參數(shù)來設置線程池中最多能同時運行的線程數(shù)目。

使用submit函數(shù)來提交線程需要執(zhí)行的任務(函數(shù)名和參數(shù))到線程池中,并返回該任務的句柄(類似于文件、畫圖),注意submit()不是阻塞的,而是立即返回。

通過submit函數(shù)返回的任務句柄,能夠使用done()方法判斷該任務是否結束。上面的例子可以看出,由于任務有2s的延時,在task1提交后立刻判斷,task1還未完成,而在延時4s之后判斷,task1就完成了。

使用cancel()方法可以取消提交的任務,如果任務已經(jīng)在線程池中運行了,就取消不了。這個例子中,線程池的大小設置為2,任務已經(jīng)在運行了,所以取消失敗。如果改變線程池的大小為1,那么先提交的是task1,task2還在排隊等候,這是時候就可以成功取消。

使用result()方法可以獲取任務的返回值。查看內(nèi)部代碼,發(fā)現(xiàn)這個方法是阻塞的。

as_completed

上面雖然提供了判斷任務是否結束的方法,但是不能在主線程中一直判斷啊。

有時候我們是得知某個任務結束了,就去獲取結果,而不是一直判斷每個任務有沒有結束。

這是就可以使用as_completed方法一次取出所有任務的結果。

from concurrent.futures import ThreadPoolExecutor, as_completed
import time
 
# 參數(shù)times用來模擬網(wǎng)絡請求的時間
def get_html(times):
    time.sleep(times)
    print("get page {}s finished".format(times))
    return times
 
executor = ThreadPoolExecutor(max_workers=2)
urls = [3, 2, 4] # 并不是真的url
all_task = [executor.submit(get_html, (url)) for url in urls]
 
for future in as_completed(all_task):
    data = future.result()
    print("in main: get page {}s success".format(data))
 
# 執(zhí)行結果
# get page 2s finished
# in main: get page 2s success
# get page 3s finished
# in main: get page 3s success
# get page 4s finished
# in main: get page 4s success

as_completed()方法是一個生成器,在沒有任務完成的時候,會阻塞,在有某個任務完成的時候,會yield這個任務,就能執(zhí)行for循環(huán)下面的語句,然后繼續(xù)阻塞住,循環(huán)到所有的任務結束。

從結果也可以看出,先完成的任務會先通知主線程。

map

除了上面的as_completed方法,還可以使用executor.map方法,但是有一點不同。

from concurrent.futures import ThreadPoolExecutor
import time
 
# 參數(shù)times用來模擬網(wǎng)絡請求的時間
def get_html(times):
    time.sleep(times)
    print("get page {}s finished".format(times))
    return times
 
executor = ThreadPoolExecutor(max_workers=2)
urls = [3, 2, 4] # 并不是真的url
 
for data in executor.map(get_html, urls):
    print("in main: get page {}s success".format(data))
# 執(zhí)行結果
# get page 2s finished
# get page 3s finished
# in main: get page 3s success
# in main: get page 2s success
# get page 4s finished
# in main: get page 4s success

使用map方法,無需提前使用submit方法,map方法與python標準庫中的map含義相同,都是將序列中的每個元素都執(zhí)行同一個函數(shù)。

上面的代碼就是對urls的每個元素都執(zhí)行get_html函數(shù),并分配各線程池。可以看到執(zhí)行結果與上面的as_completed方法的結果不同,輸出順序和urls列表的順序相同,就算2s的任務先執(zhí)行完成,也會先打印出3s的任務先完成,再打印2s的任務完成。

wait

wait方法可以讓主線程阻塞,直到滿足設定的要求。

from concurrent.futures import ThreadPoolExecutor, wait, ALL_COMPLETED, FIRST_COMPLETED
import time
 
# 參數(shù)times用來模擬網(wǎng)絡請求的時間
def get_html(times):
    time.sleep(times)
    print("get page {}s finished".format(times))
    return times
 
executor = ThreadPoolExecutor(max_workers=2)
urls = [3, 2, 4] # 并不是真的url
all_task = [executor.submit(get_html, (url)) for url in urls]
wait(all_task, return_when=ALL_COMPLETED)
print("main")
# 執(zhí)行結果 
# get page 2s finished
# get page 3s finished
# get page 4s finished
# main

wait方法接收3個參數(shù),等待的任務序列、超時時間以及等待條件。

等待條件return_when默認為ALL_COMPLETED,表明要等待所有的任務都結束。

可以看到運行結果中,確實是所有任務都完成了,主線程才打印出main。

等待條件還可以設置為FIRST_COMPLETED,表示第一個任務完成就停止等待。

源碼分析

cocurrent.future模塊中的future的意思是未來對象,可以把它理解為一個在未來完成的操作,這是異步編程的基礎 。

在線程池submit()之后,返回的就是這個future對象,返回的時候任務并沒有完成,但會在將來完成。

也可以稱之為task的返回容器,這個里面會存儲task的結果和狀態(tài)。

ThreadPoolExecutor內(nèi)部是如何操作這個對象的呢?

下面簡單介紹ThreadPoolExecutor的部分代碼:

1.init方法

init方法中主要重要的就是任務隊列和線程集合,在其他方法中需要使用到。

2.submit方法

submit中有兩個重要的對象,_base.Future()_WorkItem()對象,_WorkItem()對象負責運行任務和對future對象進行設置,最后會將future對象返回,可以看到整個過程是立即返回的,沒有阻塞。

3.adjust_thread_count方法

這個方法的含義很好理解,主要是創(chuàng)建指定的線程數(shù)。但是實現(xiàn)上有點難以理解,比如線程執(zhí)行函數(shù)中的weakref.ref,涉及到了弱引用等概念,留待以后理解。

4._WorkItem對象

_WorkItem對象的職責就是執(zhí)行任務和設置結果。這里面主要復雜的還是self.future.set_result(result)。

5.線程執(zhí)行函數(shù)--_worker

這是線程池創(chuàng)建線程時指定的函數(shù)入口,主要是從隊列中依次取出task執(zhí)行,但是函數(shù)的第一個參數(shù)還不是很明白。留待以后。

總結

future的設計理念很棒,在線程池/進程池和攜程中都存在future對象,是異步編程的核心。

ThreadPoolExecutor 讓線程的使用更加方便,減小了線程創(chuàng)建/銷毀的資源損耗,無需考慮線程間的復雜同步,方便主線程與子線程的交互。

線程池的抽象程度很高,多線程和多進程的編碼接口一致。

以上為個人經(jīng)驗,希望能給大家一個參考,也希望大家多多支持腳本之家。

相關文章

  • Python使用itertools模塊實現(xiàn)排列組合功能示例

    Python使用itertools模塊實現(xiàn)排列組合功能示例

    這篇文章主要介紹了Python使用itertools模塊實現(xiàn)排列組合功能,涉及Python基于itertools模塊product、permutations與combinations_with_replacement方法進行排列、組合等相關操作實現(xiàn)技巧,需要的朋友可以參考下
    2018-07-07
  • Django的用戶模塊與權限系統(tǒng)的示例代碼

    Django的用戶模塊與權限系統(tǒng)的示例代碼

    這篇文章主要介紹了Django的用戶模塊與權限系統(tǒng)的示例代碼,文中通過示例代碼介紹的非常詳細,對大家的學習或者工作具有一定的參考學習價值,需要的朋友們下面隨著小編來一起學習學習吧
    2019-07-07
  • python學習之plot函數(shù)的使用教程

    python學習之plot函數(shù)的使用教程

    這篇文章主要給大家介紹了關于python學習之plot函數(shù)的使用教程,文中通過示例代碼介紹的非常詳細,對大家的學習或者工作具有一定的參考學習價值,需要的朋友們下面隨著小編來一起學習學習吧
    2021-04-04
  • Python帶參數(shù)的裝飾器運行原理解析

    Python帶參數(shù)的裝飾器運行原理解析

    這篇文章主要介紹了Python帶參數(shù)的裝飾器運行原理解析,文中通過示例代碼介紹的非常詳細,對大家的學習或者工作具有一定的參考學習價值,需要的朋友可以參考下
    2020-06-06
  • Python中的urllib庫高級用法教程

    Python中的urllib庫高級用法教程

    這篇文章主要介紹了Python中的urllib庫高級用法教程,想要請求需要設置一些請求頭,如果要在請求的時候增加一些請求頭,那么就必須使用request.Request類來實現(xiàn)了,比如要增加一個 User-Agent ,增加一個 Referer 頭信息等,需要的朋友可以參考下
    2023-10-10
  • pandas修改DataFrame列名的實現(xiàn)方法

    pandas修改DataFrame列名的實現(xiàn)方法

    這篇文章主要介紹了pandas修改DataFrame列名的實現(xiàn)方法, 文中通過示例代碼介紹的非常詳細,對大家的學習或者工作具有一定的參考學習價值,需要的朋友們下面隨著小編來一起學習學習吧
    2019-02-02
  • Python中實現(xiàn)列表的逆序、復制與清除的幾種常見方法

    Python中實現(xiàn)列表的逆序、復制與清除的幾種常見方法

    本文介紹了Python中列表的逆序、復制和清除操作,通過reverse()方法、切片、copy()方法和clear()方法,我們可以輕松地對列表進行這些操作
    2024-12-12
  • python常用函數(shù)random()函數(shù)詳解

    python常用函數(shù)random()函數(shù)詳解

    這篇文章主要介紹了python常用函數(shù)random()函數(shù),本文通過實例代碼給大家介紹的非常詳細,對大家的學習或工作具有一定的參考借鑒價值,需要的朋友可以參考下
    2023-02-02
  • python3中No module named _ssl的問題解決

    python3中No module named _ssl的問題解決

    本文主要介紹了python3中No module named _ssl的問題解決,這個錯誤表示Python導入_ssl模塊時失敗,文中通過示例代碼介紹的非常詳細,對大家的學習或者工作具有一定的參考學習價值,需要的朋友們下面隨著小編來一起學習學習吧
    2024-08-08
  • Python實現(xiàn)隨機密碼生成器實例

    Python實現(xiàn)隨機密碼生成器實例

    這篇文章主要介紹了Python實現(xiàn)隨機密碼生成器實例,string.printable是string中的可打印字符,用strip函數(shù)首尾去掉空格,random模塊用來取字符,random.choice隨機取字符,將隨機取出的字符與password空字符串進行拼接,最后用print輸出,需要的朋友可以參考下
    2023-09-09

最新評論

陇川县| 梁山县| 南华县| 山丹县| 九寨沟县| 江城| 新竹县| 汉中市| 犍为县| 莫力| 平利县| 潍坊市| 民勤县| 罗甸县| 锦州市| 德令哈市| 治县。| 太保市| 井冈山市| 和平区| 三原县| 绥中县| 大余县| 中西区| 吉林市| 延川县| 海丰县| 东兰县| 慈利县| 太康县| 松滋市| 武穴市| 东莞市| 阳信县| 锡林郭勒盟| 达日县| 石台县| 习水县| SHOW| 大新县| 商洛市|