python進程池的使用注意
1、使用注意
(1)使用池時,如果未指定進程數(shù),則默認(rèn)為CPU核心數(shù)。
(2)核心數(shù)量對應(yīng)于計算機的邏輯處理器數(shù)量(任務(wù)管理器-性能),而不是核心數(shù)量(我的計算機有2個核心和4個邏輯處理器,因此這里默認(rèn)使用4個進程)
(3)進程數(shù)可以是幾十萬,并不意味著開放進程的數(shù)量是4。只要使用池(10),就可以同時打開10個進程進行爬網(wǎng)。
(4)但是需要注意的是,無論多線程還是多進程,打開過多都會導(dǎo)致切換耗時,降低效率,所以創(chuàng)建過多的多線程和進程是謹(jǐn)慎的。
2、實例
importrequests
frombs4importBeautifulSoup
frommultiprocessingimportPool,current_process
defget_title(i):
print('start',current_process().name)
title_list=[]
url='https://movie.douban.com/top250?start={}&filter='.format(i*25)
r=requests.get(url)
soup=BeautifulSoup(r.content,'html.parser')
lis=soup.find('ol',class_='grid_view').find_all('li')
forliinlis:
title=li.find('span',class_="title").text
#returntitle
title_list.append(title)
print(title)
return(title_list)if__name__=='__main__':
pool=Pool()
foriinrange(10):
pool.apply_async(get_title,(i,))
pool.close()
pool.join()
print('finish')
以上就是python進程池的使用注意,希望能對大家有所幫助。更多Python學(xué)習(xí)教程請關(guān)注IT培訓(xùn)機構(gòu):千鋒教育。