自拍偷在线精品自拍偷,亚洲欧美中文日韩v在线观看不卡

一篇文章帶你了解Python的分布式進(jìn)程接口

開(kāi)發(fā)
在Thread和Process中,應(yīng)當(dāng)優(yōu)選Process,因?yàn)镻rocess更穩(wěn)定,而且,Process可以分布到多臺(tái)機(jī)器上,而Thread最多只能分布到同一臺(tái)機(jī)器的多個(gè)CPU上。

一、前言

在Thread和Process中,應(yīng)當(dāng)優(yōu)選Process,因?yàn)镻rocess更穩(wěn)定,而且,Process可以分布到多臺(tái)機(jī)器上,而Thread最多只能分布到同一臺(tái)機(jī)器的多個(gè)CPU上。

Python的multiprocessing模塊不但支持多進(jìn)程,其中managers子模塊還支持把多進(jìn)程分布到多臺(tái)機(jī)器上。可以寫(xiě)一個(gè)服務(wù)進(jìn)程作為調(diào)度者,將任務(wù)分布到其他多個(gè)進(jìn)程中,依靠網(wǎng)絡(luò)通信進(jìn)行管理。

二、案例分析

在做爬蟲(chóng)程序時(shí),抓取某個(gè)網(wǎng)站的所有圖片,如果使用多進(jìn)程的話,一般是一個(gè)進(jìn)程負(fù)責(zé)抓取圖片的鏈接地址,將鏈接地址放到queue中,另外的進(jìn)程負(fù)責(zé) 從queue中取鏈接地址進(jìn)行下載和存儲(chǔ)到本地。

怎么用分布式進(jìn)程實(shí)現(xiàn)?

一臺(tái)機(jī)器上的進(jìn)程負(fù)責(zé)抓取鏈接地址,其他機(jī)器上的進(jìn)程負(fù)責(zé)系在存儲(chǔ)。那么遇到的主要問(wèn)題是將queue 暴露到網(wǎng)絡(luò)中,讓其他機(jī)器進(jìn)程都可以訪問(wèn),分布式進(jìn)程就是將這個(gè)過(guò)程進(jìn)行了封裝,可以將這個(gè)過(guò)程稱為本地隊(duì)列的網(wǎng)絡(luò)化。

例:

1.py

from multiprocessing.managers import BaseManager
from multiprocessing import freeze_support, Queue
# 任務(wù)個(gè)數(shù)
task_number = 10


# 收發(fā)隊(duì)列
task_quue = Queue(task_number)
result_queue = Queue(task_number)


def get_task():
    return task_quue


def get_result():
    return result_queue
# 創(chuàng)建類似的queueManager
class QueueManager(BaseManager):
    pass


def win_run():
    # 注冊(cè)在網(wǎng)絡(luò)上,callable 關(guān)聯(lián)了Queue 對(duì)象
    # 將Queue對(duì)象在網(wǎng)絡(luò)中暴露
    # window下綁定調(diào)用接口不能直接使用lambda,所以只能先定義函數(shù)再綁定
    QueueManager.register('get_task_queue', callable=get_task)
    QueueManager.register('get_result_queue', callable=get_result)
    # 綁定端口和設(shè)置驗(yàn)證口令
    manager = QueueManager(address=('127.0.0.1', 8001), authkey='qiye'.encode())
    # 啟動(dòng)管理,監(jiān)聽(tīng)信息通道
    manager.start()


    try:
        # 通過(guò)網(wǎng)絡(luò)獲取任務(wù)隊(duì)列和結(jié)果隊(duì)列
        task = manager.get_task_queue()
        result = manager.get_result_queue()


        # 添加任務(wù)
        for url in ["ImageUrl_" + str(i) for i in range(10)]:
            print('url is %s' % url)
            task.put(url)
            
        print('try get result')
        for i in range(10):
            print('result is %s' % result.get(timeout=10))


    except:
        print('Manager error')
    finally:
        manager.shutdown()


if __name__ == '__main__':
    freeze_support()
    win_run()

連接服務(wù)器,端口和驗(yàn)證口令注意保持與服務(wù)器進(jìn)程中完全一致從網(wǎng)絡(luò)獲取Queue,進(jìn)行本地化,從task隊(duì)列獲取任務(wù),并且把結(jié)果寫(xiě)入result隊(duì)列

2.py

#coding:utf-8
import time
from multiprocessing.managers import BaseManager
# 創(chuàng)建類似的Manager:
class Manager(BaseManager):
    pass
#使用QueueManager注冊(cè)獲取Queue的方法名稱
Manager.register('get_task_queue')
Manager.register('get_result_queue')
#連接到服務(wù)器:
server_addr = '127.0.0.1'
print('Connect to server %s...' % server_addr)
# 端口和驗(yàn)證口令注意保持與服務(wù)進(jìn)程設(shè)置的完全一致:
m = Manager(address=(server_addr, 8001), authkey='qiye')
# 從網(wǎng)絡(luò)連接:
m.connect()
#獲取Queue的對(duì)象:
task = m.get_task_queue()
result = m.get_result_queue()
#從task隊(duì)列取任務(wù),并把結(jié)果寫(xiě)入result隊(duì)列:
while(not task.empty()):
        image_url = task.get(True,timeout=5)
        print('run task download %s...' % image_url)
        time.sleep(1)
        result.put('%s--->success'%image_url)
#結(jié)束:
print('worker exit.')

任務(wù)進(jìn)程要通過(guò)網(wǎng)絡(luò)連接到服務(wù)進(jìn)程,所以要指定服務(wù)進(jìn)程的IP。

運(yùn)行結(jié)果如下:

獲取圖片地址,將地址傳到2.py。

接收1.py傳遞的地址,進(jìn)行圖片的下載,控制臺(tái)顯示爬取結(jié)果。

三、總結(jié)

本文基于Python基礎(chǔ),Python的分布式進(jìn)程接口簡(jiǎn)單,封裝良好,適合需要把繁重任務(wù)分布到多臺(tái)機(jī)器的環(huán)境下。通過(guò)講解Queue的作用是用來(lái)傳遞任務(wù)和接收結(jié)果。

歡迎大家積極嘗試,有時(shí)候看到別人實(shí)現(xiàn)起來(lái)很簡(jiǎn)單,但是到自己動(dòng)手實(shí)現(xiàn)的時(shí)候,總會(huì)有各種各樣的問(wèn)題,切勿眼高手低,勤動(dòng)手,才可以理解的更加深刻。

責(zé)任編輯:華軒 來(lái)源: Go語(yǔ)言進(jìn)階學(xué)習(xí)
相關(guān)推薦

2021-05-12 16:09:18

Python分布式進(jìn)程接口

2021-09-27 09:18:30

ListIterato接口方法

2021-06-29 10:00:02

JavaScriptStorage接口

2024-05-23 15:32:33

StorageJavaScript

2021-08-06 07:51:48

JavaScriptStorage接口

2024-08-06 14:44:48

JavaScriptStorage 接口

2024-10-08 15:51:09

JavaScriptStorage 接口

2021-05-15 09:18:04

Python進(jìn)程

2023-05-12 08:19:12

Netty程序框架

2021-06-30 00:20:12

Hangfire.NET平臺(tái)

2021-04-24 10:19:41

Python函數(shù)指向

2025-02-19 10:39:26

Python高階函數(shù)函數(shù)名

2018-06-25 10:10:11

分布式事務(wù)Transaction

2021-03-24 10:00:32

Python遞歸函數(shù)Python基礎(chǔ)

2021-03-21 07:36:43

Python迭代知識(shí)語(yǔ)言

2023-07-30 15:18:54

JavaScript屬性

2023-05-08 08:21:15

JavaNIO編程

2021-01-26 23:46:32

JavaScript數(shù)據(jù)結(jié)構(gòu)前端

2021-03-09 14:04:01

JavaScriptCookie數(shù)據(jù)

2021-06-24 09:05:08

JavaScript日期前端
點(diǎn)贊
收藏

51CTO技術(shù)棧公眾號(hào)