cluster模块概览
node实例是单线程作业的。在服务端编程中,通常会创建多个node实例来处理客户端的请求,以此提升系统的吞吐率。对这样多个node实例,我们称之为cluster(集群)。
借助node的cluster模块,开发者可以在几乎不修改原有项目代码的前提下,获得集群服务带来的好处。
集群有以下两种常见的实现方案,而node自带的cluster模块,采用了方案二。
方案一:多个node实例+多个端口
集群内的node实例,各自监听不同的端口,再由反向代理实现请求到多个端口的分发。
优点:实现简单,各实例相对独立,这对服务稳定性有好处。
缺点:增加端口占用,进程之间通信比较麻烦。
方案二:主进程向子进程转发请求
集群内,创建一个主进程(master),以及若干个子进程(worker)。由master监听客户端连接请求,并根据特定的策略,转发给worker。
优点:通常只占用一个端口,通信相对简单,转发策略更灵活。
缺点:实现相对复杂,对主进程的稳定性要求较高。
入门实例
在cluster模块中,主进程称为master,子进程称为worker。
例子如下,创建与CPU数目相同的服务端实例,来处理客户端请求。注意,它们监听的都是同样的端口。
// server.js
var cluster = require('cluster');
var cpuNums = require('os').cpus().length;
var http = require('http');if(cluster.isMaster){
for(var i = 0; i < cpuNums; i++){
cluster.fork();
}
}else{
http.createServer(function(req, res){
res.end(`response from worker ${process.pid}`);
}).listen(3000);
console.log(`Worker ${process.pid} started`);
}
创建批处理脚本:./req.sh。
#!/bin/bash# req.sh
for((i=1;i<=4;i++)); do
curl http://127.0.0.1:3000
echo ""
done
输出如下。可以看到,响应来自不同的进程。
response from worker 23735
response from worker 23731
response from worker 23729
response from worker 23730
cluster模块实现原理
了解cluster模块,主要搞清楚3个问题:
master、worker如何通信?
多个server实例,如何实现端口共享?
多个server实例,来自客户端的请求如何分发到多个worker?
下面会结合示意图进行介绍,源码级别的介绍,可以参考 笔者的github。
问题1:master、worker如何通信
这个问题比较简单。master进程通过 cluster.fork() 来创建 worker进程。cluster.fork() 内部 是通过 child_process.fork() 来创建子进程。









