服务器硬件性能测评是服务器选型、性能规划和故障排查的基础工作。CPU、内存、磁盘、网络四类关键指标各有成熟的基准工具与解读方法,本文以Linux系统为背景,给出一套可复制的服务器性能测评流程,并说明测试结果怎么判读、异常怎么定位。
CPU性能基准测试:sysbench与UnixBench
CPU测试先跑sysbench,命令简单、结果直观:
# 单核
sysbench cpu --cpu-max-prime=20000 run
# 多核并发
sysbench cpu --threads=16 --cpu-max-prime=20000 --time=60 run
关注events per second:单线程值代表单核性能,多线程与单线程比值代表扩展性。同型号CPU在不同机器上的events/s接近,偏差超过10%要检查散热降频和电源管理策略。更全面推荐UnixBench,覆盖多核吞吐、浮点、管道与系统调用,适合服务器整机对比测评。
内存稳定性与带宽测试:memtester与lmbench
内存先验稳定性再测性能。memtester做完整读写校验,跑足量内存与轮数:
sudo memtester 8G 5
测试出现错误优先怀疑内存条故障或插槽接触不良。性能用lmbench的bw_mem测带宽、lat_mem测延迟:
cd lmbench && make results
./bw_mem -P 4 1G rd
./lat_mem -P 1 256M 128
DDR5服务器内存带宽在50-90GB/s量级,延迟60-100ns。带宽远低于预期时检查是否只插了一半通道、BIOS是否开启了所有内存通道。
磁盘IOPS基准:fio测试矩阵与结果判定
磁盘性能测评用fio,顺序与随机分别跑,随机又以4K读写为基准。一块NVMe SSD典型测试:
fio --name=randread --ioengine=libaio --rw=randread --bs=4k --size=8G --iodepth=32 --numjobs=8 --direct=1 --runtime=60
判读三个数:IOPS、带宽、时延。随机读IOPS掉到标称一半以下、p99时延超过10ms,基本可以定位为性能劣化或盘片故障。注意测试前确认设备空闲,测试盘不要挂载正在使用的分区。
网络吞吐与延迟测试:iperf3压测
网络性能测评在两端跑iperf3:
# 服务端
iperf3 -s
# 客户端,多流并发测最大吞吐
iperf3 -c 10.0.0.2 -t 60 -P 8
结果看吞吐总和是否接近链路标称值(万兆网卡接近9.4Gbps)。吞吐上不去时,结合ethtool确认网卡速率与双工模式,再用sar -n DEV观察retrans。另外补充ping测试RTT与丢包,网络测评数据入库后与历史值对比,性能劣化能在早期发现。
最后把四类测评结果写进表格,形成服务器硬件性能测评基线,后续任何一次性能异常都有参照物可对比。
原创文章,作者:小编,如若转载,请注明出处:https://www.yunthe.com/linux-fu-wu-qi-ying-jian-xing-neng-ce-ping-shi-zhan-cpu-nei/