`

[Binospace] Linux系统性能分析的实践方法

阅读更多
任何系统的性能分析以及分布式负载平衡策略的执行,需要首先了解当前系统的资源使用情况。
从资源角度进行划分,可以把资源分为如下4类:
1)处理器资源,CPU
2)内存资源,Memory,从广义概念上讲,这还包括Swap\Cache\Buffer等
3)磁盘资源,Disk
4) 网络资源,Network IO,从广义概念上讲,还要考虑上层网络交换机的带宽和交换机之间的带宽。
 
1、CPU分析
CPU分析常用的工具top。
 
 
2、内存分析
内存分析最常用的工具有free、vmstat等。
一般内存的分析要分成两个层次来进行:
1)系统层面上。free可以查看当前系统的内存使用状况,用来分析机器的内存整体使用状况。
Linux内核为了获取更好的性能,总会尽可能地使用空余内存作为系统Cache,从上图可以看到有23G的系统Cache,对于读多写少的应用而言,这个数据是正常的。
vmstat是一个可以实时查看当前CPU、内存、swap使用的情况,该命令是系统监控与分析的一个常用工具。
  • procs:标识了当前有多少进程正在等待执行,由此来判断是否因为资源紧张而造成进程的流程运行。r标示了有多少个进程等待获得CPU访问权限,b代表了有多少个进程处于Sleep状态。一般而言,r b都为0,如果出现b>0的情况,往往是CPU资源不足的一个信号,此时,或许有大量的IO吞吐的应用在执行,或者运行的process消耗了太多的CPU时间片。
  • memory: 标识了系统的内存使用状况。具体数值与free命令类似。
  • swap:标识了系统的swap的使用的情况,si代表了当前有多少数据从swap区域被置换到内存区域,so代表有多少数据从内存区域被换入到swap。如果系统出现频繁的出现swap换入换出的状况,会影响到系统的性能。
  • io:标识了磁盘的读写的活跃情况。bi每秒读block的个数,bo每秒写block的个数,上图中,可以看到当前系统会有较多的写磁盘操作。
  • System:in代表每秒系统中断的个数,包括来自于System Clock的中断;cs代表系统上下文切换的次数。
  • CPU:us代表用于处理用户态任务的百分比,sy kernel相关的任务占用的百分比,id 空闲状态的百分比,wa:等待IO的百分比。根据经验,id低于40%表示当前系统处于比较繁忙的状态,wa如果较大往往会造成procs中r的值升高。
另外,vmstat -m 会打印slab信息,在Linux Kernel2.2版本引进了slab allocation的分配方式,从而可以更快速的掌握当前系统的内存分配状况。所有的应用程序内存的使用,最终都会映射成对应Cache下的slab空间,因此,通过可以分析出当前系统的内存开辟的分布情况。
 
跟进一步,我们来看一下在Linux Kernel中内存的原理。在内核中,内存是按照Pages进行组织的,内存分为三类:
1)Read Pages,这部分内存是从disk读取出来的,且在内存中没有做任何修改的数据,常见的形式,如:以Read形式打开的文件、执行的Binary、或者加载的Library等。Linux会尽可能按照需要把数据导入内存,因此,在大部分情况下我们使用free命令看到的Cache部分的内存总会比较大。当内存开始变得短缺时,内核会开始从Cache的数据进行淘汰。
2)Dirty Pages,Kernel修改的内存的数据,并需要写回磁盘的数据。系统进程pdflush就是执行该操作。一旦系统的内存变得短缺,系统进程kswapd会写这些page到磁盘。
3)Anonymous Pages,还有一部分的数据,并没有与一个文件或者设备相对应,但是它存在于一个进程内部。例如:我们在程序中使用的Map结构存储的应用的数据之类的。在内存紧张的时候,kswapd进程会将这些内存写入swap区域,以保证系统的内存空间。
 
 
高级一点的内存分析工具有:
pcat、memdump、htop。
pcat可以dump出某个process的内存镜像。在某些特殊的情况下,我们无法分析应用的性能的瓶颈的时候,可以使用该工具。配合strings,可以查看进程里都有那些数据,这可以在一定程度上降低被hang住的程序丢失数据的影响。注意pcat基本会打印全部的内存镜像,所以生成的文件较大。
memdump会打印出系统整个内存镜像。
htop是一个类似与top,但功能更加强大的工具,可以实现对各种系统参数的分析。
 
 
优化策略与补充:
1)对于性能要求比较高,同时机器物理内存足够使用的情况下,建议关闭swap分区。如果有ssd的情况下,可以使用ssd空间挂载swap分区。
2)对于JAVA进程,除了使用以上介绍的工具进行profiling之外,还要注意GC的影响,目前根据使用的情况来看,如果使用CMS老生代垃圾回收器,对于IO压力比较高的应用来,不要把CMSInitiatingOccupancyFraction的值设置超过70,一般来看设置在50~60之间比较合适。
 
3、磁盘分析
目前常用磁盘分析工具有:iostat、iotop、lsof、sar
iostat分析当前系统的整体的读写吞吐。
iotop可以定位io吞吐比较大的进程。
lsof可以查看某个pid下操作的文件。
使用iostat分析随机读还是随机写应用
使用/sbin/hdparm -t /dev/sda测试磁盘/dev/sda的读速度
优化策略:
1)分离系统盘成为独立的volumn。这样做,避免因为应用程序的误操作,造成系统盘的IO过重从而导致系统不可用。上次我们线上Hadoop出现的一次故障,就是因为Hadoop的用户日志数据与系统的根目录属于同一个volumn(有关概念可参考http://en.wikipedia.org/wiki/Logical_Volume_Manager_%28Linux%29),由于用户的maptask频繁写log,造成系统盘的io util长时间处于100%,从而造成节点响应速度变慢。
2) 如果是搭建具有容错特性的系统,尽可能使用单盘Raid0。这样设置的好处是在磁盘故障时造成的影响较小,而且容易监控。
 
目前,很多系统都是用SSD来提升系统的性能,作为ssd来说,它的物理特性决定了在高速的同时,有更高出现故障的风险,因此,合理的监控可以有利于系统的维护。
 
诊断标准:
 ssd_badblock -d /dev/$ssd_id  bad_block的概率超过0.006%就认为有问题,
 ssd_bitflip -d /dev/$item 出现unrecoverable的个数大于0,认为出现了问题。
 
 
4、网络分析
常用工具:
netstat获取网络使用的信息,这里
nload:获得上行(ongoing)和下行(incoming)的实时网络数据,包含从nload收集到目前为止出现的Max、Min、Average、Current、以及累计的流量。
这个工具适用于获取当前节点的网络流量状况,并由此判断节点的网络负载压力。
如果是网卡是千兆容量,1000Mbps,实际上,如果发现Curr的值超过1000M或者Max超过1000M,或者Avg的值在750M以上,此时配合其它节点ping操作确认该影响。下图就是借助多窗口管理器tmux同时查看nload和ping的状态。
 
以端口提供的服务,需要跟踪端口上相关连接的状态,例如,我们通过ThriftServer对外提供服务,出现了很多的CLOSE_WAIT状态的连接,经过分析,是由于客户端没有正常关闭对应的handler造成的。如果不及时关闭该链接,会造成因为端口上的连接数过多引起的访问故障。
 
另外,网络状况需要配合使用ethtool、/sbin/ifconfig 来查看网卡传输数据的情况,尤其查看丢包、错误包的情况,避免因为硬件问题造成的网络服务质量下降的现象。
 
 
通过以上的分析,可以确认是否因为网络流量拥塞造成的应用服务性能下降,因为如果网卡长时间处于饱和状态运行,虽然网络协议栈可以保证数据传输的可靠性,但是以Network-IO Intensive的应用就会出现瓶颈,例如Hadoop作业、需要高吞吐的数据库等。目前,这种问题的优化方案是:
1)在应用层面增加数据压缩,降低网络传输的开销。(例如hadoop/hbase 使用lzo压缩)
2)在网络架构上,可以通过网卡bonding。绑定两个千兆网卡,可以增加到2000Mbps的流量,会在很大程度上缓解压力。
3)尝试使用异步模式。根据有些应用的特征,事件驱动模型和异步策略可以实现IO复用,在一定程度上控制网络传输的效率,缓解负载的压力。Linux asynchronous I/O可以参考http://www.ibm.com/developerworks/linux/library/l-async/
 
总结:系统性能分析的实践方法是一个涉及多个领域的知识积累,下图表示了一个系统分析的Trace方法。

文章的脚注信息由WordPress的wp-posturl插件自动生成

分享到:
评论

相关推荐

    第11讲:深入理解指针(1).pdf

    第11讲:深入理解指针(1)

    springboot整合 freemarker方法

    springboot整合 freemarker方法

    第14讲:深入理解指针(4).pdf

    第14讲:深入理解指针(4)

    同行者4.1.2语音助手

    《同行者4.1.2语音助手:车机版安装详解》 在现代科技日新月异的时代,智能车载设备已经成为了汽车生活的重要组成部分。"同行者4.1.2"便是这样一款专为车机设计的语音助手,旨在提供更为便捷、安全的驾驶体验。该版本针对掌讯全系列设备进行了兼容优化,让车主能够轻松实现语音控制,减少驾驶过程中的手动操作,提升行车安全性。 我们来了解下"同行者4.1.2"的核心功能。这款语音助手集成了智能语音识别技术,用户可以通过简单的语音指令完成导航、音乐播放、电话拨打等一系列操作,有效避免了因操作手机或车机带来的分心。此外,其强大的语义理解和自学习能力,使得它能逐步适应用户的口音和习惯,提供更个性化的服务。 在安装过程中,用户需要注意的是,"同行者4.1.2"包含了四个核心组件,分别是: 1. TXZCore.apk:这是同行者语音助手的基础框架,包含了语音识别和处理的核心算法,是整个应用运行的基础。 2. com.txznet.comm.base.BaseApplication.apk:这个文件可能包含了应用的公共模块和基础服务,为其他组件提供支持。 3. TXZsetting.apk:这

    市场拓展主管绩效考核表.xls

    市场拓展主管绩效考核表

    “线上购车3D全方位体验:汽车模型展示与个性化定制功能”,three.js案例- 线上购车3d展示(源码) 包含内容:1.汽车模型展示;2.汽车肤;3.轮毂部件更;4.开关车门动画;5.汽车尺寸测量

    “线上购车3D全方位体验:汽车模型展示与个性化定制功能”,three.js案例- 线上购车3d展示(源码) 包含内容:1.汽车模型展示;2.汽车肤;3.轮毂部件更;4.开关车门动画;5.汽车尺寸测量;6.自动驾驶;7.镜面倒影;8.hdr运用;9.移动端适配; 本为html+css+three.js源码 ,核心关键词:three.js案例; 线上购车3D展示; 汽车模型展示; 汽车换肤; 轮毂部件更换; 开关车门动画; 汽车尺寸测量; 自动驾驶; 镜面倒影; HDR运用; 移动端适配; HTML+CSS+three.js源码。,"Three.js源码:线上购车3D展示案例,含汽车模型、换肤、轮毂更换等九大功能"

    (数据权威)中国城市_县域统计面板数据二合一

    数据名称:2000-2022年各县市区主要社会经济发展指标面板数据 数据类型:dta格式 数据来源:中国县域统计

    120页-环卫车项目初步方案.pdf

    一、智慧环卫管理平台的建设背景与目标 智慧环卫管理平台的建设源于对环卫管理全面升级的需求。当前,城管局已拥有139辆配备车载GPS系统、摄像头和油耗传感器的环卫车辆,但环卫人员尚未配备智能移动终端,公厕也缺乏信息化系统和智能终端设备。为了提升环卫作业效率、实现精细化管理并节省开支,智慧环卫管理平台应运而生。该平台旨在通过信息化技术和软硬件设备,如车载智能终端和环卫手机App,实时了解环卫人员、车辆的工作状态、信息和历史记录,使环卫作业管理透明化、精细化。同时,平台还期望通过数据模型搭建和数据研读,实现更合理的环卫动态资源配置,为环卫工作的科学、健康、持续发展提供决策支持。 二、智慧环卫管理平台的建设内容与功能 智慧环卫管理平台的建设内容包括运行机制体制建设、业务流程设计、智慧公厕系统建设、网络建设、主机和储存平台需求、平台运维管理体系、硬件标准规范体系以及考核评价体系等多个方面。其中,智慧公厕系统建设尤为关键,它能实时监控公厕运行状态,保障公厕的清洁和正常运行。平台建设还充分利用了现有的电子政务网络资源,并考虑了有线和无线网络的需求。在功能上,平台通过普查、整合等手段全面收集环卫车辆、企业、人员、设施、设备等数据,建立智慧环卫基础数据库。利用智能传感、卫星定位等技术实现环卫作业的在线监管和远程监控,实现对道路、公共场所等的作业状况和卫生状况的全面监管。此外,平台还建立了环卫作业网格化管理责任机制,实现从作业过程到结果的全面监管,科学评价区域、部门、单位和人员的作业效果。 三、智慧环卫管理平台的效益与风险规避 智慧环卫管理平台的建设将带来显著的环境、经济和管理效益。环境方面,它将有力推进环境卫生监管服务工作,改善环境卫生状况,为人民群众创造更加清洁、卫生的工作和生活环境。经济方面,通过智慧化监管,大大降低了传统管理手段的成本,提高了监管的准确性和效率。管理方面,平台能够追踪溯源市民反映的问题,如公厕异味、渣土车辆抛洒等,并找到相应的责任单位进行处置,防止类似事件再次发生。同时,平台还拥有强大的预警机制功能,能够在很多环卫问题尚未出现前进行处置。然而,平台建设也面临一定的风险,如部门协调、配合问题,建设单位选择风险以及不可预测的自然灾害等。为了规避这些风险,需要加强领导、统一思想,选择优秀的系统集成商承接项目建设,并做好计算机和应用系统的培训工作。同时,也要注意标准制定工作和相关法律法规的制定工作,以保证系统建设完成后能够真正为环卫管理工作带来便利。

    36 -企业管理主管绩效考核表1.xlsx

    36 -企业管理主管绩效考核表1

    1.1 -1.4 工程代码

    1.1 -1.4 工程代码

    USDT合约,USDT智能合约

    USDT合约,USDT智能合约

    基于姿态估计三维人脸形状重建.pdf

    基于姿态估计三维人脸形状重建.pdf

    一般员工绩效考核表模板(通用版) (2).xls

    一般员工绩效考核表模板(通用版) (2)

    全国295个地级市2011-2022互联网宽带接入用户数互联网普及率(数据权威)

    全国各省295地级市互联网普及率、互联网用户数、每百人互联网宽带用户(2011-2022年) 数据年份:2011-2022年(2022存在部分缺失) 数据范围:全国各省295个地级市 数据来源:地方统计局

    (数据权威)碳排放、碳中和、碳交易、碳金融、碳计算、碳建模资料

    一、各省、分行业CO2排放、283个地级市碳排放及计算过程 2.分行业二氧化碳排放量 在这里插入图片描述 3、280多个地级市碳排放及计算过程 二、碳中和文献、最新政策、碳金融数据+数学建模 1.二氧化碳减排规划,碳金融数据收集及数学建模 2.碳中和政策和下载量最高的碳中和论文 三、碳排放+碳市场+碳交易+碳中和+碳排放核算Excel自动计算表 全行业碳排放核算Excel自动计算表 四、碳交易数据 五、主要能源碳排放计算参数

    第20讲:自定义类型:结构体.pdf

    第20讲:自定义类型:结构体

    视觉跟踪算法综述.pdf

    视觉跟踪算法综述.pdf

    MATLAB超效率SBM-DEA模型代码详解:简易操作指南及期望与非期望产出的超效率分析,附Malmquist指数与分解功能,MATLAB的超效率SBM-DEA模型代码(有安装教程和内容讲解之类的东西

    MATLAB超效率SBM-DEA模型代码详解:简易操作指南及期望与非期望产出的超效率分析,附Malmquist指数与分解功能,MATLAB的超效率SBM-DEA模型代码(有安装教程和内容讲解之类的东西),操作很简单 可以做期望产出和非期望产出的超效率和非超效率sbm模型和Malmquist指数和分解 ,MATLAB; SBM-DEA模型; 超效率SBM-DEA; 安装教程; 内容讲解; 期望产出; 非期望产出; 超效率与非超效率sbm模型; Malmquist指数; 分解。,"MATLAB超效SBM-DEA模型代码:非期望产出分析的便捷工具"

    人事行政主管绩效考核评分表.xls

    人事行政主管绩效考核评分表

    人力资源管理工具绩效考核excel模板.xlsx

    人力资源管理工具绩效考核excel模板

Global site tag (gtag.js) - Google Analytics