网易视频云：网易hbase基准性能测试之结果篇.pdfVIP

下载本文档

1
0
约6.26千字
约 18页
2020-07-19 发布于未知
举报
版权申诉

网易视频云：网易hbase基准性能测试之结果篇.pdf

1、原创力文档（book118）网站文档一经付费（服务费），不意味着购买了该文档的版权，仅供个人/单位学习、研究之用，不得用于商业用途，未经授权，严禁复制、发行、汇编、翻译或者网络传播等，侵权必究。。
2、本站所有内容均由合作方或网友上传，本站不对文档的完整性、权威性及其观点立场正确性做任何保证或承诺！文档内容仅供研究参考，付费前请自行鉴别。如您付费，意味着您自己接受本站规则且自行承担风险，本站不退款、不进行额外附加服务；查看《如何避免下载的几个坑》。如果您已付费下载过本站文档，您可以点击这里二次下载。
3、如文档侵犯商业秘密、侵犯著作权、侵犯人身权等，请点击“版权申诉”（推荐），也可以打举报电话：400-050-0827(电话支持时间：9:00-18:30)。
4、该文档为VIP文档，如果想要下载，成为VIP会员后，下载免费。
5、成为VIP后，下载本文档将扣除1次下载权益。下载后，不支持退款、换文档。如有疑问请联系我们。
6、成为VIP后，您将拥有八大权益，权益包括：VIP文档下载权益、阅读免打扰、文档格式转换、高级专利检索、专属身份标志、高级客服、多端互通、版权登记。
7、VIP文档为合作方或网友上传，每下载1次，网站将根据用户上传文档的质量评分、类型等，对文档贡献者给予高额补贴、流量扶持。如果你也想贡献VIP文档。上传文档

网易视频云：网易 HBase 基准性能测试之结果篇　上一篇网易视频云的技术专家给大家分享了网易 HBase 基准性能测试之准备篇中详细介绍了本次性能测试的基本准备情况，包括测试集群架构、单台机器软硬件配置、测试工具以及测试方法等，在此基础上本篇文章主要介绍 HBase 在各种测试场景下的性能指标（主要包括单次请求平均延迟和系统吞吐量）以及对应的资源利用情况，并对各种测试结果进行分析。　　测试结果　　单条记录插入　　测试参数　　总记录数为 10 亿，分为 128 个 region ，均匀分布在 4 台 region server 上；插入操作行 2 千万次；插入请求分布遵从 zipfian 分布；　　测试结果　　　　资源使用情况　　　　上图为单台 RegionServer 的带宽使用曲线图（资源使用情况中只列出和本次测试相关的资源曲线图，后面相关资源使用情况类似），本次测试线程为 1000 的情况下带宽基本维持在 100M 左右，对于百兆网卡来说基本上已经打满。　　结果分析　　1.吞吐量曲线分析：线程数在 10~500 的情况下，随着线程数的增加，系统吞吐量会不断升高；之后线程数再增加，系统吞吐量基本上不再变化。结合图3 带宽资源使用曲线图可以看出，当线程数增加到一定程度，系统带宽资源基本耗尽，系统吞吐量就不再会增加。可见， HBase 写操作是一个带宽敏感型操作，当带宽资源 bound 后，写入吞吐量基本就会稳定。　　2. 写入延迟曲线分析：随着线程数的不断增加，写入延迟也会不断增大。这是因为写入线程过多，导致 CPU 资源调度频繁，单个线程分配到的 CPU 资源会不断降低；另一方面由于线程之间可能会存在互斥操作导致线程阻塞；这些因素都会导致写入延迟不断增大。　　建议　　根据曲线显示，500 线程以内的写入延迟并不大于 10ms，而此时吞吐量基本最大，因此如果是单纯写入的话 500 线程写入会是一个比较合适的选择。　　单纯查询　　测试参数　　总记录数为 10 亿，分为 128 个 region ，均匀分布在 4 台 region server 上；查询操作行 2 千万次；查询请求分布遵从 zipfian 分布；　　测试结果　　　　资源使用情况　　　　　　图5 为线程数在 1000 时 IO 利用率曲线图，图中 IO 利用率基本保持在 100%，说明 IO 资源已经达到使用上限。图6 为线程数在 1000 时系统负载曲线图，图中 load1 曲线表示在最近一分钟内的平均负载，load5 表示最近五分钟内的平均负载。最近 5 分钟的负责达到了50 左右，对于 32 核系统来说，表示此时系统负载很高，已经远远超负荷运行。　　结果分析　　 1. 吞吐量曲线分析：线程数在 10~500 的情况下，随着线程数的增加，系统吞吐量会不断升高；之后线程数再增加，系统吞吐量基本上不再变化。结合图5、图6 系统资源使用曲线图可以看出，当线程数增加到一定程度，系统 IO 资源基本达到上限，系统负载也特别高。IO 利用率达到 100%是因为大量的读操作都需要从磁盘查找数据，系统负载很高是因为HBase 需要对查找的数据进行解压缩操作，解压缩操作需要耗费大量 CPU 资源。这两个因素结合导致系统吞吐量就不再随着线程数增肌而增加。可见，HBase 读操作是一个IO/CPU 敏感型操作，当 IO 或者 CPU 资源 bound 后，读取吞吐量基本就会稳定不变。　　2. 延迟曲线分析：随着线程数的不断增加，读取延迟也会不断增大。这是因为读取线程过多，导致 CPU 资源调度频繁，单个线程分配到的 CPU 资源会不断降低；另一方面由于线程之间可能会存在互斥操作导致线程阻塞；这些因素都会导致写入延迟不断增大。和写入延迟相比，读取延迟会更大，是因为读取涉及 IO 操作，IO 本身就是一个耗时操作，导致延迟更高。　　建议　　根据曲线显示，500 线程以内的读取延迟并不大于 20ms，而此时吞吐量基本最大，因此如果是单纯读取的话 500 线程读取会是一个比较合适的选择。　　Range 扫描查