当前位置: 首页 > news >正文

清丰网站建设费用多人在线网站开发

清丰网站建设费用,多人在线网站开发,wordpress移动端不显示图片,定制开发app费用文章目录 背景配置单机配置HA高可用Hdfs集群性能测试统计trait最多的10个trait term统计性状xxx minValue > 500 0000的数量结论 参考文档 背景 由于公司初始使用Hadoop这一套,所以希望ClickHouse也能使用Hdfs作为存储 看了下ClickHouse的文档,拿Hdf…

文章目录

      • 背景
      • 配置单机
      • 配置HA高可用Hdfs集群
      • 性能测试
        • 统计trait最多的10个trait term
        • 统计性状xxx minValue > 500 0000的数量
        • 结论
      • 参考文档

背景

由于公司初始使用Hadoop这一套,所以希望ClickHouse也能使用Hdfs作为存储
看了下ClickHouse的文档,拿Hdfs举例来说,有两种方式来完成,一种是直接关联Hdfs上的数据文件,比如说TSV格式的文件,这种模式不支持插入数据。第二种是将Hdfs作为存储,可以理解为云存储方式,这篇文章讲解第二种方式的配置

官方文档:External Disks for Storing Data

配置单机

修改config.xml文件,一般路径在/etc/clickhouse-server/config.xml

 	<storage_configuration><disks><hdfs><type>hdfs</type><endpoint>hdfs://hdfs1:9000/clickhouse/</endpoint></hdfs></disks><policies><hdfs><volumes><main><disk>hdfs</disk></main></volumes></hdfs></policies></storage_configuration><merge_tree><min_bytes_for_wide_part>0</min_bytes_for_wide_part></merge_tree>

配置后重启

配置HA高可用Hdfs集群

  1. 复制hadoop下的配置文件hdfs-site.xml/etc/clickhouse-server/
  2. 修改config.xml配置文件,将endpoint中的标签内容,替换为cluster
        <disks><hdfs><type>hdfs</type><endpoint>hdfs://cluster1/clickhouse/</endpoint></hdfs></disks>

这种方式的配置是没有端口的

  1. 拷贝了hdfs-site.xml文件,但是ClickHouse还不能识别到该文件,所以需要配置在config.xml的配置文件下
    <hdfs><libhdfs3_conf>/etc/clickhouse-server/hdfs-site.xml</libhdfs3_conf></hdfs>

这里在官方文档的另外一处有提到
地址:HDFS
在这里插入图片描述
配置完成,重启

这里配置集群模式有些折腾,看到之前有讲如果是hdfs-client.xml这种的,可以参考下。中间还设置过环境变量:
How do I use an HDFS engine in HA mode

性能测试

使用hdfs作为外部存储的时候,需要在建表时,设置存储策略,举例如下:

CREATE TABLE trait_term
(id UUID,termName String
)
ENGINE = MergeTree
PRIMARY KEY (id)
ORDER BY id
SETTINGS index_granularity = 1024, storage_policy='hdfs', index_granularity_bytes = 0;

需要添加storage_policy='hdfs', 这样数据就会存储到hdfs中,在hdfs文件系统中查看
在这里插入图片描述

查询性能对比:
在这里插入图片描述
在这里插入图片描述
trait表大概有1700w条数据,这里主要和之前不使用外部存储,使用clickhouse当前机器的存储做对比

统计trait最多的10个trait term

场景内部存储hdfs存储
直接查询0.767s0.723s
创建视图查询0.495s0.471s
子查询优化0.157s0.172s

统计性状xxx minValue > 500 0000的数量

场景内部存储hdfs存储
直接查询0.263s0.353s
子查询优化0.131s0.207s
创建视图走索引0.01s0.023s
降低稀疏索引粒度0.007s0.015s

结论

根据测试结果,hdfs外部存储会比直接内部存储性能差一点点,但是也差不了多少,使用hdfs可以避免单机存储不够的问题,与公司的技术栈也会保持一致

参考文档

clickhouse之HDFS云存储
clickhouse hive/hdfs引擎由于HDFS-HA报错问题解决
How do I use an HDFS engine in HA mode

http://www.yayakq.cn/news/842521/

相关文章:

  • 找不同 网站开发什么系统做网站最安全
  • 郑州网站建设公司 艾特合同备案号查询系统
  • 网站建设公司企业网站wordpress修改宽度
  • 响应式网站 cms郑州同济医院收费高吗
  • 营销型网站的具体例子手机网站解决方案
  • 传销公司做网站运营网站改版降权多久恢复
  • 58同城青岛网站建设什么软件可以做app软件
  • 青岛公司网站建设价格高端移动网站建设
  • 网站开发与管理专业wordpress pdf 打印
  • 深圳 网站开发扒网站样式
  • 网站图片切换代码个人网站建什么类型的
  • 家具网站首页模板黄冈做网站的公司
  • 网站后台怎么上传图片网页设计实训报告摘要怎么写
  • 网站注销流程网站怎么做成小程序
  • 免费网页模板网站wordpress 二手市场
  • 南京seo网站排名优化龙岗外贸网站建设公司价格
  • 运城市网站建设公司网业搜索
  • 怎么样创建网站wordpress 爱情模板
  • 宿迁网站建设价格wordpress资源管理
  • 网站开发公司臻动如何刷网站排名
  • 北外网院网站建设作业贵阳网站建设技术支持
  • 连云港建设企业网站外贸电子商务网站建设
  • 网站建设规划书实训报告网站差异
  • 泊头公司做网站银川 网站建设
  • 东阿做网站软件开发系统设计
  • 网站标题的作用做网站的后台开发需要会些什么
  • 网站主题说明怎么写wordpress 怎么安装插件
  • 做网站,好苦逼有投标功能的网站怎么做
  • 网站没备案会怎么样电动牙刷开发
  • 有没有找客户的网站海口海南网站建设