logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

lostash Timeout executing grok 问题排查

Timeout executing grok问题排查使用logstash的时候发现会有这个报错,导致logstash不稳定,input端是kafka,就会导致kafka的反复rebalance,一开始排查思路有问题,而且网上的资料可能都是其中的一个原因,所以导致我的排查思路偏了。1. 问题背景我有一组logstash 从kafka中消费日志数据,解析后丢到ES当中,提供一些日志的检索能力。大概的配

#elasticsearch
基于spring boot的校园商铺管理系统

【代码】springboot基于spring boot的校园商铺管理系统

文章图片
#后端#java
spark-jar冲突解决方案

文章目录1. 问题描述2. spark on yarn cluster模式的解决方案3. 使用maven-shade-plugin1. 问题描述  spark项目的包和cdh集群中的冲突了,而且我暂时使用的是client 模式在yarn上部署(如果是cluster模式可以使用spark的config配置来解决),所以只能使用 maven-shade-plugin的relocation功能来实现。2

#java#maven#spark
java-spark广播变量

spark任务报错20/09/09 18:23:00 INFO scheduler.TaskSetManager: Starting task 0.0 in stage 5.0 (TID 4008, node-hadoop67.com, executor 3, partition 0, RACK_LOCAL, 8608 bytes)20/09/09 18:23:00 INFO storage.Bl

#spark#大数据
spark的内存过小报错

文章目录提交任务spark-submit --class org.apache.spark.examples.SparkPi--master yarn--deploy-mode client--driver-memory 600M--executor-memory 500M--num-executors 1/usr/local/spark/examples/jars/spark-examples_

#spark#大数据#hadoop +2
kafka_rebalance过长问题排查

目录问题简介使用场景原因分析进一步探索先看server端设置超时的代码consumer 端的rebalanceTimeoutMs解决方案问题简介  最近kafka集群频繁出现了长时间rebalance(耗时5min级别),kafka在rebalance期间对应的consumer group中的consumer都是无法poll()下来数据的,导致consumer消费kafka当中数据出现了较大的..

#kafka
logstash使用中遇到的问题

文章目录1. 在logstash中配置es的域名无法使用2. logstash.yml配置不生效1. 在logstash中配置es的域名无法使用output {elasticsearch {hosts => ["http://estest_hostmy.com:10200"]index => "%{[@metadata][index_0]}-%{+YYYY.MM.dd}"}}报错如下1

文章图片
ES集群新增节点无法加入集群 timed out while waiting for initial discovery state - timeout: 30s

ES : 7.5.0ES集群新增节点无法加入集群timed out while waiting for initial discovery state - timeout: 30s  ES集群需要增加专用的master节点,加入完master节点需要修改data节点的elasticsearch.yml为专用的data节点并重启。这里出现了一个问题,在data节点重启后无法加入cluster当中,自

#elasticsearch#r语言#大数据
到底了