logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

hbase报错总结01

1.The node /hbase is not in ZooKeeper. It should have been written by the master. Check the value configured in 'zookeeper.znode.parent'.    hbase-env.sh配置文档中的HBASE_MANAGES_ZK的默认值是true,它表示HBase使用自...

#hbase
rpc系列-反射

一.简介:Java程序中引用变量的类型,分为编译类型和运行类型,编译时类型由声明该变量时使用的类型决定,运行时类型由实际赋给该变量的对象决定。编译时根本无法预知该对象和类可能属于那些类,程序只依靠运行时信息来发现该对象和类的真实信息,这就用到反射。 二.示例public interface TestInterface {}public class Person imp...

#java
机器学习系列--贝叶斯分类算法

简介贝叶斯分类算法是一大类分类算法的总称贝叶斯分类算法以样本可能属于某类的概率来作为分类依据朴素贝叶斯分类算法是贝叶斯分类算法中最简单的一种注:朴素的意思是条件概率独立性此处要想真正理解,需要有概率论的基础知识P(A|x1x2x3x4)=p(A|x1)*p(A|x2)p(A|x3)p(A|x4)则为条件概率独立P(xy|z)=p(xyz)/p(z)=p(xz)/p(z)...

#spark#分类
Grok 4 系统提示词泄露

摘要:Grok 4在基准测试中全面超越现有模型,展现多领域优势 xAI发布的Grok 4在基准测试中表现卓越,所有任务均超越顶尖推理模型。其系统提示词显示核心能力包括:实时处理X平台内容(用户资料、帖子、文件分析)、图像编辑与生成确认,以及数学问题的结构化推理。Grok 4仅限付费订阅使用,强调中立立场和透明度,尤其在争议话题中会综合多方信源。相比其他AI,其特色在于实时更新、社交媒体深度适配及政

文章图片
#AI#人工智能
poi读取word--空格

/*** 判断Str是否是选择题选择项* @param str 内容* @return*/public static boolean isSelecteTitele(String str) {Pattern pattern = Pattern.compile("^([a-zA-Z]+[\\. | \\、| \\.| \\、 ].*)");if(String...

大数据职业规划

大数据职业规划

#大数据
机器学习系列--kmeans分类算法

简介K-means算法是集简单和经典于一身的基于距离的聚类算法,采用距离作为相似性的评价指标,即认为两个对象的距离越近,其相似度就越大。该算法认为类簇是由距离靠近的对象组成的,因为把得到紧凑且独立的簇作为最终目标。 算法核心思想通过迭代寻找k个类簇的一种划分方案,使得用这k个类簇的均值来代表相应各类样本时所得的总体误差最小。k个聚类具有以下特点:各聚类本身尽可能的紧凑,而各...

#spark
精益数据分析-商业模式

一.简介it行业中,许多数据分析框架的诞生,它们帮助我们理解创业和创业在不同阶段所经历的变化,并助力创业公司获取客户和创造营收。每一套框架对创业的生命周期都有着不同的视角,分别提出一系列值得关注的数据指标和领域。 二.“海盗指标”(需要关注指标,用户/客户/访客须经历的五个环节)1.获取用户相关指标:流量、提及量、CPC(每次点击费用)、搜索结果、用户获取成本、点开率2. 提高...

#数据分析
数据仓库系列--维度表技术

  维度表技术常见:增加列,维度子集,角色扮演维度,层次维度,退化维度,杂项维度,维度合并,分段维度等基本维度表技术。 一.增加列事实表和维度表上增加列。Hive上增加列,慎用alter table。原因老版本的hive对ORC格式表的模式修改,尤其是增加列的支持存在很多问题。JIRA上说2.0.0修复了ORC表模式修改问题。空值处理:<=> 二.维度子...

#数据仓库
spark报错---安装系列八

1.自从spark2.0.0发布没有assembly的包了,在jars里面,是很多小jar包修改目录查找jar  2.异常HiveConf of name hive.enable.spark.execution.engine does not exist在hive-site.xml中:hive.enable.spark.execution.engine过时了,配置删除即...

    共 21 条
  • 1
  • 2
  • 3
  • 请选择