logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

hbase blockcache BucketCache源码分析

方法:     1.封装为blockcachekey  2.从blockcache中获取block  3.从hfile中获取block  4.将block放入blockcache中   HfileReaderV2 readBlock/*** Read in a file block.* @param dataBlockOffset offset to read.* @param onDiskBlo

#hbase
hbase hfile文件格式 详解

 [value]。2元数据块元数据是key-value类型的值,但元数据快只保存元数据的value值,元数据的key值保存在第五项(元数据索引块)中。 该块由多个元数据值组成。3fileInfo块该块保存与HFile相关的一些信息。 fileInfo是以key值排序key-value类型的值。基本格式为:keyValue元素的个数 +(key + value类型id + value) +(key

#hbase
hbase源码分析

pact2.1.   Compact主要来源来自四个方面:1、Memstoreflush时;2、HRegionServer定期做Compaction Checker时;3、HBaseAdmin客户端发起的请求;4、CompactTool发起。1)      MemstoreFlush在flushRegion方法中有相关处理,整个方法主要逻辑:A 对一个flush请求,判断不是META表且文件很多,

#大数据#ui#java
hbase meta表修复

ionserver(根据meta表,将meta表上的region分给regionservere)hbase hbck -fixAssignments meta表修复二 当出现漏洞hbase hbck -fixHdfsHoles(新建一个region文件夹)hbase hbck -fixMeta(根据regioninfo生成meta表)hbase hbck -fixAssignments(分配reg

#hbase
hbase报错 java.io.IOException: Connection reset by peer

reset by peer. Count of bytes read: 0java.io.IOException: Connection reset by peer    at sun.nio.ch.FileDispatcher.read0(Native Method)    at sun.nio.ch.SocketDispatcher.read(SocketDispatcher.java:21)

#hbase
maven NoGoalSpecifiedException

ished at: Wed Apr 13 11:04:20 CST 2011[INFO] Final Memory: 1M/4M[INFO]ERROR] No goals have been specified for this build. You must specify a valid lifecycle phase or a goal in the format <plugi

#maven
hive查询导出到hdfs,hive,file

INSERT OVERWRITE LOCAL DIRECTORY '/script/dirk.zhang/test' ROW FORMAT DELIMITED FIELDS TERMINATED BY ',' select... ...;   insert overwrite [local] directory '/data/movielens/100k/output/item_rel...

#hive
单人机器学习部署实战:资源受限环境下的生存指南

机器学习部署(ML Deployment)是模型从实验走向真实价值的关键环节,其核心在于工程化落地能力,而非仅限于算法精度。在资源受限环境(Resource-Constrained Environment)中,传统MLOps流程因依赖专职角色与复杂基础设施而失效;取而代之的是以运行韧性(Operational Resilience)为目标的轻量级实践路径——依托Linux原语、极简可观测性、状态自

pyspark-ai:用英语写PySpark代码的生产级SDK

自然语言编程(NLP)正从概念走向数据工程实践,其核心是将业务意图转化为可执行、可调试、可集成的数据处理代码。pyspark-ai 作为典型的 LLM-powered data transformation 工具,不替代 Spark DataFrame API,而是通过 English SDK 封装 LangChain 链式调用与 Spark 执行计划逆向工程,在保持代码可控性的前提下大幅降低语法

Docker镜像构建实战:从Dockerfile到生产环境最佳实践

容器化技术通过将应用及其依赖打包成标准单元,解决了环境不一致这一软件开发中的经典难题。其核心原理是利用操作系统级别的虚拟化,通过命名空间和控制组实现进程隔离,相比传统虚拟机具有启动快、资源开销小的优势。在微服务架构成为主流的今天,Docker提供了理想的部署单元,每个服务可以独立开发、测试和部署。特别是在镜像构建环节,Dockerfile的声明式构建方式相比docker commit具有可重复构建

    共 69 条
  • 1
  • 2
  • 3
  • 7
  • 请选择