logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

Spark系列:Spark SQL 之 RDD、DataFrame 和 Dataset 如何选择

在什么时候该选用 RDD、DataFrame 或 Dataset 看起来好像挺明显。前者可以提供底层的功能和控制,后者支持定制的视图和结构,可以提供高级和特定领域的操作,节约空间并快速运行。DataFrame 和 Dataset,或 RDD API,按你的实际需要和场景选一个来用吧!

#spark
MongoDB系列:MongoDB 分片集群环境搭建

注:实际生产环境中,路由服务器和配置服务器可部署多个,以构建高可用分片集群模式。注意:这里启动 route 路由服务器要使用 bin/mongos 实例。至此,分片集群环境搭建成功 :)

#mongodb
Linux系列:Linux 安装 MySQL 5.7.27 教程

另外 --initialize 选项默认以“安全”模式来初始化,则会为 root 用户生成一个密码并将该密码标记为过期,登陆后你需要设置一个新的密码。为了保证数据库目录为与文件的所有者为 mysql 登陆用户,如果你是以 root 身份运行 mysql 服务,需要执行下面的命令初始化。停止mysql服务器:#systemctl stop mysqld.service。mysql 数据库默认只能本地

#linux#mysql
Linux系列:Linux 正则表达式

所谓正则表达式,就是利用一些特殊符号构成的表达式,来模糊匹配字符串。

#正则表达式#linux
Hive系列:Hive 整合 HBase

HBase 不支持标准 SQL 语句,而且 HBase 做统计分析也不支持 Join 表操作,而这些功能是 Hive 所具备的,所以在实际的生产环境中将二者整合并让 HBase 表中的数据可以使用 Hive SQL 语句及 Join 分析是很有必要的。注:进入了 hive 的 shell 命令行界面。

#hive#hbase
Flin系列:Flink 集群安装部署

拷贝 flink 安装包到 node-02、node-03。关闭 flink 集群 # stop-cluster.sh。启动 Flink 集群服务(standalone模式)修改 conf/workers 配置文件。查看 Flink Web UI 界面。

#flink
【数据仓库】Iceberg、Hudi、Delta Lake、Paimon:四大开源湖表格式怎么选?

如果你用多种计算引擎,选 Iceberg;如果你需要强实时更新 + CDC,选 Hudi;如果你在 Databricks 上,用 Delta Lake;如果你重度依赖 Flink,Paimon 更高效。没有“最好”,只有“最合适”。建议在测试环境验证关键路径(如写入吞吐、查询延迟、Compaction 开销),再决定生产选型。

#数据仓库
AI编程工具选型指南

在AI编程时代,我们不再是执行者,而是设计者。选择一款合适的AI编程工具,行动起来吧!

10 个你会喜欢玩的开源游戏

10 个你会喜欢玩的开源游戏我们希望突出一些很棒的开源游戏,这里给你推荐10个伟大的开源游戏。这些都是完全开放源码,包括数据引擎和所有。 1. 模拟城市游戏:LinCity-NGLinCity-NG是一个可以运行在Linux、Mac、Windows等操作系统中的跨平台的模拟经营类游戏。它类似于Windows下的著名的“模拟城市”。玩家在游戏里

    共 30 条
  • 1
  • 2
  • 3
  • 请选择