logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

基于spark mllib的LDA模型训练Scala代码实现

从事NLP算法工作也快一年了,主要时间花在了LDA上面,但是却一直没有好好整理一下,决心把到目前为止做的一些东西分享出来,如有疑问敬请指正。在Github上建了一个自己的项目:CkoocNLP(去这个名字是想做一个NLP相关的技术的代码实现,不过目前上面还没有什么东西)。里面已经有基于spark的训练和预测代码实现,有兴趣的同学可以去看看,代码比较简单,可以直接checkout出来跑。直接

#机器学习
hive执行任务报错Execution failed with exit status: 3

Execution failed with exit status: 3FAILED: Execution Error, return code 3 from org.apache.hadoop.hive.ql.exec.mr.MapredLocalTask

#hive
Intellij idea创建javaWeb以及Servlet简单实现

Intellij idea创建javaWeb工程的必要设置以及对Servlet的简单实现。

#servlet
Intellij idea创建javaWeb以及Servlet简单实现

Intellij idea创建javaWeb工程的必要设置以及对Servlet的简单实现。

#servlet
Intellij idea创建javaWeb以及Servlet简单实现

Intellij idea创建javaWeb工程的必要设置以及对Servlet的简单实现。

#servlet
基于LR的新闻多分类(基于spark2.1.0, 附完整代码)

自从引进DataFrame之后,spark在ml方面,开始使用DataFrame作为RDD的上层封装,以屏蔽RDD层次的复杂操作,对应用开发者提供简单的DataFrame,以减少开发量。本文以最新的spark2.1.0版本为基础,构建从数据预处理、特征转换、模型训练、数据测试到模型评估的一整套处理流程。

#spark#逻辑回归#scala
VirtualBox 安装ghost xp(雨林木风)

        自从微软宣布停止更新XP以来,网上各种各样的xp序列号都不能用了,但是因为工作的需要又必须要装一个xp的虚拟机。因此只能忍痛装一个ghost版的xp(个人不太喜欢ghost版本,总觉得预装了很多乱七八糟的软件让我很不爽)。        自己鼓捣了几次发现ghost版的xp还没有想象中的那么好装,因此写一篇教程方便自己也方便别人,供大家参考一下:↓↓↓↓↓↓

到底了