logo
publist
写文章

简介

该用户还未填写简介

擅长的技术栈

可提供的服务

暂无可提供的服务

程学旗发布大数据白皮书与发展趋势报告

程学旗摘要:中科院计算所研究员,CCF大数据专家委员会秘书长程学旗发布大数据白皮书与发展趋势报告。介绍了大数据的背景与动态、典型应用、技术进展等内容。程学旗对2015年大数据发展预测用了8个字:融合、跨界、基础、突破。【CSDN现场报道】2014年12月12-14日,由中国计算机学会(CCF)主办,CCF大数据专家委员会承办,中科院计算所与CSDN共同协办,以推进大数据科研、应用与产业

#大数据
大数据从百万级别数据的分析角度,数据库如何选择?

问题描述:现在需要做一个数据存储,500w左右的数据,日后每天大约产生5w条左右的数据。想把这些数据存储起来,供日后的数据分析用?使用上面说的三种数据库中的哪中比较好?是否有必要建立集群?个人看法是:从长远角度看,由于单台机器的性能瓶颈,后期肯定要做集群,单纯的做复制最终也无法缓解单台master上读的负担。因此,使用mysql的话会使用cluser。但是了解到mysql的clus

#mongodb#storm#elasticsearch
将 SPSS 分析技术应用于大数据

试用SPSS with IBM Netezza、InfoSphere BigInsights 和 InfoSphere Streams 执行大规模分析了解 SPSS® 中处理大数据的新功能。现在可以对 SPSS 分析资产轻松地进行修改,以便连接到不同的大数据来源,它们还可以在不同的部署模式(批处理或实时模式)下运行。SPSS 平台的组件现在可与 IBM Netezza、I

程学旗发布大数据白皮书与发展趋势报告

程学旗摘要:中科院计算所研究员,CCF大数据专家委员会秘书长程学旗发布大数据白皮书与发展趋势报告。介绍了大数据的背景与动态、典型应用、技术进展等内容。程学旗对2015年大数据发展预测用了8个字:融合、跨界、基础、突破。【CSDN现场报道】2014年12月12-14日,由中国计算机学会(CCF)主办,CCF大数据专家委员会承办,中科院计算所与CSDN共同协办,以推进大数据科研、应用与产业

#大数据
大数据从百万级别数据的分析角度,数据库如何选择?

问题描述:现在需要做一个数据存储,500w左右的数据,日后每天大约产生5w条左右的数据。想把这些数据存储起来,供日后的数据分析用?使用上面说的三种数据库中的哪中比较好?是否有必要建立集群?个人看法是:从长远角度看,由于单台机器的性能瓶颈,后期肯定要做集群,单纯的做复制最终也无法缓解单台master上读的负担。因此,使用mysql的话会使用cluser。但是了解到mysql的clus

#mongodb#storm#elasticsearch
将 SPSS 分析技术应用于大数据

试用SPSS with IBM Netezza、InfoSphere BigInsights 和 InfoSphere Streams 执行大规模分析了解 SPSS® 中处理大数据的新功能。现在可以对 SPSS 分析资产轻松地进行修改,以便连接到不同的大数据来源,它们还可以在不同的部署模式(批处理或实时模式)下运行。SPSS 平台的组件现在可与 IBM Netezza、I

【数据分析】Excel数据分析功能藏在哪里

我们常见的数据分析工具大多是SPSS、R、Matlab等,Excel中自带的数据分析功能,也可以完成这些专业统计软件的一些数据分析工作,包括描述性统计、相关系数、概率分布、方差分析、回归、抽样等内容。 以Excel 2007为例,首先需我们加载数据分析功能。  步骤:1、“Excel选项”。2、单击“加载项->“Excel

#数据分析
【Container讲师】中科院李明宇:和而不同——OpenStack&Docker

摘要:中国科学院软件所课题组负责人李明宇认为,Docker生态圈还处于起步阶段,可利用OpenStack的技术积累助Docker实现企业级云计算系统,李明宇将在2014 Container技术大会上带来分享“和而不同——OpenStack&Docker”。2014年10月18日,CSDN&《程序员》主办的2014Container技术大会(Container Conference

#openstack#docker
HDFS进化,Hadoop即将拥抱对象存储?

Hortonworks在博客中提出了一个全新的Hadoop对象存储环境——Ozone,能将HDFS从文件系统扩展成更加复杂的企业级存储层。Hadoop社区的一些成员今日提议为Hadoop增加一个新的对象存储环境,这样一来Hadoop就能以与亚马逊S3、微软Azure以及OpenStack Swift等云存储服务一样的方式去存储数据。Hadoop发行商Hortonworks本周二在官网发 博

#hdfs
内存计算技术那家强?SPARK vs HANA

最近业界有很多技术和产品都认为属于内存计算的范畴,由于我个人也从事于内存计算产品的研发,所以想借个机会,跟各位聊聊到底什么是内存计算技术,以及比较一些现在两种比较主流的内存计算技术Apache Spark和SAP HANA,它们的特点和区别。什么是内存计算技术?关于内存计算,就像云计算和大数据一样,其实无论在百度百科还是Wikipedia都没有非常精确的描述,但是有几个共通的关键点

#scala#spark
    共 14 条
  • 1
  • 2
  • 请选择