Java程序员使用大数据工具汇总
在许多情况下,使用SQL数据库用于存储/检索数据就足够了。但在另一些情况下,要么SQL数据库规模不够,要么还有更好的工具。这一切都取决于使用情况。
现在让我们来讨论一下存储/处理数据用的不同的非SQL工具——NoSQL数据库,内存缓存,全文搜索引擎,实时流,图形数据库,等等。
MongoDB
一种流行的,跨平台的面向文档的数据库。
Elasticsearch
专为云而构建的分布式REST风格搜索引擎。
Cassandra
一个开源的分布式数据库管理系统,最初由脸谱网开发,被设计用来处理横跨多个商用服务器的大量数据,提供了无单点故障的高度可用性。
Redis
一个开源的(BSD许可),内存数据结构存储,作为数据库、缓存和消息代理使用。
Hazelcast
基于Java的开源内存数据网格。
EHCache
一种被广泛使用的开源Java分布式缓存,用于通用缓存、Java EE和轻量级容器。
Hadoop
用Java编写的.一个开源软件框架,用于分布式存储和对在计算机集群上的超大型数据集的分布式处理。
Solr
一个开源的企业搜索平台,用Java编写的,来自于Apache Lucene项目。
Spark
Apache Software Foundation中最活跃的项目,一个开源的集群计算框架。
Memcached
一个通用的分布式内存缓存系统。
Apache Hive
提供了Hadoop之上类似于SQL的层。
Apache Kafka
一个高通量、分布式的发布-订阅式消息系统,最初开发在LinkedIn上。Windows上脱离Cygwin运行Apache Kafka。
Akka
一个工具包和运行时,用于在JVM上构建高度并行的、分布式的、有弹性的消息驱动的应用程序。
HBase
一个开源的,非关系型的,分布式数据库,在谷歌的BigTable后建模,用Java编写,并运行在HDFS上。
Neo4j
用Java实现的开源图形数据库。
CouchBase
一个开源的、面向文档的分布式NoSQL数据库,特别为了交互式应用而优化。
Apache Storm
开源的分布式实时计算系统。
CouchDB
使用JSON来存储数据的面向文档的开源NoSQL数据库。
Oracle Coherence
一个内存的数据网格解决方案,通过提供快速访问常用数据的渠道,使得企业可预测地扩展关键任务应用程序。
Titan
一个可扩展的图形数据库,优化的目的在于存储和查询包含数千亿顶点和边的图形,分布在多机集群。
Amazon DynamoDB
一个快速、灵活、完全管理的NoSQL数据库服务,用于在任何规模需要一致的、个位数毫秒延迟的所有应用程序。
Amazon Kinesis
用于在AWS上的流数据的实时平台。
Datomic
一个用Clojure写的完全事务式的,支持云的,分布式数据库。
-
2017计算机二级考试C语言冲刺题及答案
好的复习题是备考计算机二级考试C语言的关键,为了让考生更好地复习。本站小编为大家准备了计算机二级C语言冲刺题。欢迎阅读。一、选择题(1)下列关于栈叙述正确的是A)栈顶元素最先能被删除B)栈顶元素最后才能被删除C)栈底元素永远不能被删除D)以上三种说法都不...
-
2016下半年计算机二级VB上机考试答题攻略
计算机等级考试进入冲刺备考阶段,为帮助同学们考过计算机等级考试,本站小编为大家分享的是二级VB上机考试答题攻略——常用算法,希望对同学们考试有所帮助!常用算法熟练地掌握算法原理、编程思想和代码实现,就能够做到举一反三,轻松备考,顺利过关。1.累加...
-
2017年浙江省计算机三级网络技术考试试题
计算机网络包括计算机和网络两部分.其中计算机又称电子计算机,俗称电脑,是一种能够按照程序运行,自动、高速处理海量数据的现代化智能电子设备。下面是小编整理的关于计算机三级网络技术考试试题,欢迎大家参考!1).对于下列说法,错误的是()。协议可以提供可靠的数据...
-
2017年计算机二级MSOffice上机操作题及答案
2017年NCRE继续实施2013年版考试大纲(部分科目有修订),大纲和教材详情可查询本网站大纲教材栏目。下面是小编收集的计算机二级MSOffice上机操作题及答案,希望可以帮助大家!一、字处理题请在【答题】菜单下选择【进入考生文件夹】命令,并按照题目要求完成下面的操...