当前位置: 首页 > news >正文

Java转职大数据人群常用的20多个大数据工具

最近我问了很多Java开发人员关于最近12个月内他们使用的是什么大数据工具。

这是一个系列,主题为:

  • 语言
  • web框架
  • 应用服务器
  • SQL数据访问工具
  • SQL数据库
  • 大数据
  • 构建工具
  • 云提供商

今天我们就要说说大数据。根据维基百科,大数据是数据集的一个广义的术语,并且该数据集是如此庞大和复杂,以致于传统的数据处理应用程序无法胜任。

在许多情况下,使用SQL数据库用于存储/检索数据就足够了。但在另一些情况下,要么SQL数据库规模不够,要么还有更好的工具。这一切都取决于使用情况。

现在让我们来讨论一下存储/处理数据用的不同的非SQL工具——NoSQL数据库,内存缓存,全文搜索引擎,实时流,图形数据库,等等。

MongoDB—— 一种流行的,跨平台的面向文档的数据库。

Elasticsearch——专为云而构建的分布式REST风格搜索引擎。

Cassandra——一个开源的分布式数据库管理系统,最初由Facebook开发,被设计用来处理横跨多个商用服务器的大量数据,提供了无单点故障的高度可用性。

Redis—— 一个开源的(BSD许可),内存数据结构存储,作为数据库、缓存和消息代理使用。

Hazelcast——基于Java的开源内存数据网格。

EHCache——一种被广泛使用的开源Java分布式缓存,用于通用缓存、Java EE和轻量级容器。Ehcache相关介绍

Hadoop——用Java编写的一个开源软件框架,用于分布式存储和对在计算机集群上的超大型数据集的分布式处理。

Solr——一个开源的企业搜索平台,用Java编写的,来自于Apache Lucene项目。

Spark——Apache Software Foundation中最活跃的项目,一个开源的集群计算框架。

Memcached—— 一个通用的分布式内存缓存系统。

Apache Hive——提供了Hadoop之上类似于SQL的层。

Apache Kafka—— 一个高通量、分布式的发布-订阅式消息系统,最初开发在LinkedIn上。Windows上脱离Cygwin运行Apache Kafka

Akka—— 一个工具包和运行时,用于在JVM上构建高度并行的、分布式的、有弹性的消息驱动的应用程序。

HBase—— 一个开源的,非关系型的,分布式数据库,在谷歌的BigTable后建模,用Java编写,并运行在HDFS上。

Neo4j——用Java实现的开源图形数据库。

CouchBase——一个开源的、面向文档的分布式NoSQL数据库,特别为了交互式应用而优化。

Apache Storm——开源的分布式实时计算系统。

CouchDB——使用JSON来存储数据的面向文档的开源NoSQL数据库。

Oracle Coherence—— 一个内存的数据网格解决方案,通过提供快速访问常用数据的渠道,使得企业可预测地扩展关键任务应用程序。

Titan—— 一个可扩展的图形数据库,优化的目的在于存储和查询包含数千亿顶点和边的图形,分布在多机集群。

Amazon DynamoDB——一个快速、灵活、完全管理的NoSQL数据库服务,用于在任何规模需要一致的、个位数毫秒延迟的所有应用程序。

Amazon Kinesis—— 用于在AWS上的流数据的实时平台。

Datomic—— 一个用Clojure写的完全事务式的,支持云的,分布式数据库。

有一句话叫做三人行必有我师,其实做为一个开发者,有一个学习的氛围
跟一个交流圈子特别重要这是一个我的大数据交流学习群531629188
不管你是小白还是大牛欢迎入驻,正在求职的也可以加入
,大家一起交流学习,话糙理不糙,互相学习,共同进步,一起加油吧。

好文要顶 关注我 收藏该文  

相关文章:

  • 【NOIP模拟赛】就 反悔贪心
  • 深度解析数据分析、大数据工程师和数据科学家的区别
  • Make Palindrome UVA - 10453
  • 大数据行业发展的九大痛点(个人观点)
  • 【设计模式】 状态模式
  • IT技术人员转行大数据应该考虑哪些问题
  • 日常(关于机房卫生???)
  • 两矩阵相乘的秩的性质_浅析数学中的行列式与矩阵
  • (Python) SOAP Web Service (HTTP POST)
  • 苹果新款笔记本_谷歌发布售价99美元的新款Wi-Fi路由器(全文)_苹果 新款MacBook Pro 13英寸_笔记本新闻...
  • 使用IDEA从github中下载fastdfs-client-java
  • 苹果7手机严重卡顿_iPhone12 实测 5G 网络耗电更快丨苹果官方壳存在严重问题|iphone12|手机壳|续航|蜂窝...
  • [luoguP1666] 前缀单词(DP)
  • JZOJ 8.10 B组总结
  • android oboe 混音_Android之AppBarLayout实现悬停吸附伸缩效果
  • [js高手之路]搞清楚面向对象,必须要理解对象在创建过程中的内存表示
  • 「译」Node.js Streams 基础
  • 【划重点】MySQL技术内幕:InnoDB存储引擎
  • 2017年终总结、随想
  • android 一些 utils
  • ES6 ...操作符
  • java第三方包学习之lombok
  • js递归,无限分级树形折叠菜单
  • php中curl和soap方式请求服务超时问题
  • seaborn 安装成功 + ImportError: DLL load failed: 找不到指定的模块 问题解决
  • spring boot 整合mybatis 无法输出sql的问题
  • v-if和v-for连用出现的问题
  • 多线程事务回滚
  • 发布国内首个无服务器容器服务,运维效率从未如此高效
  • 给新手的新浪微博 SDK 集成教程【一】
  • 目录与文件属性:编写ls
  • 小试R空间处理新库sf
  • 与 ConTeXt MkIV 官方文档的接驳
  • 3月7日云栖精选夜读 | RSA 2019安全大会:企业资产管理成行业新风向标,云上安全占绝对优势 ...
  • #Spring-boot高级
  • $(document).ready(function(){}), $().ready(function(){})和$(function(){})三者区别
  • (20)目标检测算法之YOLOv5计算预选框、详解anchor计算
  • (3)STL算法之搜索
  • (Matalb时序预测)PSO-BP粒子群算法优化BP神经网络的多维时序回归预测
  • (Matalb时序预测)WOA-BP鲸鱼算法优化BP神经网络的多维时序回归预测
  • (pojstep1.1.2)2654(直叙式模拟)
  • (保姆级教程)Mysql中索引、触发器、存储过程、存储函数的概念、作用,以及如何使用索引、存储过程,代码操作演示
  • (三)c52学习之旅-点亮LED灯
  • (四)Android布局类型(线性布局LinearLayout)
  • (四)linux文件内容查看
  • ****Linux下Mysql的安装和配置
  • *Django中的Ajax 纯js的书写样式1
  • .bat批处理(八):各种形式的变量%0、%i、%%i、var、%var%、!var!的含义和区别
  • .bat批处理出现中文乱码的情况
  • .desktop 桌面快捷_Linux桌面环境那么多,这几款优秀的任你选
  • .NET WebClient 类下载部分文件会错误?可能是解压缩的锅
  • .NET 中让 Task 支持带超时的异步等待
  • .net解析传过来的xml_DOM4J解析XML文件
  • .Net中的集合
  • @modelattribute注解用postman测试怎么传参_接口测试之问题挖掘