正在阅读:海量数据汹涌而来 Hadoop不再一家独大

海量数据汹涌而来 Hadoop不再一家独大

2017-02-22 09:28:59来源:36d大数据 编辑:沐子飞 关键词:大数据数据存储数据挖掘阅读量:37395

导读:随着对不同类型、不同体量数据的结构化存储、批量处理以及价值挖掘需求的增多,2017年注定是大数据里程碑式的一年。
  【中国智能制造网 智造快讯】随着对不同类型、不同体量数据的结构化存储、批量处理以及价值挖掘需求的增多,2017年注定是大数据里程碑式的一年。

海量数据汹涌而来 Hadoop不再一家独大
 
  2017年,支持大量结构化和非结构化数据的系统将继续增长。市场需要数据平台来帮助数据管理人员管理和保护大数据,同时允许终用户进行数据分析。这些系统将逐步成熟,在企业内部的IT系统中更好地运行。
 
  1.数据处理变得更加快速,数据也变得更加易于使用
 
  选项扩展将加速Hadoop
 
  当然,你可以在Hadoop上执行机器学习和情绪分析,但人们常常会问的个问题是:交互式SQL(结构化查询语言,一种数据库查询和程序设计语言,用于存取数据以及查询、更新和管理关系数据库系统)究竟有多快?毕竟,SQL相当于企业用户的“导管”——他们希望使用Hadoop数据来更快的获得可复用的BI仪表盘(一种向企业展示度量信息和关键业务指标即KPI现状的数据虚拟化工具),或者是进行一些探索性分析。
 
  这种对速度的需求促使用户采用访问速度更快和执行效率更高的数据库,如Exasol、MemSQL,或者是类似于Kudu这种基于Hadoop的商店,当然还需要能够更快查询数据的技术。诸如SQL-on-Hadoop引擎(Apache Impala,Hive LLAP,Presto,Phoenix和Drill)和OLAP-on-Hadoop技术(AtScale,Jethro Data和Kyvos Insights)这样的数据查询加速器将进一步模糊传统数据库与大数据世界的边界。
 
  2.大数据不再只是Hadoop
 
  专门基于Hadoop开发的工具已过时
 
  在过去的几年中,随着大数据浪潮来袭,数种为了满足Hadoop分析需求的技术兴起。但是,身处复杂,异构环境中的企业不再希望仅为一个数据源(Hadoop)采用孤立的BI访问点。他们需要的答案被埋没在一大堆数据源中,从记录系统到云端,再到来自Hadoop和非Hadoop源的结构化和非结构化数据。(顺便说一句,甚至连关系型数据库也正在为大数据趋势做准备。例如,SQL Server 2016于近日添加了JSON支持)。
 
  在2017年,客户将会需要对所有数据都进行分析。不依赖于数据源的平台将会茁壮成长,而专为Hadoop而设计的平台和未能跨应用部署的平台将被弃用。Platfora的退出便是这一趋势的预示。
 
  3.相关组织将利用数据湖(DataLake)来实现价值
 
  数据湖就像一个人造水库
 
  数据湖就像一个人造水库。首先你要建造一个水坝(构建一个集群),然后填满水(数据)。一旦建立了湖泊,你将开始因为各种目的而使用这些水资源(数据),如发电,饮用以及各种消遣(预测分析,机器学习,网络安全等)。
 
  而今,保有数据湖里的数据已经变成了一种为了保留而保留的行为。在2017年,这将随着Hadoop业务的收紧而改变。各个组织要求可重复的并且敏捷地使用数据湖,以便更快地获得响应。在确定对人事、数据和基础设施的相应投资之前,企业会更加慎重的考虑业务成果。这将促进业务和IT之间的强力耦合。而自助服务平台作为分析大数据资产的工具将获得更深入的认可。
 
  另外,公司还将关注业务驱动型应用,避免数据湖陷入困境。在2017年,企业机构将从“构建未来”的数据湖应用转向业务驱动型数据应用。当今世界需要分析和操作能力去触及客户、处理索赔并且连接到个体的不同设备。
 
  举例而言,任何商业网站需要提供实时的个性化推荐和价格查询。医疗健康型企业必须处理有效的索赔并且运用分析运营系统来防止索赔欺诈。媒体公司需要通过机顶盒提供个性化的内容。汽车制造商和汽车共享公司则要交互运营其车辆和司机。这些案例的实施交付均需要由一个敏捷平台来实现,同时提供分析和运营的处理,跨越后台分析和前台运营进行整合,提升了商业价值。
 
  4.成熟的架构拒绝通用型框架
 
  Hadoop不再只是一个用于数据科学用例的批处理平台。
 
  Hadoop不再只是一个用于数据科学用例的批处理平台。它已经成为一种专为特殊分析而架设的多用途分析引擎,甚至被用于日常工作负载的操作报告——传统上这项任务是由数据仓库(大量数据提取和分析的工具)来处理的。
 
  在2017年,各个组织将通过特定的用例的架构设计来满足现存的混合需求。他们将研究一系列的因素,包括用户角色模型、访问频率、数据速度和聚合级别等,然后才能提交合适的数据策略。这些现代化的参考架构由需求驱动,他们将以某种方式将好的自助服务数据准备工具Hadoop核心和终用户分析平台结合起来,以便可以根据这些需求进行重新配置。这些架构的灵活性将终推动技术选择。
 
  5.推动大数据投资的是数据的多样性,而不是体量和速
 
  Gartner将大数据定义为“三高”
 
  Gartner将大数据定义为“三高”:高容量,高速率,高品类的信息资产。正如New Vantage Partners近的一项调查结果所示:虽然三个特性都在凸显,但其中,多元化无疑正成为大数据投资的主导推动力。
 
  随着企业寻求整合更多来源并关注大数据的“长尾”,这一趋势将更加明显。从自由模式的JSON到嵌入式的数据库(如关系数据库和非关系数据库),到非平面数据(如Avro,Parquet,XML),数据格式正在成倍增长,连接器变得至关重要,它将不同格式的数据变成统一的表达/它让不同格式的数据之间实现互通。在2017年,为零散的、不同的资源提供即时连接的能力,将成为评估一个平台能力的重要方面。
 

我要评论
  • 人工智能+大数据:2025年它们如何塑造企业

    “2025 年商业中的人工智能与大数据”如今已成为竞争优势的代名词。人工智能 (AI) 与大数据的融合正在通过预测分析、个性化服务和自动化运营重塑全球经济的各个领域。
    人工智能大数据
    2025-09-16 10:29:40
  • 中国大数据规模未来5年增速世界第一 全球占比10%

    中国大数据市场表现格外亮眼,预计2029年中国大数据IT支出规模为730.2亿美元,全球占比约10%。
    大数据大数据技术
    2025-09-12 11:44:02
  • 合肥都市圈要素市场化配置综合改革试点实施方案

    发挥安徽省数据交易所枢纽作用,推进数据流通交易,建设合规高效的数据流通交易平台,发挥数据产业促进、交易技术创新、数商生态合作等功能,打造全国一流、特色鲜明的区域性数据交易场所。
    要素市场化配置改革数据挖掘
    2025-09-12 09:37:09
  • 新华三与广东电信深化战略合作 共拓数字经济新蓝海

    多年来广东电信与新华三一直保持着良好的合作关系,取得丰硕成果。期待双方在传统云网合作基础上,共同探索先进算力网络建设,协力深耕粤港澳大湾区数字化沃土。
    数字经济大数据
    2025-07-11 11:40:07
  • 物流智能转型新引擎:DeepSeek+物流

    DeepSeek 物流不仅是技术的革新,更是城市发展的重要推动力。它通过智能化手段提升物流效率、优化资源利用、减少环境影响,并为智慧城市建设提供支撑。未来,随着AI技术的不断进步,物流行业将迎来更深刻的变革。
    物流大数据服务平台
    2025-04-30 10:11:15
  • 2025年4月1日开始施行的重要新规一览

    四月,一系列新规定即将实施,包括《公共安全视频图像信息系统管理条例》、《车联网网络安全异常行为检测机制》等。
    大数据服务平台
    2025-04-02 09:31:36
版权与免责声明:

凡本站注明“来源:智能制造网”的所有作品,均为浙江兴旺宝明通网络有限公司-智能制造网合法拥有版权或有权使用的作品,未经本站授权不得转载、摘编或利用其它方式使用上述作品。已经本网授权使用作品的,应在授权范围内使用,并注明“来源:智能制造网”。违反上述声明者,本站将追究其相关法律责任。

本站转载并注明自其它来源(非智能制造网)的作品,目的在于传递更多信息,并不代表本站赞同其观点或和对其真实性负责,不承担此类作品侵权行为的直接责任及连带责任。如其他媒体、平台或个人从本站转载时,必须保留本站注明的作品第一来源,并自负版权等法律责任。如擅自篡改为“稿件来源:智能制造网”,本站将依法追究责任。

鉴于本站稿件来源广泛、数量较多,如涉及作品内容、版权等问题,请与本站联系并提供相关证明材料:联系电话:0571-89719789;邮箱:1271141964@qq.com。

不想错过行业资讯?

订阅 智能制造网APP

一键筛选来订阅

信息更丰富

推荐产品/PRODUCT 更多
智造商城:

PLC工控机嵌入式系统工业以太网工业软件金属加工机械包装机械工程机械仓储物流环保设备化工设备分析仪器工业机器人3D打印设备生物识别传感器电机电线电缆输配电设备电子元器件更多

我要投稿
  • 投稿请发送邮件至:(邮件标题请备注“投稿”)1271141964.qq.com
  • 联系电话0571-89719789
工业4.0时代智能制造领域“互联网+”服务平台
智能制造网APP

功能丰富 实时交流

智能制造网小程序

订阅获取更多服务

微信公众号

关注我们

抖音

智能制造网

抖音号:gkzhan

打开抖音 搜索页扫一扫

视频号

智能制造网

公众号:智能制造网

打开微信扫码关注视频号

快手

智能制造网

快手ID:gkzhan2006

打开快手 扫一扫关注
意见反馈
我要投稿
我知道了