符合混合数据结构的数据湖
随着Hadoop的数据湖获得更多的定义和部署,现在开始看起来将与现有的数据仓库技术共存。而混合型数据架构这样一种观点出现在加利福尼亚州圣迭戈召开的2016企业数据世界会议上。 “这不是一个有或没有的事情,而是一个共同存在的事情。”纽约咨询公司CasertaConcepts公司总裁兼首席执行官乔治·卡塞塔在2016年EDW大会上表示,“企业的数据仓库不会消失。即使当我们正在关注Hadoop和Spark和其他所有闪亮的新事物,它仍然存在。” 但是数据湖在大数据科学和分析应用中找到了用武之地。乔治·卡塞塔表示,基于Hadoop的数据湖通常首先要处理大量和快速到达的大量非结构化数据。卡塞塔和其他专家表示,数据湖是大数据的趋势,将为数据专业人员熟悉实践的重要组成部分带来改变。 “我们采数据仓库创建了第一个数据模型,但这已经发生了变化,“卡塞塔说。随着数据湖的采用,这些模型都已落后。“我们不这样做,马上就落后了。”他说。 分析和应用 其中的一个原因是数据湖与实时数据流关联。随着分析使得业务应用更加紧密,并成为了实时决策的一部分,数据需要尽快地创建和访问。卡塞塔说,这也使得它与数据仓库的工作有很大的...