【Hadoop Summit Tokyo 2016】Apache NiFi的先锋派-低调大师

【Hadoop Summit Tokyo 2016】Apache NiFi的先锋派

2017-02-28 691

本讲义出自Joe Percivall在Hadoop Summit Tokyo 2016上的演讲，主要对于Apache NiFi进行了介绍，还介绍了NiFi中新的特性，并且对于MiNiFi的相关概念以及架构设计进行了介绍。

Apache NiFi是Apache基金会的开源项目，其设计目标是自动化系统间的数据流。基于其工作流式的编程理念，NiFi非常易于使用，强大，可靠及高可配置。两个最重要的特性是其强大的用户界面及良好的数据回溯工具。NiFi的用户界面允许用户在浏览器中直观的理解并与数据流举行交互，更快速和安全的进行迭代。

微信关注我们

原文链接：https://yq.aliyun.com/articles/71173

转载内容版权归作者及来源网站所有！

低调大师中文资讯倾力打造互联网数据资讯、行业资源、电子商务、移动互联网、网络营销平台。持续更新报道IT业界、互联网、市场资讯、驱动更新,是最及时权威的产业资讯及硬件资讯报道平台。

Spark结合源码解决数据倾斜造成Too Large Frame

新公司遇到的第一个spark的坑，寻找原因的过程其实还挺有意思，最终在源码和spark ui上的统计数据的帮助下找到根源，具体如下。先说下问题由于严重的数据倾斜，大量数据集中在单个task中，导致shuffle过程中发生异常完整的exeception是这样的但奇怪的是，经过尝试减小executor数量后任务反而成功，增大反而失败，经过多次测试，问题稳定复现。成功的executor数量是7，失败的则是15，集群的active node是7 这结果直接改变了认知，也没爆内存，cpu也够，怎么会这样，executor数量应该越多越快啊，居然还失败了。解决过程这个数在几个失败里不一样，但是都超过了Integer.MaxValue。在spark源码中，这条异常发生在TransportFrameDecoder这个类中检查发现是frame的大小超过了MAX_FRAME_SIZE，而MAX_FRAME_SIZE的大小定义如下这个TransportFrameDecoder继承自ChannelInboundHandlerAdapter，这是Netty里的类，好了，看到这就明白了，原来错误...

2017-03-01

675

本讲义出自Shwetha Shivalingamurthy与Suma Shivaprasad在Hadoop Summit Tokyo 2016上的演讲，主要分享了企业数据分类和治理的案例并且深入地讲解了大数据治理的相关内容，并介绍了Atlas的概览和架构设计以及其特性和发展路线。

2017-03-01

660

资源下载

更多资源

优质分享App

近一个月的开发和优化，本站点的第一个app全新上线。该app采用极致压缩，本体才4.36MB。系统里面做了大量数据访问、缓存优化。方便用户在手机上查看文章。后续会推出HarmonyOS的适配版本。

Mario

马里奥是站在游戏界顶峰的超人气多面角色。马里奥靠吃蘑菇成长，特征是大鼻子、头戴帽子、身穿背带裤，还留着胡子。与他的双胞胎兄弟路易基一起，长年担任任天堂的招牌角色。

Nacos

Nacos /nɑ:kəʊs/ 是 Dynamic Naming and Configuration Service 的首字母简称，一个易于构建 AI Agent 应用的动态服务发现、配置管理和AI智能体管理平台。Nacos 致力于帮助您发现、配置和管理微服务及AI智能体应用。Nacos 提供了一组简单易用的特性集，帮助您快速实现动态服务发现、服务配置、服务元数据、流量管理。Nacos 帮助您更敏捷和容易地构建、交付和管理微服务平台。

Spring

Spring框架（Spring Framework）是由Rod Johnson于2002年提出的开源Java企业级应用框架，旨在通过使用JavaBean替代传统EJB实现方式降低企业级编程开发的复杂性。该框架基于简单性、可测试性和松耦合性设计理念，提供核心容器、应用上下文、数据访问集成等模块，支持整合Hibernate、Struts等第三方框架，其适用范围不仅限于服务器端开发，绝大多数Java应用均可从中受益。