欢迎加入HBase生态+Spark社区大群-低调大师

欢迎加入HBase生态+Spark社区大群

2018-11-03 770

首选欢迎各位同学使用云HBase产品，地址为：https://cn.aliyun.com/product/hbase?spm=5176.51065.416540.50.EgxJI1
为了让营造一个针对云HBase的技术交流平台，我们特别新建了交流群：
目前国内HBase没有较大的社区及交流群体，但是很多公司都有HBase的应用，阿里云云HBase技术团队愿意补充这一块，共同探讨HBase及其生态的问题。

【HBase大神推荐】： 【关注专家，将收到及时的HBase博客，周刊，线下meetup邀请】
阿里专家：封神
09年加入阿里巴巴，阿里云高级技术专家、架构师；专注在大数据领域，多年分布式经验；先后研发上万台Hadoop、ODPS集群；先后负责阿里分布式调度平台YARN；自主研发分布式内存计算引擎，负责Spark；目前为广大公共云用户提供

微信关注我们

原文链接：https://yq.aliyun.com/articles/664521

转载内容版权归作者及来源网站所有！

低调大师中文资讯倾力打造互联网数据资讯、行业资源、电子商务、移动互联网、网络营销平台。持续更新报道IT业界、互联网、市场资讯、驱动更新,是最及时权威的产业资讯及硬件资讯报道平台。

Spark DataFrame 的 groupBy vs groupByKey

在使用 Spark SQL 的过程中，经常会用到 groupBy 这个函数进行一些统计工作。但是会发现除了 groupBy 外，还有一个 groupByKey（注意RDD 也有一个 groupByKey，而这里的 groupByKey 是 DataFrame 的）。这个 groupByKey 引起了我的好奇，那我们就到源码里面一探究竟吧。所用 spark 版本：spark 2.1.0 先从使用的角度来说，groupBy：groupBy类似于传统SQL语言中的group by子语句，但比较不同的是groupBy()可以带多个列名，对多个列进行group。比如想根据 "id" 和 "name" 进行 groupBy 的话可以 df.goupBy("id","name") groupBy返回的类型是RelationalGroupedDataset。 groupByKey：groupByKey则更加灵活，可以根据用户自己对列的组合来进行groupBy，比如上面的那个例子，根据 "id" 和 "name" 进行 groupBy，使用groupByKey可以这样。 //同前面的goupBy效...

2018-11-03

607

1.背景互联网从来就不是一个安全的地方。很多时候我们过分依赖防火墙来解决安全的问题，不幸的是，防火墙是假设“坏人”是来自外部的，而真正具有破坏性的攻击事件都是往往都是来自于内部的。近几年，在thehackernews等网站上总会时不时的看到可以看到一些因为数据安全问题被大面积攻击、勒索的事件。在Hadoop1.0.0之前，Hadoop并不提供对安全的支持，默认集群内所有角色都是可靠的。用户访问时不需要进行任何验证,++导致++恶意用户很容易就可以伪装进入集群进行破坏。要保证Hadoop集群的安全，至少要做到2个A：Authentication(认证)，Authorization(授权)。常见的方案有： Authentication：MIT Kerberos, Azure AD, Kerby Authorization：Apache Sentry(Cloudera), Apache Ranger(Hortonworks) Hadoop集群对Kerberos的支持 2012年1.0.0版本正式发布后，Hadoop才增加了对Kerberos的支持, 使得集群中的节点是可信任的。 Ker...

2018-11-04

681

资源下载

更多资源

腾讯云软件源

为解决软件依赖安装时官方源访问速度慢的问题，腾讯云为一些软件搭建了缓存服务。您可以通过使用腾讯云软件源站来提升依赖包的安装速度。为了方便用户自由搭建服务架构，目前腾讯云软件源站支持公网访问和内网访问。

Spring

Spring框架（Spring Framework）是由Rod Johnson于2002年提出的开源Java企业级应用框架，旨在通过使用JavaBean替代传统EJB实现方式降低企业级编程开发的复杂性。该框架基于简单性、可测试性和松耦合性设计理念，提供核心容器、应用上下文、数据访问集成等模块，支持整合Hibernate、Struts等第三方框架，其适用范围不仅限于服务器端开发，绝大多数Java应用均可从中受益。

Sublime Text

Sublime Text具有漂亮的用户界面和强大的功能，例如代码缩略图，Python的插件，代码段等。还可自定义键绑定，菜单和工具栏。Sublime Text 的主要功能包括：拼写检查，书签，完整的 Python API ， Goto 功能，即时项目切换，多选择，多窗口等等。Sublime Text 是一个跨平台的编辑器，同时支持Windows、Linux、Mac OS X等操作系统。

WebStorm

WebStorm 是jetbrains公司旗下一款JavaScript 开发工具。目前已经被广大中国JS开发者誉为“Web前端开发神器”、“最强大的HTML5编辑器”、“最智能的JavaScript IDE”等。与IntelliJ IDEA同源，继承了IntelliJ IDEA强大的JS部分的功能。