首页 文章 精选 留言 我的
优秀的个人博客,低调大师

微信关注我们

原文链接:https://blog.51cto.com/u_15265965/2891984

转载内容版权归作者及来源网站所有!

低调大师中文资讯倾力打造互联网数据资讯、行业资源、电子商务、移动互联网、网络营销平台。持续更新报道IT业界、互联网、市场资讯、驱动更新,是最及时权威的产业资讯及硬件资讯报道平台。

Spark RDD算子进阶(转换算子、行动算子、缓存、持久化)

教程目录 0x00 教程内容 0x01 进阶算子操作 1. 创建RDD 2. 转换算子 【1】reduceByKey(func) 【2】groupByKey() 【3】mapValues(func) 【4】flatMapValues(func) 【5】keys() 【6】values() 【7】sortByKey() 【8】combineByKey(createCombiner, mergeValue, mergeCombiners) 【9】subtractByKey() 【10】cogroup() 3. 行动算子 【1】countByKey() 【2】lookup() 【3】collectAsMap() 0x02 RDD的缓存与持久化 1. 缓存与持久化的意义 2. 缓存 3. 持久化 4. persist()的两个坑 0xFF 总结 0x00 教程内容 转换算子与行动算子的进阶操作 RDD的缓存与持久化 0x01 进阶算子操作 1. 创建RDD val rdd = sc.parallelize(List((1,1),(2,1),(3,1),(3,4))) 2. 转换算子 【1】r...

关注企业开源供应链:开源有风险,使用需谨慎!

所谓的软件供应链,就是一个企业在生产环境中,包括研发、运营、销售等环节所依赖的计算机软件。如今,大部分企业所使用的基础软件都是基于开源软件实现,有研究表明目前企业所使用的软件中,开源软件占比已高达 90%,可见开源软件在今天的重要地位。 然而,开源软件不同于有供应商提供一站式服务的商用软件。很多企业使用的开源软件通常来源于开源社区或各大代码托管平台,如何保证这些软件的安全性与合规性,就成为了每个使用开源软件的企业必须思考的问题。 开放原子基金会 TOC 副主席谭中意是一位拥有 20 年开源经验的软件工程师,同时也是国际开源合规项目 OpenChain 中国工作组联合创始人。本文将整理谭中意老师在 GOTC 全球开源技术峰会「开源运营与治理」 直播专场的演讲内容,为大家介绍企业开源软件供应链常见的风险和挑战,以及国际开源供应链标准 OpenChain 项目如何帮助企业解决和避免这些问题。 直播回放:https://play.itdks.com/watch/10441588?player 开源软件供应链的风险与挑战 开源软件在企业软件开发中的地位无需赘言,但很多企业的开发团队在使用开源软件...

相关文章

发表评论

资源下载

更多资源
优质分享App

优质分享App

近一个月的开发和优化,本站点的第一个app全新上线。该app采用极致压缩,本体才4.36MB。系统里面做了大量数据访问、缓存优化。方便用户在手机上查看文章。后续会推出HarmonyOS的适配版本。

Mario

Mario

马里奥是站在游戏界顶峰的超人气多面角色。马里奥靠吃蘑菇成长,特征是大鼻子、头戴帽子、身穿背带裤,还留着胡子。与他的双胞胎兄弟路易基一起,长年担任任天堂的招牌角色。

Apache Tomcat

Apache Tomcat

Tomcat是Apache 软件基金会(Apache Software Foundation)的Jakarta 项目中的一个核心项目,由Apache、Sun 和其他一些公司及个人共同开发而成。因为Tomcat 技术先进、性能稳定,而且免费,因而深受Java 爱好者的喜爱并得到了部分软件开发商的认可,成为目前比较流行的Web 应用服务器。

Sublime Text

Sublime Text

Sublime Text具有漂亮的用户界面和强大的功能,例如代码缩略图,Python的插件,代码段等。还可自定义键绑定,菜单和工具栏。Sublime Text 的主要功能包括:拼写检查,书签,完整的 Python API , Goto 功能,即时项目切换,多选择,多窗口等等。Sublime Text 是一个跨平台的编辑器,同时支持Windows、Linux、Mac OS X等操作系统。