首页 文章 精选 留言 我的
优秀的个人博客,低调大师

微信关注我们

原文链接:https://yq.aliyun.com/articles/666580

转载内容版权归作者及来源网站所有!

低调大师中文资讯倾力打造互联网数据资讯、行业资源、电子商务、移动互联网、网络营销平台。持续更新报道IT业界、互联网、市场资讯、驱动更新,是最及时权威的产业资讯及硬件资讯报道平台。

SQL优化器原理 - Auto Hash Join

这是MaxCompute有关SQL优化器原理的系列文章之一。我们会陆续推出SQL优化器有关优化规则和框架的其他文章。添加钉钉群“关系代数优化技术”(群号11719083)可以获取最新文章发布动态(二维码在文章末尾)。 本文主要描述MaxCompute优化器实现的Auto Hash Join的功能。 简介 在MaxCompute中,Join操作符的实现算法之一名为"Hash Join",其实现原理是,把小表的数据全部读入内存中,并拷贝多份分发到大表数据所在机器,在 map 阶段直接扫描大表数据与内存中的小表数据进行匹配。Hash join执行方式效率很高,但是要求小表数据足够小以便放到内存中,假如小表数据太大,则任务在执行过程中会报OutOfMemory错误。 在MapCompute中,可以使用MapJoin关键字来实现Hash join,

Forrester再次肯定Informatica大数据流分析平台领导地位

ZDNet至顶网软件频道消息: 全球独立数据集成软件提供商Informatica公司近日宣布,Informatica在Forrester Research发布的《Forrester Wave:2014年第三季度大数据流分析平台》报告中名列领导地位。数据流分析包括创建数据流应用程序的开发工具及运行平台,让用户可以从高速数据流中挖掘转瞬即逝的信息。 Forrester将数据流分析视为一种软件,该软件可以筛选、整合、丰富、分析来自不同实时数据源以及任意数据格式的大量数据,识别不同难易程度的数据,实时将业务数据可视化,探查紧急情况,并且立即自动执行。该报告指出,“对大多数公司来说,来自如市场数据、物联网、移动设备、传感器、点击流、甚至交易数据等海量实时数据源的高速、巨量数据流并不通畅。而现在正是利用数据流分析的大好时机。” Forrester调查人员进一步指出,“Informatica为数据流处理能力注入了最优业务规则引擎。Informatica是本次报告中仅有的让开发者从容创作数据流应用程序、将业务规则和数据流操作符同时植入平台的两家供应商之一。” Informatica数据集成高级副总裁兼...

相关文章

发表评论

资源下载

更多资源
优质分享App

优质分享App

近一个月的开发和优化,本站点的第一个app全新上线。该app采用极致压缩,本体才4.36MB。系统里面做了大量数据访问、缓存优化。方便用户在手机上查看文章。后续会推出HarmonyOS的适配版本。

Oracle

Oracle

Oracle Database,又名Oracle RDBMS,或简称Oracle。是甲骨文公司的一款关系数据库管理系统。它是在数据库领域一直处于领先地位的产品。可以说Oracle数据库系统是目前世界上流行的关系数据库管理系统,系统可移植性好、使用方便、功能强,适用于各类大、中、小、微机环境。它是一种高效率、可靠性好的、适应高吞吐量的数据库方案。

JDK

JDK

JDK是 Java 语言的软件开发工具包,主要用于移动设备、嵌入式设备上的java应用程序。JDK是整个java开发的核心,它包含了JAVA的运行环境(JVM+Java系统类库)和JAVA工具。

Sublime Text

Sublime Text

Sublime Text具有漂亮的用户界面和强大的功能,例如代码缩略图,Python的插件,代码段等。还可自定义键绑定,菜单和工具栏。Sublime Text 的主要功能包括:拼写检查,书签,完整的 Python API , Goto 功能,即时项目切换,多选择,多窗口等等。Sublime Text 是一个跨平台的编辑器,同时支持Windows、Linux、Mac OS X等操作系统。