一分钟了解阿里云产品:墨迹天气之阿里云MaxCompute实践

 

墨迹天气成立到现在5年多,已经积累了4亿用户。同时,在墨迹天气上,每天有超过 5 亿次的天气查询需求。墨迹天气已经集成了多语言版本,可根据手机系统语言自动适配,用户覆盖包括中国大陆、港澳台,日韩及东南亚、欧美等全球各地用户。运营团队每天最关心的是这些用户正在如何使用墨迹,在他们操作中透露了哪些个性化需求。

 

 

这些数据全部存储在墨迹的API日志中,墨迹天气的API每天产生的日志量大约在400GB左右,分析工具采用了阿里云的大数据计算服务MaxCompute。

 

使用MaxCompute流程如下:

 

1.在每个日志服务器上都安装了Fluentd及MaxCompute数据导入插件。日志数据通过流通道DataHub实时导入到MaxCompute。

 

2.数据分析作业分小时级和天级任务。数据开发工程师通过MaxCompute Python SDK向ODPS提交SQL 分析脚本,将统计后的数据导入Mongo DB。报表系统直接对接Mongo DB。

 

3.运营人员通过报表系统来查看用户统计结果。

 

整个数据分析过程也做了很多优化。以下是几点说明:

 

1. Fluentd是一款优秀的日志导入软件。支持300多个插件,基本上今天的大数据处理系统,Fluentd都能支持。Fluentd还支持自定义插件。墨迹选择了使用Fluentd向MaxCompute导入数据。

 

2.墨迹的服务器部署在不同时区,日志数据按天和小时两级分区流入到MaxCompute表中,但统计作业是发生在北京时间。由于时区不同,部分数据在统计时会落掉。Fluentd中Filter 插件可以完成这个转换操作。

 

3.墨迹分析的作业每天和每小时都会执行。分析后的数据导入本地Mongo DB,报表系统接入Mongo DB来做展现。墨迹分析工程师在本地使用定时调度Python脚本完成这些流程。SQL 分析脚本可以通过ODPS Python SDK直接提交到MaxCompute上执行完,完成后将统计结果放到List 对象。通过Python Mongo Client 将List写入Mongo DB。迁移到MaxCompute后,流程上做了优化,EMR的工作省掉了,日志数据导入到MaxCompute表后,通过SQL进行分析,完成后直接将结果写入本地Mongo DB。在存储方面,MaxCompute中的表按列压缩存储,更节省存储空间,整体上存储和计算的费用比之前省了70%,性能和稳定性也提高了很多。同时墨迹可以借助MaxCompute上的机器学习算法,对数据进行深度挖掘,为用户提供个性化的天气服务。

 

 

如果您想详细了解MaxCompute相关体验,请访问:

http://www.zhihu.com/question/24441220

 

优秀的个人博客,低调大师

微信关注我们

原文链接:https://yq.aliyun.com/articles/6931

转载内容版权归作者及来源网站所有!

低调大师中文资讯倾力打造互联网数据资讯、行业资源、电子商务、移动互联网、网络营销平台。持续更新报道IT业界、互联网、市场资讯、驱动更新,是最及时权威的产业资讯及硬件资讯报道平台。

相关文章

发表评论

资源下载

更多资源
优质分享Android(本站安卓app)

优质分享Android(本站安卓app)

近一个月的开发和优化,本站点的第一个app全新上线。该app采用极致压缩,本体才4.36MB。系统里面做了大量数据访问、缓存优化。方便用户在手机上查看文章。后续会推出HarmonyOS的适配版本。

Mario,低调大师唯一一个Java游戏作品

Mario,低调大师唯一一个Java游戏作品

马里奥是站在游戏界顶峰的超人气多面角色。马里奥靠吃蘑菇成长,特征是大鼻子、头戴帽子、身穿背带裤,还留着胡子。与他的双胞胎兄弟路易基一起,长年担任任天堂的招牌角色。

Apache Tomcat7、8、9(Java Web服务器)

Apache Tomcat7、8、9(Java Web服务器)

Tomcat是Apache 软件基金会(Apache Software Foundation)的Jakarta 项目中的一个核心项目,由Apache、Sun 和其他一些公司及个人共同开发而成。因为Tomcat 技术先进、性能稳定,而且免费,因而深受Java 爱好者的喜爱并得到了部分软件开发商的认可,成为目前比较流行的Web 应用服务器。

Sublime Text 一个代码编辑器

Sublime Text 一个代码编辑器

Sublime Text具有漂亮的用户界面和强大的功能,例如代码缩略图,Python的插件,代码段等。还可自定义键绑定,菜单和工具栏。Sublime Text 的主要功能包括:拼写检查,书签,完整的 Python API , Goto 功能,即时项目切换,多选择,多窗口等等。Sublime Text 是一个跨平台的编辑器,同时支持Windows、Linux、Mac OS X等操作系统。