开源大数据分析实验(4)——简单用户画像分析之数据可视化展现

简介: 本场景主要介绍基于海量日志数据进行简单用户画像分析为背景,如何通过使用DataWorks完成数据采集 、加工数据、配置数据质量监控和数据可视化展现等任务。

1. 进入数据分析

在Chromium网页浏览器中,切换至数据开发页签。单击左上方的图标image.png,选择全部产品>数据分析>SQL查询。

image.png

2. 配置数据源

单击新建SQL查询。

image.png

设置数据源。

去安全中心,进行授权。

选择自己MaxCompute引擎实例同名的数据源,单击授权。

image.png

空间角色选择数据分析师,空间成员选择实验给自己分配的子账号。单击确认,完成授权。

image.png

回到SQL查询页面,选择对应数据源,单击保存。

3.编写SQL

在临时文件页签,输入如下SQL语句,单击image.png图标,查询rpt_user_info_d表数据情况。

select * from rpt_user_info_d where dt=${
   
   bdp.system.bizdate};

在成本预估对话框中,单击运行。

image.png

返回结果如下,您可查看到rpt_user_info_d表数据。

image.png

4.修改字段类型。

在结果区域,单击左侧的image.png图标。

image.png

在待选字段列表中,找到pv字段,单击其右侧的 图标,选择修改类型>数值。

image.png

在待选字段列表中,找到dt字段,单击其右侧的 图标,选择修改类型>日期。

image.png

5. 城市注册人数排行榜分析

在结果区域,图标类型选择条形图。

image.png

在结果区域,将维度中的uid字段删除。

image.png

在结果区域,将待选字段列表中的region字段拖入到维度中。

image.png

在结果区域的维度中,选择region>设置字段信息。

image.png

在设置字段信息对话框中,字段展示名输入为身份,单击确认。

image.png

在结果区域的指标中,选择计数(uid)>设置字段信息。

image.png

在设置字段信息对话框中,字段展示名输入为注册会员数,单击确认。

image.png

在结果区域的指标中,选择聚合方式>去重计数。

image.png

返回结果如下,您可查看到城市注册人数排行榜分析。

image.png

6.注册会员访问次数年龄分布

在结果区域,图标类型选择饼图。

image.png

在结果区域,将维度中的省份字段删除。

image.png

在结果区域,将待选字段列表中的age_range字段拖入到维度中。

image.png

在结果区域的维度中,选择age_range>设置字段信息。

image.png

在设置字段信息对话框中,字段展示名输入为年龄区间,单击确认。

image.png

在结果区域,将指标中的注册会员数字段删除。

image.png

在结果区域,将待选字段列表中的pv字段拖入到指标中。

image.png

在结果区域的指标中,选择求和(pv)>设置字段信息。

image.png

在设置字段信息对话框中,字段展示名输入为访问次数,单击确认。

image.png

在结果区域的指标中,选择访问次数>聚合方式>求和。

image.png

返回结果如下,您可查看到注册会员访问次数年龄分布。

image.png

7.注册会员性别访问次数分布

在结果区域,将维度中的年龄区间字段删除。

image.png

在结果区域,将待选字段列表中的gender字段拖入到维度中。

image.png

在结果区域的维度中,选择gender>设置字段信息。

image.png

在设置字段信息对话框中,字段展示名输入为性别,单击确认。

image.png

返回结果如下,您可查看到注册会员性别访问次数分布。

image.png

8.男女星座访问次数分析

在结果区域,将待选字段列表中的zodiac字段拖入到维度中。

image.png

在结果区域的维度中,选择zodiac>设置字段信息。

image.png

在设置字段信息对话框中,字段展示名输入为星座,单击确认。

image.png

在结果区域,图标类型选择柱状图。

image.png

返回结果如下,您可查看到男女星座访问次数分析。

image.png

相关文章
|
7月前
|
存储 分布式计算 大数据
基于Python大数据的的电商用户行为分析系统
本系统基于Django、Scrapy与Hadoop技术,构建电商用户行为分析平台。通过爬取与处理海量用户数据,实现行为追踪、偏好分析与个性化推荐,助力企业提升营销精准度与用户体验,推动电商智能化发展。
|
7月前
|
数据可视化 关系型数据库 MySQL
基于python大数据的的海洋气象数据可视化平台
针对海洋气象数据量大、维度多的挑战,设计基于ECharts的可视化平台,结合Python、Django与MySQL,实现数据高效展示与交互分析,提升科研与决策效率。
|
8月前
|
存储 SQL 分布式计算
终于!大数据分析不用再“又要快又要省钱”二选一了!Dataphin新功能太香了!
Dataphin推出查询加速新功能,支持用StarRocks等引擎直连MaxCompute或Hadoop查原始数据,无需同步、秒级响应。数据只存一份,省成本、提效率,权限统一管理,打破“又要快又要省”的不可能三角,助力企业实现分析自由。
435 49
|
7月前
|
机器学习/深度学习 大数据 关系型数据库
基于python大数据的台风灾害分析及预测系统
针对台风灾害预警滞后、精度不足等问题,本研究基于Python与大数据技术,构建多源数据融合的台风预测系统。利用机器学习提升路径与强度预测准确率,结合Django框架实现动态可视化与实时预警,为防灾决策提供科学支持,显著提高应急响应效率,具有重要社会经济价值。
|
7月前
|
机器学习/深度学习 大数据 关系型数据库
基于python大数据的青少年网络使用情况分析及预测系统
本研究基于Python大数据技术,构建青少年网络行为分析系统,旨在破解现有防沉迷模式下用户画像模糊、预警滞后等难题。通过整合多平台亿级数据,运用机器学习实现精准行为预测与实时干预,推动数字治理向“数据驱动”转型,为家庭、学校及政府提供科学决策支持,助力青少年健康上网。
|
8月前
|
数据采集 数据可视化 关系型数据库
基于python大数据的电影数据可视化分析系统
电影分析与可视化平台顺应电影产业数字化趋势,整合大数据处理、人工智能与Web技术,实现电影数据的采集、分析与可视化展示。平台支持票房、评分、观众行为等多维度分析,助力行业洞察与决策,同时提供互动界面,增强观众对电影文化的理解。技术上依托Python、MySQL、Flask、HTML等构建,融合数据采集与AI分析,提升电影行业的数据应用能力。
|
7月前
|
传感器 人工智能 监控
拔俗多模态跨尺度大数据AI分析平台:让复杂数据“开口说话”的智能引擎
在数字化时代,多模态跨尺度大数据AI分析平台应运而生,打破数据孤岛,融合图像、文本、视频等多源信息,贯通微观与宏观尺度,实现智能诊断、预测与决策,广泛应用于医疗、制造、金融等领域,推动AI从“看懂”到“会思考”的跃迁。
635 0
|
8月前
|
机器学习/深度学习 传感器 分布式计算
数据才是真救命的:聊聊如何用大数据提升灾难预警的精准度
数据才是真救命的:聊聊如何用大数据提升灾难预警的精准度
596 14
|
10月前
|
数据采集 分布式计算 DataWorks
ODPS在某公共数据项目上的实践
本项目基于公共数据定义及ODPS与DataWorks技术,构建一体化智能化数据平台,涵盖数据目录、归集、治理、共享与开放六大目标。通过十大子系统实现全流程管理,强化数据安全与流通,提升业务效率与决策能力,助力数字化改革。
371 4