基于阿里云大数据产品的重庆地区招聘数据分析

简介: 随着重庆的迅速发展,越来越多的毕业生以及外来人员选择在重庆工作,同时重庆也提供了众多的工作岗位。在数以万计的工作岗位中,求职者对公司与职位了解甚少,这对他们的工作选择带来了巨大的问题。我们将基于重庆地区的各个公司招聘信息数据进行分析,让大家能够迅速清晰了解各个职位的薪资等信息

一、项目背景
随着重庆的迅速发展,越来越多的毕业生以及外来人员选择在重庆工作,同时重庆也提供了众多的工作岗位。在数以万计的工作岗位中,求职者对公司与职位了解甚少,这对他们的工作选择带来了巨大的问题。为了帮助求职者对重庆的公司和需求的工作岗位,我们将基于重庆地区的各个公司招聘信息数据进行分析,让大家能够迅速清晰了解各个职位的薪资,要求等以及公司的潜力等等信息,相互比较,做出合理选择。同时政府也可以通过招聘信息判断当前重庆的人才需求。

二、项目处理流程
image.png

三、项目难点
1.同一或者不同职业类中出现了的相同的招聘职业名时的统计问题。
关系表中有一个唯一的主键URL,它是该职位信息网页的一部分url地址,不会有重复,可以对职位进行区分。
2.优势公司的推荐标准的设置。
评判优势公司的依据:公司所在的城市,公司的融资情况,公司所提供的职位数量。
公司离重庆越近,融资情况越好,提供的职位越多,那么该公司的优势就越大
3.在进行数据分析的时候遇到了大量的困难,数据所涉及到了各行各业种类太多,数据处理太复杂,对于不了解的职位类型可能得到不正确的结果
将不了解的职位类别不再向下细分,以大类为单位进行数据分析,降低了数据的精确性,但提高了结果的正确性。
4.数据的分类不太科学,有些分类里面的数据量过少,不具有代表性。
去除该数据
5.爬数据时,网站有反爬系统封掉IP,这对获取数据来说,是致命的。
经过一段时间的试验,了解到了反爬系统的工作流程,制定相应的方案饶过反爬系统,高效地获取数据。

四、项目结果及可视化呈现
1.重庆地区当前的热门行业有互联网,生活服务,娱乐文化,电子商务,旅游,在线教育等等,拥有9314家招聘公司,提供9万个职位
2.当前需求量最大的职业方向是技术类与管理类,其中金融类职业的平均工资最高,采购贸易工资低,招收少。同时发展趋势较好的是与IT相关的技术类职业
3.对于各个职业来说学历超过本科以上工资会有明显增加,工作经验3年以上对工资影响最大。重庆人才需求的趋势在向高学历发展,硕士占比越来越大
4.目前重庆地区行业多样化,职业需求量大,互联网等行业值得投资,工作最有利的职业是技术方面,有一定工作经验的最适合在这里工作

image.png
image.png
image.png
image.png
image.png
image.png
image.png
image.png

相关实践学习
基于MaxCompute的热门话题分析
Apsara Clouder大数据专项技能认证配套课程:基于MaxCompute的热门话题分析
目录
相关文章
|
2月前
|
数据可视化 大数据 关系型数据库
基于python大数据技术的医疗数据分析与研究
在数字化时代,医疗数据呈爆炸式增长,涵盖患者信息、检查指标、生活方式等。大数据技术助力疾病预测、资源优化与智慧医疗发展,结合Python、MySQL与B/S架构,推动医疗系统高效实现。
|
2月前
|
机器学习/深度学习 搜索推荐 数据挖掘
数据分析真能让音乐产业更好听吗?——聊聊大数据在音乐里的那些事
数据分析真能让音乐产业更好听吗?——聊聊大数据在音乐里的那些事
172 9
|
3月前
|
人工智能 分布式计算 DataWorks
阿里云大数据AI产品月刊-2025年8月
阿里云大数据& AI 产品技术月刊【2025年 8 月】,涵盖 8 月技术速递、产品和功能发布、市场和客户应用实践等内容,帮助您快速了解阿里云大数据& AI 方面最新动态。
336 2
|
3月前
|
数据可视化 数据挖掘 大数据
基于python大数据的水文数据分析可视化系统
本研究针对水文数据分析中的整合难、分析单一和可视化不足等问题,提出构建基于Python的水文数据分析可视化系统。通过整合多源数据,结合大数据、云计算与人工智能技术,实现水文数据的高效处理、深度挖掘与直观展示,为水资源管理、防洪减灾和生态保护提供科学决策支持,具有重要的应用价值和社会意义。
|
3月前
|
机器学习/深度学习 传感器 分布式计算
数据才是真救命的:聊聊如何用大数据提升灾难预警的精准度
数据才是真救命的:聊聊如何用大数据提升灾难预警的精准度
288 14
|
5月前
|
数据采集 分布式计算 DataWorks
ODPS在某公共数据项目上的实践
本项目基于公共数据定义及ODPS与DataWorks技术,构建一体化智能化数据平台,涵盖数据目录、归集、治理、共享与开放六大目标。通过十大子系统实现全流程管理,强化数据安全与流通,提升业务效率与决策能力,助力数字化改革。
191 4
|
4月前
|
机器学习/深度学习 运维 监控
运维不怕事多,就怕没数据——用大数据喂饱你的运维策略
运维不怕事多,就怕没数据——用大数据喂饱你的运维策略
177 0
|
3月前
|
传感器 人工智能 监控
数据下田,庄稼不“瞎种”——聊聊大数据如何帮农业提效
数据下田,庄稼不“瞎种”——聊聊大数据如何帮农业提效
156 14
|
2月前
|
传感器 人工智能 监控
拔俗多模态跨尺度大数据AI分析平台:让复杂数据“开口说话”的智能引擎
在数字化时代,多模态跨尺度大数据AI分析平台应运而生,打破数据孤岛,融合图像、文本、视频等多源信息,贯通微观与宏观尺度,实现智能诊断、预测与决策,广泛应用于医疗、制造、金融等领域,推动AI从“看懂”到“会思考”的跃迁。