离线数据计算-国际查询转换率及其他|学习笔记-阿里云开发者社区

离线数据计算-国际查询转换率及其他|学习笔记

2022-11-15 238

版权

本文内容由阿里云实名注册用户自发贡献，版权归原作者所有，阿里云开发者社区不拥有其著作权，亦不承担相应法律责任。具体规则请查看《阿里云开发者社区用户服务协议》和《阿里云开发者社区知识产权保护指引》。如果您发现本社区中有涉嫌抄袭的内容，填写侵权投诉表单进行举报，一经查实，本社区将立刻删除涉嫌侵权内容。

简介： 快速学习离线数据计算-国际查询转换率及其他

开发者学堂课程【大数据实战项目 - 反爬虫系统（Lua+Spark+Redis+Hadoop框架搭建）第七阶段：离线数据计算-国际查询转换率及其他】学习笔记，与课程紧密联系，让用户快速学习知识。

课程地址：https://developer.aliyun.com/learning/course/675/detail/11741

离线数据计算-国际查询转换率及其他

内容简介：

一、国际查询转换率

二、计算和数据获取方式

三、国内航班选择-旅客信息转换率

四、国际航班选择-旅客信息转换率

五、爬虫用户转换率

六、正常用户转换率

一、国际查询转换率

国际查询转换率=添加乘客信息量/浏览的总量

二、计算和数据获取方式

（1）、在 request1-transformed 表中过滤出是国际的操作

代码

request1-transformed.filter(request1-transformed(“flightType”).equalTo(other=”International”)).filter(request1-transformed(“StageTag”).equalTo(other=”International”)).filter(request1-transformed(“StageTag”).equalTo(other=”2”)).count().toFloat/request1.filter(request1(“flightType”).equalTo(other=”National”)).filter(request1(“StageTag”).equalTo(other=”1”))

println(InternationalRate-1)

val1tcast_domest1C_inter_conversion_rate_KDD2=

sc.parallelize(Array(UUID.randomUUID().toString()+”,”+”0,”+”1,”+InternationalRate_1)).map(-.split(regex=”,”

//通过StructType直接指定每个字段的schema

val rowRDD2=itcast_domestic_conversion-rate-RDD2.map(p=>Row(p(0),p(1).toInt,p(2),toInt,p(3).toFloat,data

//将schema信息应用到rowRDD上

提取数据时，输入数据改θ为1

（2）、在上面数据的基础上过滤出 StageTag/2在上面数据的基础上过滤出StageTag=1

第一个θ 步骤类型：θ查询到旅客信息，1旅客信息到下单，2下单到完成支付

第二个θ 类型：θ国内，1国际

三、国内航班选择-旅客信息转换率

（1）、在 request1-transformed 表中过滤出时 National 的操作

代码

val NainlRate_2=request1_transformed,filter(request1_transformed(“flightType”),equa1To(other=”Nayional”)),filter(request1.filter(request(“flightType”).equest1(“flightType”).equa1To(other=”National”)).filter(request1(“StageTag”).equalTo(other=”2”)).

Println(“国内航班选择-旅客信息转换率”)

Println(Natina1Rate_2)

（2）、StageTag=Tag=2

四、国际航班选择-旅客信息转换率

（1）、在 request-transformed 表中过滤出时 International 的操作

代码val Internationa1Rate_2=request1_transformed.filter(request1_transformed(“flightType”).equa1To(other=”Internatinal”))

request1.filter(request1(“flightType”).equa1To(other=”Internatinal”)).filter(request1(“StageTag”).equa1To(other=”2”

println(“国际航班选择-旅客信息转换率”)

print六年（InternatinalRate_2）

（2）、StageTag=3/StageTag=2

五、爬虫用户转换率

（1）、在 request1-transformed 表中过滤出时爬虫的数据

val

代码SpiderUserRate_1=request1_transformed.filter(request1_transformed(“SpiderTag”).equalTo(other=”1”))

.filter(request1_transformed(“StageTag”).equalTo(other=”2”)).count().toFloat/

Request.filter(request_transformed(“StageTag”).equalTo(other”1”)),filter(request1(“StageTag”).equalTo(other=”1”)).count().

Println(“爬虫用户转换率”)

Print六年（SpiderUserRate_1）

/“

（2）、在上面数据的基础上过滤出 StageTag=2/ 在上面数据的基础上过滤出 StageTag=1

六、正常用户转换率

（1）、在 request1-transformed 表中过滤出时不是爬虫的数据

代码val NormalUserRate_1=request1_transformed.filter(request1_transformed(“SpiderTag”),equalTo(other=”0”)),filter(requst1,filter(request1(“SpiderTag”),equalTo(other=”0”)),filter(request1(“StageTag”),equa1To(other=”1”)),count(),

println(“正常用户转换率“)

println（NormaUserRate_1）

（2）、在上面数据的基础上过滤出 StageTag=2/在上面数据的基础上过滤出 StageTag=1

离线数据计算-国际查询转换率及其他|学习笔记

离线数据计算-国际查询转换率及其他

一、国际查询转换率

二、计算和数据获取方式

三、国内航班选择-旅客信息转换率

四、国际航班选择-旅客信息转换率

五、爬虫用户转换率

六、正常用户转换率

阿里云开发者学堂

热门文章

最新文章

相关课程

相关电子书

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

离线数据计算-国际查询转换率及其他|学习笔记

离线数据计算-国际查询转换率及其他

一、国际查询转换率

二、计算和数据获取方式

三、国内航班选择-旅客信息 转换率

四、国际航班选择-旅客信息 转换率

五、爬虫用户转换率

六、正常用户转换率

阿里云开发者学堂

热门文章

最新文章

相关课程

相关电子书

三、国内航班选择-旅客信息转换率

四、国际航班选择-旅客信息转换率