空间大数据:机遇与挑战并存

本文涉及的产品
云原生大数据计算服务 MaxCompute,5000CU*H 100GB 3个月
云原生大数据计算服务MaxCompute,500CU*H 100GB 3个月
简介:

“大数据的魅力,在于它几乎能够研究世界上的任何问题。”全国政协常委、国家测绘地理信息局副局长李朋德在6月13日召开的WGDC2017上指出,我们已经来到了数据大爆炸的时代。

李朋德认为,空间大数据要在中国充分发挥价值,就需要在数据开放和共享上做出突破。他表示,未来,将会有越来越多的权威地理信息数据开放给社会和企业,空间大数据将迎来新的机遇。

挖掘空间大数据的价值

“大数据已经上升为国家战略,而几乎所有的大数据,都需要而且可以与地理信息数据紧密融合。”泰伯创始人、董事长兼CEO刘玉璋表示,空间大数据是大数据与地理信息数据的融合体。由此,空间大数据正在全球范围内迅速崛起,给政府用户、企业用户与个人用户提供前所未有的应用价值和服务能力。

“空间大数据的崛起,带来的远比我们想象的要多得多。”泰伯研究院专家顾问、英国伦敦大学学院教授程涛说,“空间大数据崛起给我们带来的是时空大数据,不只是告诉位置,也不只是告诉时间,更重要是有了内涵和内容。这为城市智能化和个人的位置服务提供了非常好的机遇。”

数据离不开时空,在李朋德看来,大数据有序的挖掘才能出现价值。他把时空大数据分为五大形态,第一是基础地理信息数据,即按照国家标准精准测绘所形成的政府数据;第二是专题地理信息数据,比如地理国情所获取的大量与经济、社会有关的数据;第三是专业地理信息数据,如农业部门、国土部门等专业部门的数据;第四是传感地理信息数据,也是时空大数据里面重要且有活力的部分,并涵盖很多的领域;第五是社交地理信息数据,比如采集的共享单车所走的轨迹等数据。

“目前,真正在经济价值上值得花功夫的是第四类和第五类,而前面一、二、三类是政府部门有序打开支撑产业的发展。因此要建立以企业为中心的公众服务、事业支撑、政府监管的新大数据体制。”李朋德说。

李朋德也带来了时空大数据创新发展方面的新思路:把“一带一路”沿线和区域的大坐标关联起来,形成基础地理数据和系列的地图成果,用于规划、建设、感知,借助互联网时代的物联网、云计算和大数据技术,时空数据在数字空间串接起来,形成物理世界的虚拟再现,支持混合现实的智能化管理,为地理信息产业发展提供全新的渠道和原动力。

知卓集团创始人、董事长、泰伯研究院顾问委员陶闯还在大会上发布了《2017中国空间大数据产业趋势报告》。陶闯在发布趋势报告时表示,物联网、云计算、大数据、人工智能的迅速发展,正在催生一个庞大的空间大数据产业链。他认为,空间大数据是全球政府管理和经济发展的基础设施,随着产业的迅速发展,空间大数据将会在社会经济的各个领域发挥不可替代的重要作用,尤其是在智慧城市和智慧汽车领域。

仍面临很多挑战

虽然,现在通过遥感、社会感知传感器等获得了一些信息,这些信息从理论上来说可以更好地理解客观的世界、物理的世界,但是挑战也相当明显。

中国科学院院士、泰伯研究院名誉院长龚健雅在报告中指出,测绘遥感有严格的产品标准和生产技术规程,社会感知数据没有标准规范,模态多样、杂乱无章,如何梳理成可信的数据是一大挑战。

“如果两类数据要融合的话,它的量不一致、时空尺度不一致、精度不一致、可靠性不一致,两类数据如何集成,信息和空间如何融合?这是第一个挑战。”龚健雅说。

另外,“社会感知的数据杂乱无章需要清理,清理后需要入库,是否在线清理等都是一系列的问题。传感网的数据很大,是把传感网的数据直接存进来,还是摘取,这都给我们带来挑战。”

从动态到实施,无论是测绘还是遥感,获取的信息都是在某一个时刻经过时得到的,往往把数据导入数据库里进行管理。但是现在,地理信息已从静态向动态发展,传统的数据管理的模式已经不再适应。

“今天,从传感和各种感知设备出来之后,我们迫切需要发展一种新的地理信息系统。”龚健雅提出,能够支撑实时数据采集、处理、分析与应用模拟的实时的地理信息系统(GIS)将成为未来GIS发展的一个重要方向,也是时空大数据分析的重要平台。

“在统一的空间大数据框架下,基于传感网的实时动态GIS可以实时管理与分析城市内部的人流、物流和事件流,因而能够在智慧城市中发挥重要作用。”龚健雅说。

他还表示,天、空、地传感器成为地理信息数据采集与实时更新的重要工具,传感网与互联网和云计算结合将构成地理国情监测、智慧城市、大数据分析的基础设施。

本文转自d1net(转载)

相关实践学习
基于MaxCompute的热门话题分析
本实验围绕社交用户发布的文章做了详尽的分析,通过分析能得到用户群体年龄分布,性别分布,地理位置分布,以及热门话题的热度。
SaaS 模式云数据仓库必修课
本课程由阿里云开发者社区和阿里云大数据团队共同出品,是SaaS模式云原生数据仓库领导者MaxCompute核心课程。本课程由阿里云资深产品和技术专家们从概念到方法,从场景到实践,体系化的将阿里巴巴飞天大数据平台10多年的经过验证的方法与实践深入浅出的讲给开发者们。帮助大数据开发者快速了解并掌握SaaS模式的云原生的数据仓库,助力开发者学习了解先进的技术栈,并能在实际业务中敏捷的进行大数据分析,赋能企业业务。 通过本课程可以了解SaaS模式云原生数据仓库领导者MaxCompute核心功能及典型适用场景,可应用MaxCompute实现数仓搭建,快速进行大数据分析。适合大数据工程师、大数据分析师 大量数据需要处理、存储和管理,需要搭建数据仓库?学它! 没有足够人员和经验来运维大数据平台,不想自建IDC买机器,需要免运维的大数据平台?会SQL就等于会大数据?学它! 想知道大数据用得对不对,想用更少的钱得到持续演进的数仓能力?获得极致弹性的计算资源和更好的性能,以及持续保护数据安全的生产环境?学它! 想要获得灵活的分析能力,快速洞察数据规律特征?想要兼得数据湖的灵活性与数据仓库的成长性?学它! 出品人:阿里云大数据产品及研发团队专家 产品 MaxCompute 官网 https://www.aliyun.com/product/odps 
相关文章
|
4月前
|
存储 分布式计算 NoSQL
惊呆了!大数据处理竟然这么牛?挑战与机遇并存,看完这篇,你也能成为数据处理大师!
【8月更文挑战第6天】信息时代中,数据成为关键资源。企业需分析海量数据洞察市场、优化流程、提效决策。面对TB乃至PB级数据量及其多样性与复杂性的挑战,HDFS与NoSQL确保高效存储,而MapReduce和Spark等框架支持分布式计算,大幅提升处理效率。在金融、电商和医疗等领域,大数据正推动风险识别、精准营销与精准医疗等应用的发展,展现广阔前景。
78 1
|
5月前
|
弹性计算 分布式计算 大数据
MaxCompute产品使用合集之如何将用户A从项目空间A申请的表权限需要改为用户B
MaxCompute作为一款全面的大数据处理平台,广泛应用于各类大数据分析、数据挖掘、BI及机器学习场景。掌握其核心功能、熟练操作流程、遵循最佳实践,可以帮助用户高效、安全地管理和利用海量数据。以下是一个关于MaxCompute产品使用的合集,涵盖了其核心功能、应用场景、操作流程以及最佳实践等内容。
|
6月前
|
分布式计算 DataWorks API
DataWorks操作报错合集之在将ODPS空间设置成保护模式后,导出到OSS的任务出现了权限问题,该怎么解决
DataWorks是阿里云提供的一站式大数据开发与治理平台,支持数据集成、数据开发、数据服务、数据质量管理、数据安全管理等全流程数据处理。在使用DataWorks过程中,可能会遇到各种操作报错。以下是一些常见的报错情况及其可能的原因和解决方法。
178 1
|
6月前
|
存储 SQL 分布式计算
MaxCompute产品使用问题之如何查看项目空间耗用的存储大小
MaxCompute作为一款全面的大数据处理平台,广泛应用于各类大数据分析、数据挖掘、BI及机器学习场景。掌握其核心功能、熟练操作流程、遵循最佳实践,可以帮助用户高效、安全地管理和利用海量数据。以下是一个关于MaxCompute产品使用的合集,涵盖了其核心功能、应用场景、操作流程以及最佳实践等内容。
110 3
|
5月前
|
机器学习/深度学习 分布式计算 大数据
MaxCompute产品使用合集之如何查看空间资源、CPU和内存以及存储空间容量
MaxCompute作为一款全面的大数据处理平台,广泛应用于各类大数据分析、数据挖掘、BI及机器学习场景。掌握其核心功能、熟练操作流程、遵循最佳实践,可以帮助用户高效、安全地管理和利用海量数据。以下是一个关于MaxCompute产品使用的合集,涵盖了其核心功能、应用场景、操作流程以及最佳实践等内容。
100 0
|
6月前
|
机器学习/深度学习 人工智能 分布式计算
人工智能平台PAI操作报错合集之在ODPS的xxx_dev项目空间调用easyrec训练,需要访问yyy项目空间的OSS,出现报错,是什么导致的
阿里云人工智能平台PAI (Platform for Artificial Intelligence) 是阿里云推出的一套全面、易用的机器学习和深度学习平台,旨在帮助企业、开发者和数据科学家快速构建、训练、部署和管理人工智能模型。在使用阿里云人工智能平台PAI进行操作时,可能会遇到各种类型的错误。以下列举了一些常见的报错情况及其可能的原因和解决方法。
|
6月前
|
分布式计算 大数据 关系型数据库
MaxCompute产品使用问题之如何查看表占用的空间大小
MaxCompute作为一款全面的大数据处理平台,广泛应用于各类大数据分析、数据挖掘、BI及机器学习场景。掌握其核心功能、熟练操作流程、遵循最佳实践,可以帮助用户高效、安全地管理和利用海量数据。以下是一个关于MaxCompute产品使用的合集,涵盖了其核心功能、应用场景、操作流程以及最佳实践等内容。
|
7月前
|
分布式计算 DataWorks 关系型数据库
MaxCompute产品使用合集之在DataWorks中,怎么创建空间并绑定MaxCompute引擎,然后创建项目
MaxCompute作为一款全面的大数据处理平台,广泛应用于各类大数据分析、数据挖掘、BI及机器学习场景。掌握其核心功能、熟练操作流程、遵循最佳实践,可以帮助用户高效、安全地管理和利用海量数据。以下是一个关于MaxCompute产品使用的合集,涵盖了其核心功能、应用场景、操作流程以及最佳实践等内容。
|
7月前
|
分布式计算 关系型数据库 大数据
MaxCompute产品使用合集之怎么才可以将 PostgreSQL 中的 geometry 空间类型字段同步到 MaxCompute 或另一个 PostgreSQL 数据库
MaxCompute作为一款全面的大数据处理平台,广泛应用于各类大数据分析、数据挖掘、BI及机器学习场景。掌握其核心功能、熟练操作流程、遵循最佳实践,可以帮助用户高效、安全地管理和利用海量数据。以下是一个关于MaxCompute产品使用的合集,涵盖了其核心功能、应用场景、操作流程以及最佳实践等内容。