什么是大数据?

本文涉及的产品
云原生大数据计算服务MaxCompute,500CU*H 100GB 3个月
云原生大数据计算服务 MaxCompute,5000CU*H 100GB 3个月
简介:   然而,什么是大数据?至今也没有一个比较权威的定义。  麦肯锡曾给出大数据的定义是:大数据是指大小超出了常规数据库工具获取、存储、管理和分析能力的数据集合。  维基百科也给出类似的定义:大数据指的是所涉及的数据量规模大到无法通过目前主流软件工具,在合理时间内达到撷取、管理、处理并整理成为帮助企业经营决策更积极目的的资讯。  一句话,大数据就是数据量大?!  我觉得,这句话说了等于没说,还容易让人误解。你以为数据量大才是大数据?

  然而,什么是大数据?至今也没有一个比较权威的定义。

  麦肯锡曾给出大数据的定义是:大数据是指大小超出了常规数据库工具获取、存储、管理和分析能力的数据集合。

  维基百科也给出类似的定义:大数据指的是所涉及的数据量规模大到无法通过目前主流软件工具,在合理时间内达到撷取、管理、处理并整理成为帮助企业经营决策更积极目的的资讯。

  一句话,大数据就是数据量大?!

  我觉得,这句话说了等于没说,还容易让人误解。你以为数据量大才是大数据?

  大数据(Big Data)的概念,其实早在上个世纪九十年代就已经提出。

  最初,大数据是特指由于需要处理的数据量过大,其所需要的计算能力已经超出了单台电脑的处理能力,因此工程师们必须要找到新的处理技术和方法,以便快速处理数据。比如,二手手机靓号交易平台要利用上百上千台电脑组建的集群系统中,实现海量数据的分布式存储和分布式计算,但这需要新的计算系统(比如Apache的开源系统Hadoop大数据平台系统)来实现。

  另一方面,随着互联网的发展,所谓数据也不仅仅是指保存在数据库中的排列整齐的结构化数据,也包含大量的非结构化和半结构化的数据(比如网页、图片、音频、视频等等),这些数据也同样蕴含着重要的信息,也属于大数据的范畴。

  所以,用数据本身的特征来定义,大数据可以理解为海量数据和复杂数据。

  大数据=海量数据 + 复杂数据

  其实,大数据并非一个确切的概念,就正如互联网的概念一样。互联网,不仅仅是一个计算机网络,其中有更丰富的内涵;大数据,也不仅仅是数据量大那么简单。

  在今天,大数据只是一个泛称,它可以是一种应用场景,也可以是一种技术(分布式技术),是一种方法(分析和挖掘方法),是一种工具(探索事物规律的工具),更是一种思维方式(大数据思维),等等。

  尽管,无法给大数据一个明确的定义,但这并不妨碍人们将这个概念应用到人类社会中的所有行业、所有领域中,以解决生活、工作、商业的问题。

相关实践学习
基于MaxCompute的热门话题分析
本实验围绕社交用户发布的文章做了详尽的分析,通过分析能得到用户群体年龄分布,性别分布,地理位置分布,以及热门话题的热度。
SaaS 模式云数据仓库必修课
本课程由阿里云开发者社区和阿里云大数据团队共同出品,是SaaS模式云原生数据仓库领导者MaxCompute核心课程。本课程由阿里云资深产品和技术专家们从概念到方法,从场景到实践,体系化的将阿里巴巴飞天大数据平台10多年的经过验证的方法与实践深入浅出的讲给开发者们。帮助大数据开发者快速了解并掌握SaaS模式的云原生的数据仓库,助力开发者学习了解先进的技术栈,并能在实际业务中敏捷的进行大数据分析,赋能企业业务。 通过本课程可以了解SaaS模式云原生数据仓库领导者MaxCompute核心功能及典型适用场景,可应用MaxCompute实现数仓搭建,快速进行大数据分析。适合大数据工程师、大数据分析师 大量数据需要处理、存储和管理,需要搭建数据仓库?学它! 没有足够人员和经验来运维大数据平台,不想自建IDC买机器,需要免运维的大数据平台?会SQL就等于会大数据?学它! 想知道大数据用得对不对,想用更少的钱得到持续演进的数仓能力?获得极致弹性的计算资源和更好的性能,以及持续保护数据安全的生产环境?学它! 想要获得灵活的分析能力,快速洞察数据规律特征?想要兼得数据湖的灵活性与数据仓库的成长性?学它! 出品人:阿里云大数据产品及研发团队专家 产品 MaxCompute 官网 https://www.aliyun.com/product/odps 
目录
相关文章
|
2月前
|
存储 传感器 数据采集
大数据
大数据是指数据量庞大(Volume)、增长迅速(Velocity)、类型多样(Variety)、价值密度低(Value)但潜力巨大的数据集。其来源包括互联网、物联网及企业内部数据。处理技术涵盖采集、预处理、存储、分析与可视化。应用领域涉及商业智能、金融、医疗、交通及公共服务等,助力决策优化与创新。
34 8
|
存储 机器学习/深度学习 SQL
什么是大数据?
什么是大数据?
283 0
什么是大数据?
|
存储 分布式计算 资源调度
大数据1
大数据1
637 0
大数据1
|
存储 分布式计算 大数据
深入理解大数据
大数据的定义、采集、应用、意义和前景
201 0
|
新零售 存储 Java
关于大数据最常见的10个问题,必看!
1、云计算与大数据是什么关系?   云计算的关键词在于“整合”,无论你是通过现在已经很成熟的传统的虚拟机切分型技术,还是通过google后来所使用的海量节点聚合型技术,他都是通过将海量的服务器资源通过网络进行整合,调度分配给用户,从而解决用户因为存储计算资源不足所带来的问题。
1298 0
|
存储 人工智能 大数据
|
分布式计算 大数据 Hadoop
|
机器学习/深度学习 算法 大数据
下一篇
无影云桌面