开发者社区 > PolarDB开源 > PolarDB 分布式版 > 正文

什么是数据分析步骤中的处理数据?

已解决

什么是数据分析步骤中的处理数据?

展开
收起
云上静思 2022-10-18 15:21:41 723 0
1 条回答
写回答
取消 提交回答
  • 推荐回答

    处理数据的意思就是提取特征数据。在真实的工作场景中,除了数据格式不统一,数据的内容往往也参差不齐,很少能直接拿到 一份干净又完整的数据。比如有些样本数据会缺失部分特征、有些数据是明显的异常数据。

    所以在开始分析之前,还需要 对数据做进一步的处理,比如用默认值填充缺失的值、过滤掉明显重复的或者异常的数据,这个步骤一般也叫“特征工 程”,需要耗费比较长的时间才能把数据整理好。

    以上内容摘自《PolarDB for PostgreSQL 源码与应用实战》电子书,点击https://developer.aliyun.com/ebook/download/7773可下载完整版

    2022-10-18 16:26:11
    赞同 展开评论 打赏

PolarDB 分布式版 (PolarDB for Xscale,简称“PolarDB-X”) 是阿里云自主设计研发的高性能云原生分布式数据库产品,为用户提供高吞吐、大存储、低延时、易扩展和超高可用的云时代数据库服务。

相关电子书

更多
Python第四讲——使用IPython/Jupyter Notebook与日志服务玩转超大规模数据分析与可视化 立即下载
互联网下半场的角逐,玩转轻资产的大数据服务—图(关系网络)数据分析与阿里应用 立即下载
如何使用大数据计算服务 MaxCompute进行数据分析 立即下载