2022年开源大数据热力报告
《2022年开源大数据热力报告》,由开放原子开源基金会、X-lab开放实验室和阿里巴巴开源委员会联合出品。报告基于公开数据研究最活跃的102个开源大数据项目,探寻出开源大数据技术发展背后的“摩尔定律”。
阿里云云原生一体化数仓新能力解读
云原生一体化数仓是阿里云推出的一站式大数据处理平台,具备流批一体、实时离线一体、湖仓一体、 全链路数据治理四大核心能力。本书将分为离线实时一体、分析服务一体、湖仓一体、数据安全、数据建模、数据治理,六大热门主题,六位大数据专家,带你了解炙手可热的云数据产品最新演进趋势,为大数据开发者讲述一体化数仓的核心产品能力以及在业务中的应用。
Databricks数据洞察:从入门到实践
Delta Lake 作为数据湖核心存储引擎方案能给企业带来诸多的优势。本书从技术基础介绍到场景应用实践,从大数据平台架构的演进、Delta Lake关键特性、实现原理,以及数据仓库、数据湖的优劣势,湖仓一体架构的应用等多方面解析Lakehouse架构和Delta Lake的应用优势。帮助读者入门数据湖Lakehouse以及部分spark相关应用。
Flink CDC Meetup PPT - 龚中强
2022.5.21 Flink CDC Meetup|龚中强 - Flink CDC 在大健云仓的实践
阿里云 JindoFS+OSS 数据上云实战
为了帮助读者能更全面地了解 JindoFS,我们特地编撰了这本电子书。从架构到场景到实操,全方面解读jindoFS。
SaaS模式云原生数据仓库应用场景实践
MaxCompute 是阿里云推出的一款简单、易用、全托管的面向分析的企业级 Saas 模式云数据仓库,能够匹配业务发展进行灵活弹性扩展,面向云上开发者, MaxCompute 支持机器学习、数据湖、传统数仓、近实时数仓等多种业务分析场景,并 提供更开放的开发生态。
《“后红海”时代,独家揭秘当下大数据体系》
《“后红海”时代,独家揭秘当下大数据体系》从系统架构的角度,就大数据架构热点,每条技术线的发展脉络,以及技术趋势和未解问题等方面做一概述。特别的,大数据领域仍然处于发展期,部分技术收敛,但新方向和新领域层出不穷。本文内容和作者个人经历相关,是个人的视角,难免有缺失或者偏颇,同时限于篇幅,也很难全面。仅作抛砖引玉,希望和同业共同探讨。
阿里云实时计算Flink版解决方案白皮书-2021版
实时计算Flink版是阿里云基于 Apache Flink 构建的企业级、高性能实时大数据处理平台。为了帮助读者快速掌握实时计算Flink版,阿里云Apache Flink 创始团队特此推出本书。本书详细介绍了实时计算Flink版的产品结构、产品功能及优势。并以结合场景案例的方式在金融、电商、广告等九大行业的应用上给出相应的解决方案供读者学习,帮助读者在实践中学习使用阿里云实时计算 Flink 版。
实时数仓“王炸组合”实时计算Flink版+Hologres
精品的内容促使训练营非常受大家的欢迎,为满足大家求知学习的劲头,我们现将《实时数仓入门训练营》的课程内容全部整理了出来!汇编成《实时数仓“王炸组合”-实时计算Flink版+Hologres》的合集电子书!供各位小伙伴学习参考,免费下载!
《实时计算 Flink 版独家实战秘籍》
从结绳记事到量子计算,从飞鸽传书到万物互联,人类文明奔流不息,数字技术变革不止。如今,IT上云与业务互联网化已成必然态势。作为一线开发者,置身于数字化技术变革浪潮之中,如何保持自身核心竞争力,实现技术的积累、进阶与升级?实时计算 Flink 版独家实战秘籍,由阿里巴巴实时计算核心研发团队出品,技术大佬手把手教学,从基础场景解析到进阶任务迁移、demo实操等,9天帮您轻松Get企业级实时计算能力!
《实时数仓技术入门一本通》
云原生Hologres作为HSAP服务与分析一体化理念的最佳实践,到底有哪些核心技术优势?Hologres实时数仓原理是什么?又有哪些常见的写入场景?针对传统数据库痛点, Hologres 落地具体业务场景的最佳实践又是什么样的呢?这些问题都可以在本书找到答案!本书通过详细的图文介绍,指导读者搞定融合实时数仓&报表、数据仓库、传统OLAP迁移等10+个实战场景,助力实现服务和分析一体化实时数仓。
《SaaS模式云数据仓库实践手册》
本书的制作目的在于让MaxCompute帮助企业构建全托管的现代化数仓,简化数据洞察、加速价值实现。
中国开发者调查报告
为了了解Elasticsearch 中国开发者群体,结合1186位开发者的调研数据和18位社区专家的深度访谈,Elastic 技术社区、阿里巴巴 Elasticsearch 技术团队和阿里云开发者社区联合发布了《Elasticsearch 中国开发者调查报告》。免费下载,抢先一步读懂这个“族群”吧。
Paimon ✖️ StarRocks,共话实时湖仓架构
8月3日 Streaming Lakehouse Meetup · Online 邀请到了 Apache Paimon PMC ,阿里云,饿了么,喜马拉雅,同程旅行等众多业内大咖,为大家分享 Apache Paimon + StarRocks 在各场景中的最佳实践、生产经验和技术原理。
基于 Flink SQL + Paimon 构建流式湖仓新方
《基于 Flink SQL + Paimon 构建流式湖仓新方》展示了如何构建新一代流式湖仓体系,以满足低延迟、高并发、强一致性的实时数据分析需求,为数据驱动的决策制定提供强有力的支持。
MaxCompute半结构化数据思考与创新
《MaxCompute半结构化数据思考与创新》介绍了半结构化数据模型简析,与传统方案优劣对,MaxCompute思考与实践,以及收益分析。
PAI-Megatron-Patch:灵骏集群训练 LLMs
本书深入探讨了如何利用PAI平台提供的高性能计算资源和优化工具来训练大型语言模型,特别是在分布式集群环境下的高效训练方法。
中国零售行业数智化成熟度白皮书
基于零售企业数智化成熟度模型,瓴羊联动IDC对300+企业进行数智化调研,深入了解企业目前的数据管理状况,将核心结论集结成册,形成中国零售行业数智化成熟度白皮书 《以数智化引擎促增长,探索零售发展新机遇》。 企业数智化成熟度测评:https://home.lydaas.com/model
Elastic与阿里云合作宣传信息白皮书
阿里云是 Elastic 在中国最早开展合作的伙伴,长期的合作积淀了深厚的技术实践和丰富的业务经验,本白皮书介绍了自合作以来阿里云和Elastic的联合价值主张、产品功能与优势、客户案例等。
大数据与机器学习
大数据领域前沿技术分享与交流,这里不止有技术干货、学习心得、企业实践、社区活动,还有未来。