官方博客-第51页-阿里云开发者社区

  • 170

    DMS Airflow:企业级数据工作流编排平台的专业实践

    DMS Airflow是基于Apache Airflow构建的企业级数据工作流编排平台,深度集成阿里云DMS系统,提供统一认证、智能调度、多任务类型支持及企业级监控能力,助力数据团队高效管理ETL、分析、机器学习等复杂工作流。

    170
  • 2024-05-15
    672

    DNS解析异常监控

    本文将介绍如何使用“网络分析与监控”产品的“站点监控”功能,监控国内各省份三大运营商的用户和云上的应用服务访问您的域名能否正常解析。

  • 2024-05-15
    806

    链路追踪(Tracing)其实很简单——链路成本进阶指南

    广义上的链路成本,既包含使用链路追踪产生的数据生成、采集、计算、存储、查询等额外资源开销,也包含链路系统接入、变更、维护、协作等人力运维成本。为了便于理解,本小节将聚焦在狭义上的链路追踪机器资源成本,人力成本将在下一小节(效率)进行介绍。

    806
  • 2024-05-15
    495

    OpenSergo/MSE & CloudWeGo 共同保障微服务运行时流量稳定性

    微服务运行时稳定性的问题微服务的稳定性一直是开发者非常关注的话题。随着业务从单体架构向分布式架构演进以及部署方式的变化,服务之间的依赖关系变得越来越复杂,业务系统也面临着巨大的高可用挑战。大家可能都经历过以下的场景:演唱会抢票瞬间洪峰流量导致系统超出最大负载,load 飙高,用户无法正常下单;在线选...

  • 【深度】企业 AI 落地实践(四):如何构建端到端的 AI 应用观测体系

    本文探讨了AI应用在实际落地过程中面临的三大核心问题:如何高效使用AI模型、控制成本以及保障输出质量。文章详细分析了AI应用的典型架构,并提出通过全栈可观测体系实现从用户端到模型推理层的端到端监控与诊断。结合阿里云的实践经验,介绍了基于OpenTelemetry的Trace全链路追踪、关键性能指标(如TTFT、TPOT)采集、模型质量评估与MCP工具调用观测等技术手段,帮助企业在生产环境中实现AI应用的稳定、高效运行。同时,针对Dify等低代码平台的应用部署与优化提供了具体建议,助力企业构建可扩展、可观测的AI应用体系。

  • 2024-05-15
    617

    基于 OPLG 从 0 到 1 构建统一可观测平台实践

    “可观测”是近几年比较火的一个议题,而 OPLG 就是包含了 OpenTelemetry、Prometheus、Loki 和 Grafana 在内的开源可观测技术合集,它们之间将碰撞出什么样的火花?请阅读本文介绍的基于 OPLG 从 0 到 1 构建统一可观测平台实践。

    617
  • 2024-05-15
    456

    日志审计:多账号下VPC流日志采集与监控方案

    本文主要介绍如何基于日志审计进行跨账号的VPC流日志采集与监控。

    456
  • 2024-05-15
    408

    基于EventBridge HTTP Source构建SaaS应用集成的最佳实践

    本文将介绍基于EventBridge HTTP Source构建SaaS应用集成的最佳实践。

    408
  • 1
    ...
    48
    49
    50
    51
    52
    到第