官方博客-第22页-阿里云开发者社区

阿里云云原生

2025-06-30

543

基于 AI 网关和 llmaz，提升 vLLM 推理服务可用性和部署易用性的实践

本文介绍了如何使用 llmaz 快速部署基于 vLLM 的大语言模型推理服务，并结合 Higress AI 网关实现流量控制、可观测性、故障转移等能力，构建稳定、高可用的大模型服务平台。

阿里云云原生

543

ModelScope

2024-05-15

1100

Modelscope结合α-UMi：基于Modelscope的多模型协作Agent

基于单个开源小模型的工具调用Agent，由于模型容量和预训练能力获取的限制，无法在推理和规划、工具调用、回复生成等任务上同时获得比肩大模型等性能。

ModelScope

1,100

ModelScope

2024-05-15

110155

FunASR 语音大模型在 Arm Neoverse 平台上的优化实践

Arm 架构的服务器通常具备低功耗的特性，能带来更优异的能效比。相比于传统的 x86 架构服务器，Arm 服务器在相同功耗下能够提供更高的性能。这对于大模型推理任务来说尤为重要，因为大模型通常需要大量的计算资源，而能效比高的 Arm 架构服务器可以提供更好的性能和效率。

ModelScope

110,155

牛俊

2024-08-15

11829

动手实践：高效构建企业级AI搜索

本文介绍了基于阿里云 Elasticsearch的AI搜索产品能力、业务价值、场景应用，以及搭建演示等。

牛俊

11,829

阿里云云原生

2024-09-14

567

用 Rust 实现敏感信息拦截插件，提升 AI 网关安全防护能力

本⽂对敏感信息拦截插件的使用方式和实现原理进行了简单介绍，它能够自动检测并处理请求和响应中的敏感词，有效防止敏感信息泄露。通过对不同数据范围的支持和灵活的配置选项，该插件能够适应各种应用场景，确保数据的安全性和合规性。

阿里云云原生

567

李德

2025-04-03

484

结合多模态RAG和异步调用实现大模型内容

文章探讨了如何利用多模态大模型和工程优化手段提升物流理赔业务效率。核心方案包括：通过多模态RAG技术实现图片查重，结合异步调用方法优化货损识别功能。

李德

484

阿里云云原生

2025-05-16

770

日志采集 Agent 性能大比拼——LoongCollector 性能深度测评

为了展现 LoongCollector 的卓越性能，本文通过纵向（LoongCollector 与 iLogtail 产品升级对比）和横向（LoongCollector 与其他开源日志采集 Agent 对比）两方面对比，深度测评不同采集 Agent 在常见的日志采集场景下的性能。

阿里云云原生

770

阿里云大数据Al技术

2024-08-09

9255

基于RAG搭建企业级知识库在线问答

本文介绍如何使用搜索开发工作台快速搭建基于RAG开发链路的知识库问答应用。

阿里云大数据Al技术

9,255

百潼

2024-08-12

8185

敦煌智旅：Serverless 初探，运维提效 60%

SAE 提供了一个开箱即用的 Serverless PaaS 平台，提供了微服务、监控等能力，帮助敦煌智旅很好地解决了发版困难、运维困难、弹性能力不足和资源利用率低等痛点问题。成功实现轻松应对 10 倍突增流量洪峰，运维效率大幅提升。

百潼

8,185

官方博客-第22页-阿里云开发者社区

类目筛选

内容类型

基于 AI 网关和 llmaz，提升 vLLM 推理服务可用性和部署易用性的实践

Modelscope结合α-UMi：基于Modelscope的多模型协作Agent

FunASR 语音大模型在 Arm Neoverse 平台上的优化实践

动手实践：高效构建企业级AI搜索

用 Rust 实现敏感信息拦截插件，提升 AI 网关安全防护能力

结合多模态RAG和异步调用实现大模型内容

日志采集 Agent 性能大比拼——LoongCollector 性能深度测评

基于RAG搭建企业级知识库在线问答

敦煌智旅：Serverless 初探，运维提效 60%

官方博客-第22页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

基于 AI 网关和 llmaz，提升 vLLM 推理服务可用性和部署易用性的实践

Modelscope结合α-UMi：基于Modelscope的多模型协作Agent

FunASR 语音大模型在 Arm Neoverse 平台上的优化实践

动手实践：高效构建企业级AI搜索

用 Rust 实现敏感信息拦截插件，提升 AI 网关安全防护能力

结合多模态RAG和异步调用实现大模型内容

日志采集 Agent 性能大比拼——LoongCollector 性能深度测评

基于RAG搭建企业级知识库在线问答

敦煌智旅：Serverless 初探，运维提效 60%