官方博客-第7页-阿里云开发者社区

米基

2024-05-15

4085

大模型推理优化实践：KV cache复用与投机采样

在本文中，我们将详细介绍两种在业务中实践的优化策略：多轮对话间的 KV cache 复用技术和投机采样方法。我们会细致探讨这些策略的应用场景、框架实现，并分享一些实现时的关键技巧。

米基

4,085

望雲十雨言澈

2025-04-10

789

AI Infra之模型显存管理分析

本文围绕某线上客户部署DeepSeek-R1满血版模型时进行多次压测后，发现显存占用一直上升，从未下降的现象，记录了排查过程。

望雲十雨言澈等

789

峯华

2025-07-22

1260

轻松搭建AI知识问答系统，阿里云PolarDB MCP深度实践

无论是PolarDB MySQL兼容MySQL语法的SQL执行功能，还是其特有的OLAP分析与AI能力，通过MCP协议向LLM开放接口后，显著降低了用户使用门槛，更为未来基于DB-Agent的智能体开发奠定了技术基础

峯华

1,260

夏冬

2025-04-01

3654

RAG 调优指南：Spring AI Alibaba 模块化 RAG 原理与使用

通过遵循以上最佳实践，可以构建一个高效、可靠的 RAG 系统，为用户提供准确和专业的回答。这些实践涵盖了从文档处理到系统配置的各个方面，能够帮助开发者构建更好的 RAG 应用。

夏冬

3,654

施晨尹丰彬筱文李林杨黄俊等

2023-11-07

43913

基于阿里云PAI平台搭建知识库检索增强的大模型对话系统

基于原始的阿里云计算平台产技文档，搭建一套基于大模型检索增强答疑机器人。本方案已在阿里云线上多个场景落地，将覆盖阿里云官方答疑群聊、研发答疑机器人、钉钉技术服务助手等。线上工单拦截率提升10+%，答疑采纳率70+%，显著提升答疑效率。

施晨尹丰彬筱文李林杨黄俊等

43,913

君启

2024-11-29

1622

性能提升利器｜PolarDB- X 超详细列存查询技术解读

本文将深入探讨 PolarDB-X 列存查询引擎的分层缓存解决方案，以及其在优化 ORC 列存查询性能中的关键作用。

君启

1,622

德灵

2024-05-15

118256

阿里云PAI大模型RAG对话系统最佳实践

本文为大模型RAG对话系统最佳实践，旨在指引AI开发人员如何有效地结合LLM大语言模型的推理能力和外部知识库检索增强技术，从而显著提升对话系统的性能，使其能更加灵活地返回用户查询的内容。适用于问答、摘要生成和其他依赖外部知识的自然语言处理任务。通过该实践，您可以掌握构建一个大模型RAG对话系统的完整开发链路。

德灵

118,256

思勉宙游

2024-05-24

63069

ClickHouse物化视图里常见的7个坑，点进看避坑指南

一文解析ClickHouse物化视图

思勉宙游

63,069

赵世振

2024-08-22

1559

阿里云百炼应用实践系列-10分钟在企业微信中集成一个 AI 助手

在阿里云平台上，您只需十分钟，无需任何编码，即可在企业微信上为您的组织集成一个具备大模型能力的AI助手。此助手可24小时响应用户咨询，解答各类问题，尤其擅长处理私域问题，从而成为您企业的专属助手，有效提升用户体验及业务竞争力。

赵世振

1,559

官方博客-第7页-阿里云开发者社区

类目筛选

内容类型

大模型推理优化实践：KV cache复用与投机采样

AI Infra之模型显存管理分析

轻松搭建AI知识问答系统，阿里云PolarDB MCP深度实践

RAG 调优指南：Spring AI Alibaba 模块化 RAG 原理与使用

基于阿里云PAI平台搭建知识库检索增强的大模型对话系统

性能提升利器｜PolarDB- X 超详细列存查询技术解读

阿里云PAI大模型RAG对话系统最佳实践

ClickHouse物化视图里常见的7个坑，点进看避坑指南

阿里云百炼应用实践系列-10分钟在企业微信中集成一个 AI 助手

官方博客-第7页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

大模型推理优化实践：KV cache复用与投机采样

AI Infra之模型显存管理分析

轻松搭建AI知识问答系统，阿里云PolarDB MCP深度实践

RAG 调优指南：Spring AI Alibaba 模块化 RAG 原理与使用

基于阿里云PAI平台搭建知识库检索增强的大模型对话系统

性能提升利器｜PolarDB- X 超详细列存查询技术解读

阿里云PAI大模型RAG对话系统最佳实践

ClickHouse物化视图里常见的7个坑，点进看避坑指南

阿里云百炼应用实践系列-10分钟在企业微信中集成一个 AI 助手