官方博客-第7页-阿里云开发者社区

米基

2024-05-15

4083

大模型推理优化实践：KV cache复用与投机采样

在本文中，我们将详细介绍两种在业务中实践的优化策略：多轮对话间的 KV cache 复用技术和投机采样方法。我们会细致探讨这些策略的应用场景、框架实现，并分享一些实现时的关键技巧。

米基

4,083

赵世振

2024-08-22

1559

阿里云百炼应用实践系列-10分钟在企业微信中集成一个 AI 助手

在阿里云平台上，您只需十分钟，无需任何编码，即可在企业微信上为您的组织集成一个具备大模型能力的AI助手。此助手可24小时响应用户咨询，解答各类问题，尤其擅长处理私域问题，从而成为您企业的专属助手，有效提升用户体验及业务竞争力。

赵世振

1,559

ModelScope

2024-05-15

1423

元象大模型开源30款量化版本加速低成本部署丨附教程

元象大模型一次性发布30款量化版本，全开源，无条件免费商用。

ModelScope

1,423

赵世振

2025-01-08

1859

阿里云百炼xWaytoAGI共学课 DAY2 - 更好用的文本知识库应用跟学，快速上手阿里云百炼

本课程是阿里云百炼平台的第二天课程内容，旨在帮助用户了解如何通过阿里云百炼构建和发布自己的AI应用。介绍了如何利用大模型和智能体应用来创建具备强大语言理解和生成能力的AI助手，并通过不同的渠道（如网站、钉钉、微信公众号等）发布这些应用。

赵世振

1,859

德灵

2024-05-15

118254

阿里云PAI大模型RAG对话系统最佳实践

本文为大模型RAG对话系统最佳实践，旨在指引AI开发人员如何有效地结合LLM大语言模型的推理能力和外部知识库检索增强技术，从而显著提升对话系统的性能，使其能更加灵活地返回用户查询的内容。适用于问答、摘要生成和其他依赖外部知识的自然语言处理任务。通过该实践，您可以掌握构建一个大模型RAG对话系统的完整开发链路。

德灵

118,254

借势

337

代码采纳率如何提升至50%？AI 自动编写单元测试实践总结

借助Aone Copilot Agent，通过标准化Prompt指导AI生成单元测试代码，实现50%代码采纳率，显著提升测试效率与质量，推动团队智能化研发转型。

借势

337

山泽

2024-05-15

1721

从零构建现代深度学习框架(TinyDL-0.01)

本文主要以一个Java工程师视角，阐述如何从零(无任何二三方依赖)构建一个极简(麻雀虽小五脏俱全)现代深度学习框架（类比AI的操作系统）。

山泽

1,721

才胜南也

2024-09-05

1232

RAG效果优化：高质量文档解析详解

本文关于如何将非结构化数据（如PDF和Word文档）转换为结构化数据，以便于RAG（Retrieval-Augmented Generation）系统使用。

才胜南也

1,232

望宸

2025-02-20

910

大模型推理服务全景图

推理性能的提升涉及底层硬件、模型层，以及其他各个软件中间件层的相互协同，因此了解大模型技术架构的全局视角，有助于我们对推理性能的优化方案进行评估和选型。

望宸

910

官方博客-第7页-阿里云开发者社区

类目筛选

内容类型

大模型推理优化实践：KV cache复用与投机采样

阿里云百炼应用实践系列-10分钟在企业微信中集成一个 AI 助手

元象大模型开源30款量化版本加速低成本部署丨附教程

阿里云百炼xWaytoAGI共学课 DAY2 - 更好用的文本知识库应用跟学，快速上手阿里云百炼

阿里云PAI大模型RAG对话系统最佳实践

代码采纳率如何提升至50%？AI 自动编写单元测试实践总结

从零构建现代深度学习框架(TinyDL-0.01)

RAG效果优化：高质量文档解析详解

大模型推理服务全景图

官方博客-第7页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

大模型推理优化实践：KV cache复用与投机采样

阿里云百炼应用实践系列-10分钟在企业微信中集成一个 AI 助手

元象大模型开源30款量化版本 加速低成本部署丨附教程

阿里云百炼xWaytoAGI共学课 DAY2 - 更好用的文本知识库应用跟学，快速上手阿里云百炼

阿里云PAI大模型RAG对话系统最佳实践

代码采纳率如何提升至50%？AI 自动编写单元测试实践总结

从零构建现代深度学习框架(TinyDL-0.01)

RAG效果优化：高质量文档解析详解

大模型推理服务全景图

元象大模型开源30款量化版本加速低成本部署丨附教程