官方博客-第7页-阿里云开发者社区

望宸

2025-02-20

932

大模型推理服务全景图

推理性能的提升涉及底层硬件、模型层，以及其他各个软件中间件层的相互协同，因此了解大模型技术架构的全局视角，有助于我们对推理性能的优化方案进行评估和选型。

望宸

932

辰马

2025-05-08

2057

深度解析Agent实现，定制自己的Manus

文章结合了理论分析与实践案例，旨在帮助读者系统地认识AI Agent的核心要素、设计模式以及未来发展方向。

辰马

2,057

施晨尹丰彬筱文李林杨黄俊等

2023-11-07

43929

基于阿里云PAI平台搭建知识库检索增强的大模型对话系统

基于原始的阿里云计算平台产技文档，搭建一套基于大模型检索增强答疑机器人。本方案已在阿里云线上多个场景落地，将覆盖阿里云官方答疑群聊、研发答疑机器人、钉钉技术服务助手等。线上工单拦截率提升10+%，答疑采纳率70+%，显著提升答疑效率。

施晨尹丰彬筱文李林杨黄俊等

43,929

耘越

2024-10-29

1690

AI 辅助编程的效果衡量

本文主要介绍了如何度量研发效能，以及 AI 辅助编程是如何影响效能的，进而阐述如何衡量 AI 辅助编程带来的收益。

耘越

1,690

赵世振

2024-12-24

1639

探索大型语言模型LLM推理全阶段的JSON格式输出限制方法

本篇文章详细讨论了如何确保大型语言模型（LLMs）输出结构化的JSON格式，这对于提高数据处理的自动化程度和系统的互操作性至关重要。

赵世振

1,639

赵世振

2024-08-22

1572

阿里云百炼应用实践系列-10分钟在企业微信中集成一个 AI 助手

在阿里云平台上，您只需十分钟，无需任何编码，即可在企业微信上为您的组织集成一个具备大模型能力的AI助手。此助手可24小时响应用户咨询，解答各类问题，尤其擅长处理私域问题，从而成为您企业的专属助手，有效提升用户体验及业务竞争力。

赵世振

1,572

李德

2024-12-06

1530

【阅读十分钟，百分百成功】——通过大模型实现对客服回答的质量评估

本文章基于业务实践，总结有关客服质检场景的解决方案和处理经验，为相似场景提供可行的借鉴方法。

李德

1,530

澄潭计缘望宸

2025-03-14

1220

大模型无缝切换，QwQ-32B和DeepSeek-R1 全都要

通义千问最新推出的QwQ-32B推理模型，拥有320亿参数，性能媲美DeepSeek-R1（6710亿参数）。QwQ-32B支持在小型移动设备上本地运行，并可将企业大模型API调用成本降低90%以上。本文介绍了如何通过Higress AI网关实现DeepSeek-R1与QwQ-32B之间的无缝切换，涵盖环境准备、模型接入配置及客户端调用示例等内容。此外，还详细探讨了Higress AI网关的多模型服务、消费者鉴权、模型自动切换等高级功能，帮助企业解决TPS与成本平衡、内容安全合规等问题，提升大模型应用的稳定性和效率。

澄潭计缘望宸等

1,220

阿里云云原生

2025-08-05

1331

如何实现 AI Agent 自主发现和使用 MCP 服务 —— Nacos MCP Router 部署最佳实践

Nacos社区推出MCP Router与MCP Registry开源解决方案，助力AI Agent高效调用外部工具。Router可智能筛选匹配的MCP Server，减少Token消耗，提升安全性与部署效率。结合Nacos Registry实现服务自动发现与管理，简化AI Agent集成复杂度。支持协议转换与容器化部署，保障服务隔离与数据安全。提供智能路由与代理模式，优化工具调用性能，助力MCP生态普及。

阿里云云原生

1,331

官方博客-第7页-阿里云开发者社区

类目筛选

内容类型

大模型推理服务全景图

深度解析Agent实现，定制自己的Manus

基于阿里云PAI平台搭建知识库检索增强的大模型对话系统

AI 辅助编程的效果衡量

探索大型语言模型LLM推理全阶段的JSON格式输出限制方法

阿里云百炼应用实践系列-10分钟在企业微信中集成一个 AI 助手

【阅读十分钟，百分百成功】——通过大模型实现对客服回答的质量评估

大模型无缝切换，QwQ-32B和DeepSeek-R1 全都要

如何实现 AI Agent 自主发现和使用 MCP 服务 —— Nacos MCP Router 部署最佳实践

官方博客-第7页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

大模型推理服务全景图

深度解析Agent实现，定制自己的Manus

基于阿里云PAI平台搭建知识库检索增强的大模型对话系统

AI 辅助编程的效果衡量

探索大型语言模型LLM推理全阶段的JSON格式输出限制方法

阿里云百炼应用实践系列-10分钟在企业微信中集成一个 AI 助手

【阅读十分钟，百分百成功】——通过大模型实现对客服回答的质量评估

大模型无缝切换，QwQ-32B和DeepSeek-R1 全都要

如何实现 AI Agent 自主发现和使用 MCP 服务 —— Nacos MCP Router 部署最佳实践