官方博客-第8页-阿里云开发者社区

山泽

2024-05-15

1721

从零构建现代深度学习框架(TinyDL-0.01)

本文主要以一个Java工程师视角，阐述如何从零(无任何二三方依赖)构建一个极简(麻雀虽小五脏俱全)现代深度学习框架（类比AI的操作系统）。

山泽

1,721

才胜南也

2024-09-05

1232

RAG效果优化：高质量文档解析详解

本文关于如何将非结构化数据（如PDF和Word文档）转换为结构化数据，以便于RAG（Retrieval-Augmented Generation）系统使用。

才胜南也

1,232

望宸

2025-02-20

910

大模型推理服务全景图

推理性能的提升涉及底层硬件、模型层，以及其他各个软件中间件层的相互协同，因此了解大模型技术架构的全局视角，有助于我们对推理性能的优化方案进行评估和选型。

望宸

910

辰马

2025-05-08

2033

深度解析Agent实现，定制自己的Manus

文章结合了理论分析与实践案例，旨在帮助读者系统地认识AI Agent的核心要素、设计模式以及未来发展方向。

辰马

2,033

子潍

2025-05-22

1724

本文介绍了通过MCP（Model Context Protocol）结合通义千问大模型实现跨平台、跨服务的自动化任务处理方案。使用Qwen3-235B-A22B模型，配合ComfyUI生成图像，并通过小红书等社交媒体发布内容，展示了如何打破AI云服务的数据孤岛。具体实践包括接入FileSystem、ComfyUI和第三方媒体Server，完成从本地文件读取到生成图像再到发布的全流程。方案优势在于高可扩展性和易用性，但也存在大模型智能化不足、MCP Server开发难度较大及安全风险等问题。未来需进一步提升模型能力、丰富应用场景并解决安全挑战，推动MCP在更多领域落地。

子潍

1,724

新念

2025-02-14

1605

DeepSeek-V3 高效训练关键技术分析

本文从模型架构、并行策略、通信优化和显存优化四个方面展开，深入分析了DeepSeek-V3高效训练的关键技术，探讨其如何以仅5%的算力实现对标GPT-4o的性能。

新念

1,605

砚染

2024-09-03

1842

速成RAG+Agent框架大模型应用搭建

本文侧重于能力总结和实操搭建部分，从大模型应用的多个原子能力实现出发，到最终串联搭建一个RAG+Agent架构的大模型应用。

砚染

1,842

澄潭计缘望宸

2025-03-14

1203

大模型无缝切换，QwQ-32B和DeepSeek-R1 全都要

通义千问最新推出的QwQ-32B推理模型，拥有320亿参数，性能媲美DeepSeek-R1（6710亿参数）。QwQ-32B支持在小型移动设备上本地运行，并可将企业大模型API调用成本降低90%以上。本文介绍了如何通过Higress AI网关实现DeepSeek-R1与QwQ-32B之间的无缝切换，涵盖环境准备、模型接入配置及客户端调用示例等内容。此外，还详细探讨了Higress AI网关的多模型服务、消费者鉴权、模型自动切换等高级功能，帮助企业解决TPS与成本平衡、内容安全合规等问题，提升大模型应用的稳定性和效率。

澄潭计缘望宸等

1,203

怀潜

2023-05-10

3203

Hologres+大模型初探，让ChatGPT回答商家问题

本文介绍基于Hologres+ChatGPT提供智能客服服务的实践。

怀潜

3,203

官方博客-第8页-阿里云开发者社区

类目筛选

内容类型

从零构建现代深度学习框架(TinyDL-0.01)

RAG效果优化：高质量文档解析详解

大模型推理服务全景图

深度解析Agent实现，定制自己的Manus

自媒体创作场景实践｜通义千问3 + MCP=一切皆有可能

DeepSeek-V3 高效训练关键技术分析

速成RAG+Agent框架大模型应用搭建

大模型无缝切换，QwQ-32B和DeepSeek-R1 全都要

Hologres+大模型初探，让ChatGPT回答商家问题

官方博客-第8页-阿里云开发者社区

探索云世界

热门

云计算

大数据

云原生

人工智能

数据库

开发与运维

活动广场

任务中心

训练营

直播

乘风者计划

下载

镜像站

技术资料

类目筛选

内容类型

从零构建现代深度学习框架(TinyDL-0.01)

RAG效果优化：高质量文档解析详解

大模型推理服务全景图

深度解析Agent实现，定制自己的Manus

自媒体创作场景实践｜通义千问3 + MCP=一切皆有可能

DeepSeek-V3 高效训练关键技术分析

速成RAG+Agent框架大模型应用搭建

大模型无缝切换，QwQ-32B和DeepSeek-R1 全都要

Hologres+大模型初探，让ChatGPT回答商家问题