从知识库问答到企业系统集成:智能体接入客户域名的工程化实践

简介: 如何让用户通过客户自己的域名访问智能体?如何让智能体读取或操作客户内部系统?

客户在体验完智能体原型后,通常会提出一个非常具体的问题:

“这个助手能不能直接放到我们的官网和业务系统里?”

从工程角度看,这不是简单的页面嵌入问题,而是一个从“智能体能力”走向“业务服务”的过程。

本文以 Haoee 上搭建的“培训机构课程问答”演示案例为例,说明如何设计客户域名接入、后端代理、身份隔离和业务系统集成。

ScreenShot_2026-07-28_112957_922.png

1. 先确定接入目标

“放到客户系统里”至少有三种含义。

1. 页面接入

用户从客户官网进入智能体,使用课程问答能力。

2. 服务接入

客户自己的前端调用后端接口,由后端转发至智能体服务。

3. 工具接入

智能体需要调用客户的教务、CRM、订单或排课系统。

这三种方式的复杂度逐步增加,不能用同一套交付口径处理。

2. 演示案例的当前状态

“培训机构课程问答”使用一份虚构 FAQ,内容包括:

  • 办公自动化课程;
  • 短视频运营课程;
  • 课程适合人群;
  • 演示时间;
  • 报名流程;
  • 价格、名额、证书和就业的边界说明。

当前配置为:

开始节点
   |
课程 FAQ 问答节点

知识库文档导入后解析为 5 个文本分片,智能体使用 deepseek-v4-pro,问答节点设置了低随机性和节点级评估。

1bdfdd09-7972-410f-b2af-62740fd40167.png

测试结果:

  • 可以回答课程内容;
  • 可以回答课程适合人群;
  • 可以说明演示报名流程;
  • 对价格和剩余名额不做虚构;
  • 对就业结果不做承诺;
  • 最终报名确认转人工处理。

该版本的目标是验证知识问答链路,并不声称已经完成教务系统集成。

3. 推荐的服务架构

正式接入时,建议不要让浏览器直接调用平台对话服务,而是采用后端代理:

Browser
   |
Customer Frontend
   |
Customer Backend / API Gateway
   |
Haoee Published Agent
   |
Knowledge Base / Model / Skills / MCP

客户前端调用自己的后端接口:

POST /api/ai/course-chat

后端完成以下工作:

  • 校验用户登录态;
  • 生成内部会话 ID;
  • 限制问题长度;
  • 判断用户是否具备访问权限;
  • 调用已发布智能体;
  • 将流式结果转发给前端;
  • 保存必要的业务日志。

这样可以避免将发布密钥暴露在浏览器中。

4. 会话隔离怎么设计?

如果客户拥有官网、员工工作台和小程序三个入口,建议给每个入口分配不同的应用标识:

appId = course-web
appId = course-workbench
appId = course-miniapp

同时绑定外部用户标识:

externalUserId = user-001

需要注意,外部用户标识和平台鉴权凭据不是同一个概念。

多客户交付时,还应保证:

  • 客户 A 的课程资料不能被客户 B 检索;
  • 客户 A 的对话记忆不能被客户 B 读取;
  • 管理员、课程顾问和普通访客权限不同;
  • 知识库更新具有版本记录;
  • 关键操作可以追溯。

5. 从问答到工具调用

课程介绍属于知识库问答,但实时名额属于业务数据查询。

推荐先设计只读接口:

{
  "success": true,
  "courseId": "course-001",
  "classTime": "周二、周四 19:30-21:00",
  "available": true,
  "sourceTime": "2026-07-28 10:00:00"
}

智能体负责理解用户问题和组织回答,业务系统负责返回事实数据。

如果使用 MCP Server 或 Skills,工具定义至少应包含:

  • 工具名称;
  • 输入参数;
  • 返回字段;
  • 权限要求;
  • 超时限制;
  • 失败返回;
  • 版本号。

例如,当教务系统暂时不可用时,工具应返回明确错误,而不是让模型使用旧资料猜测名额。

6. 写操作必须设计确认链路

自动报名不是一个简单的工具调用。

推荐流程:

识别课程和班次
    |
提取姓名、电话等字段
    |
校验完整性
    |
展示报名摘要
    |
用户明确确认
    |
调用报名接口
    |
记录请求和结果
    |
返回最终状态

写入接口还需要处理:

  • 重复提交;
  • 并发占位;
  • 接口超时;
  • 写入成功但响应失败;
  • 用户取消;
  • 人工补录。

价格、退款、优惠、资格判断等内容,必须根据客户业务规则增加权限和人工审核。

7. 域名接入的选择

自建前端

客户自己开发页面,后端代理调用智能体。这是正式项目中最容易控制的方式。

嵌入页面

如果平台提供正式嵌入组件,可以快速上线。但要确认跨域、登录态、移动端适配和版本兼容,不建议直接把内部工作台地址作为长期方案。

API Gateway 统一代理

客户已有统一网关时,可以将域名、认证、限流、日志和后端代理集中管理。

无论采用哪种方式,都不建议让前端持有长期密钥。

8. 什么时候要进入私有化方案?

客户使用自有域名,并不等于智能体必须部署在客户内网。

只有当客户要求:

  • 数据不出域;
  • 私有部署;
  • 内网系统接入;
  • 权限审计;
  • 机构级模型治理;

才需要进一步评估 AI 服务要素平台 / AI 中台。

其基础结构可以理解为:

应用层
  |
AI 服务要素层
  |
可选算力资源层

AI 服务要素层包括模型、智能体、数据与能力资产。知识库、Skills、MCP Server 和上下文记忆应纳入统一治理,算力资源层则根据部署条件决定是否建设。

9. 建议的实施顺序

第一阶段:知识库问答
第二阶段:接入客户自有域名
第三阶段:客户后端代理和身份隔离
第四阶段:接入只读业务数据
第五阶段:评估报名、CRM 等写入能力
第六阶段:补充权限、审计和运维体系

这种方式能够把页面展示、知识问答和业务系统集成分开管理,降低项目初期风险,也方便客户逐阶段验收。

相关文章
|
17天前
|
人工智能 边缘计算 自然语言处理
ModelScope介绍:魔搭社区是什么?在魔搭社区能做哪些事?
阿里云ModelScope(魔搭社区)是开源模型即服务(MaaS)平台,提供超5万个AI模型,支持免费下载、一键预测、微调定制、边缘部署及向量检索。覆盖NLP、CV、语音、多模态等领域,服务超1400万开发者。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens
483 2
|
22天前
|
机器学习/深度学习 JSON 安全
从零搓一个语言模型,然后把它变成认知体的声带
这是一个“反着来”的硬核项目:不调包、不微调、不套壳,从张量运算手搓197万参数的轻量语言模型(62MB/73文件),专为认知体设计为“声带”——仅负责流畅表达,不替代意识与记忆。内置三层漏斗架构+34个JSON回路专家(MoE路由),OpenAI兼容接口,真正实现小模型与大模型的智能分工。(239字)
|
29天前
|
人工智能 运维 监控
AI Agent开发平台的技术架构探索与功能设计
2026年,企业级AI Agent市场规模预计达449亿元,但仍有60%的企业停留在试点阶段——规模化落地的核心障碍并非模型能力,而是可观测性、管控粒度与层级治理的缺失。 本文从技术架构视角出发,对比分析了Dify、Coze、LangChain及主流云厂商平台在监控深度、管控粒度、编排耦合、层级抽象和声明式管理五个维度的共性不足。 在此基础上,我们提出并实践了一套七层递进式治理架构(工具库→Skill→工作流→Agent→编排→项目→安全策略),实现了六层穿透式监控能力——成本可从项目逐级下钻到单次工具调用,解决了“钱花在哪、谁花的、值不值”的核心问题。同时支持可视化拖拽与声明式YAML双
304 1
|
4天前
从一个智能体到多个客户副本:模板复制的工程化方法
智能体项目一旦进入交付阶段,问题会从“能不能搭出来”转向“能不能稳定交付给多个客户”。
|
5天前
|
机器学习/深度学习 缓存 人工智能
月之暗面 Kimi K3 接入百炼平台:100 万 Token 长文本,缓存仅 2 元 / 百万输入
全球首个开源3万亿级大模型Kimi K3(2.8万亿参数)正式上线阿里云百炼平台,支持100万Token超长上下文、原生视觉理解与深度推理。文本生成、多模态分析、复杂逻辑任务表现卓越,输入20元/百万Token(缓存命中仅2元),面向长程编程、知识工作等高阶场景。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens
|
6天前
|
SQL 数据采集 人工智能
数据治理工具哪家好?2026年使用体验测评
历时3个月选型调研、2轮POC实测、6个月生产环境深度使用,我最终将企业数据治理的"底座"交给了瓴羊Dataphin。它不是功能最多的,但它是唯一一个让我觉得"方法论真正跑通了"的产品——阿里巴巴十余年OneData体系沉淀、EB级数据实战验证、2026年业内首发的数据资产智能体DataAgent,三者叠加后产生的治理效果,远超我此前用过的任何拼凑方案。以下是完整真实记录。
|
7天前
|
数据采集 运维 Java
高并发爬虫代理IP怎么配置?从接入到调优的完整流程
本文详解高并发代理配置的完整实践:从短效/隧道代理选型决策,到接入、调参、调优、验证四阶段实操,涵盖IP池管理、连接复用、请求头随机化等关键技巧,并提供可直接运行的Python代码示例,助你稳定高效突破反爬限制。
74 1
|
7天前
|
传感器 安全 数据可视化
沉浸式学习革命:VR虚拟培训让新员工上手速度提升3倍
随着工业4.0和数字化转型的深入,企业对技能型人才的需求日益增长。传统的新员工培训模式往往面临周期长、成本高、风险大以及实操机会稀缺等痛点。基于云计算、虚拟现实(VR)及增强现实(AR)技术的沉浸式培训方案,正在重塑企业的人才培养体系。通过构建高保真的数字孪生环境与实时交互系统,该方案不仅显著缩短了学习曲线,更实现了从“被动听讲”到“主动探索”的根本性转变。
|
13天前
|
数据采集 运维 数据可视化
AR数字孪生:让工厂设备“开口说话”的维修革命
在工业4.0与智能制造深入发展的背景下,传统制造业正面临从“被动响应”向“主动预测”转型的关键节点。物理世界与数字世界的边界日益模糊,增强现实(AR)技术与数字孪生(Digital Twin)的深度融合,正在重构工业运维的逻辑。这种融合不仅实现了设备状态的可视化映射,更通过实时数据流与交互界面,赋予了静止的工业设备以“表达能力”,从而引发了一场深刻的维修与管理革命。

热门文章

最新文章