惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

T
Tor Project blog
博客园 - 聂微东
Microsoft Azure Blog
Microsoft Azure Blog
博客园 - 【当耐特】
G
Google Developers Blog
J
Java Code Geeks
The Cloudflare Blog
Attack and Defense Labs
Attack and Defense Labs
宝玉的分享
宝玉的分享
Last Week in AI
Last Week in AI
Cisco Talos Blog
Cisco Talos Blog
酷 壳 – CoolShell
酷 壳 – CoolShell
I
Intezer
Jina AI
Jina AI
T
Tenable Blog
P
Palo Alto Networks Blog
Project Zero
Project Zero
D
DataBreaches.Net
Hugging Face - Blog
Hugging Face - Blog
The Hacker News
The Hacker News
F
Full Disclosure
Cloudbric
Cloudbric
量子位
H
Heimdal Security Blog
K
Kaspersky official blog
有赞技术团队
有赞技术团队
罗磊的独立博客
V
Vulnerabilities – Threatpost
cs.AI updates on arXiv.org
cs.AI updates on arXiv.org
阮一峰的网络日志
阮一峰的网络日志
Vercel News
Vercel News
Recent Announcements
Recent Announcements
WordPress大学
WordPress大学
GbyAI
GbyAI
S
SegmentFault 最新的问题
M
MIT News - Artificial intelligence
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
I
InfoQ
Recorded Future
Recorded Future
Security Archives - TechRepublic
Security Archives - TechRepublic
AI
AI
Webroot Blog
Webroot Blog
C
CXSECURITY Database RSS Feed - CXSecurity.com
爱范儿
爱范儿
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
T
The Exploit Database - CXSecurity.com
Apple Machine Learning Research
Apple Machine Learning Research
C
Cybersecurity and Infrastructure Security Agency CISA
H
Hacker News: Front Page
Latest news
Latest news

博客园 - 唯一客服系统开发笔记

企业微信怎么设置投诉页面 汽修行业AI知识库应用到抖店智能咨询 快手直播间弹幕评论抓取 知识库 AI Excel表格数据上传处理 扣子知识库 AI 智能体完整创建、对接实操教程 客服私有化部署 + 抖音私信接入说明 抖店飞鸽客服自动回复机器人插件使用 网站客服系统与电商客服自动化工具 唯一客服浏览器插件自动回复抖音评论私信 拼多多客服如何实现24小时全自动值守、大幅降本增效?这款自动化插件帮你轻松破局! 扣子 AI 智能体对接企业微信客服 抖音私信和评论网页端浏览器自动化插件 功能详解 批量扒完抖音评论还能发私信 | 本地开源工具 唯一客服企业微信侧边栏客户画像:让客服在聊天时直接查看客户详情、进群记录和跟进轨迹 自定义微信卡片链接生成工具:自由设置标题、描述与封面图 唯一客服系统接入自定义大模型:一行代码都不用改,写个 HTTP 接口就够了 GoLiveChat:Golang独立部署海外英文在线客服系统全解析 抖音无痕引流神器!评论自动回复藏微表情,规避系统检测,自动引私域 抖音评论区全自动表情回复插件-引流推广小技巧,有人评论自动化回表情 企业微信官方机器人无法对接外部群/个人微信的解决方案 Why We Built GoLiveChat — A Self-Hosted Live Chat Platform That Puts You in Control 抖音智能客服自动化:评论与私信自动化回复功能 微信个人号群发:用 UI 自动化模拟人工操作,实现零封号批量发送 从零搭建企业微信 AI 客服:Hook 注入 + 扣子知识库实战 抖音私信接入扣子知识库机器人教程|企业号/个人号全自动AI回复落地指南 抖音私信自动化回复-抖音企业号聚合回复-抖音私信AI智能体对接 抖音私信自动化回复-多版本 DOM 适配-抖音对不同账号推了不同的私信页面版本 Gin + 本地 CDN Vue + SQLite:绝配!真正开箱即用的本地系统三驾马车 轴承行业官网必备:一键接入在线客服,牢牢锁住搜索流量 PC 微信 4.1.9.62 UIA 抓取消息方案总结 唯一客服系统二次开发基础:Golang + Gin + Gorm + WebSocket 快速上手教程 Golang客服系统为什么比PHP客服系统更稳定?高并发、长连接、私有化部署全解析 聊城变量网络科技有限公司_专注企业客服系统与自动化解决方案 90%的人区分不清网站客服系统和电商客服平台 Python小程序二手房源界面抓取方案 聊城企业建站别踩坑!我是变量网络创始人程序员老狼,给聊城企业做真正能获客的官网 私域临时任务众包管理工具-基于微信号的创建任务,领取任务,反馈任务完整实现 聊城变量网络科技:扎根鲁西,用技术赋能临清本土企业数字化转型 电竞护航小程序完整开发方案 电竞护航UniApp源码项目-聚焦核心下单业务 在线客服系统源码 唯一客服 SCRM源码 微信群活码功能 企业微信 SCRM 服务商代开发实战:参数配置全打通,源码可直接交付 深耕PHP十余年,做聊城本地靠谱的网站建设公司——聊城变量网络科技有限公司 企业微信群活码开发-唯一客服企微xscrm源码开发 聊城本地企业微信服务商|变量网络科技,专注企微代开发 & 自研 SCRM 定制 从零搭建 UniApp 电竞护航项目源码(无NPM依赖、纯净版架构 2026电竞护航系统完整开发方案(行业分析+数据库+UniApp前端架构) 聊城临清本土互联网科技企业-聊城变量网络科技有限公司 Dify报错not_chat_app?一文解决工作流与对话流的核心混淆 唯一客服企业微信 SCRM:客户备注搜索功能 企业微信电竞护航运营体系 企业微信+电竞护航系统落地方案(解决漏单、私域流失等核心痛点) 从SCRM表结构底层逻辑,看唯一客服如何破解私域运营痛点 唯一客服 SCRM:独立部署的Golang企业微信SCRM源码 基于 UI 自动化的 QQ 群消息自动转发工具 自研企业微信SCRM系统源码独立部署(Golang+Vue.js) 程序员老狼|个人简介 企业微信SCRM应用开发:回调事件数据获取 基于企业微信 API 实现渠道活码 企业微信渠道活码(联系我)创建指南 企业微信开放平台:第三方系统通讯录管理 企业微信客服 × Dify 独立对接 AI企业实操落地方案服务商|不玩虚的,聚焦技术落地、解决企业实际问题 程序员老狼 · OPC超级个体介绍 私域引流:企业微信客服分流个人微信 扣子API使用场景及核心操作指南(非流式响应重点,记住上下文历史记录) 想让AI搜到你?自建内容站才是长久办法 拼多多客服自动回复工具|告别手动值守,轻松应对海量咨询 美团点评客服自动回复神器|告别手动回复,轻松达标平台考核 为什么企业需要专业的在线客服系统 Websocket高性能即时通讯在线客服系统 微信消息定时自动发送:用Python脚本与cron任务实现办公自动化 在线客服系统源码实现 企业客服系统解决方案:一站式解决客户服务难题 降低运营成本:智能客服系统ROI分析 电商客服系统:提升店铺转化率的必备利器 智能客服机器人:7×24小时永不离线的AI服务专家 在线客服系统功能全解析:企业选型必看指南 客服系统多少钱?在线客服系统价格全对比 在线客服系统:企业数字化转型的必备工具 独立站网页即时聊天在线客服系统 选择独立开发的Golang在线客服系统,安全稳定,性能领先 赋能跨境与独立站——您的专属智能在线客服系统 同城跑腿派送系统源码 聊城临清网络科技公司哪家强? 聊城网络科技公司哪家强? 实测!我们公众号的客服系统,消息提醒到底有多“狠”? 在线客服系统实现复杂统计需求,直接SQL操作查询数据库,统计超过一分钟未回复消息数 我开发的客服系统,自动欢迎语以及对接AI与转人工模式思考
唯一客服系统多智能体架构深度解析:一个后台,四种 AI 引擎随心切换
唯一客服系统开发笔记 · 2026-06-09 · via 博客园 - 唯一客服系统开发笔记

为什么需要多平台支持

智能客服的最终效果,很大程度上取决于背后的 AI 引擎。但不同团队、不同业务场景对 AI 引擎的需求千差万别:

  • 有些团队已经用扣子(Coze)搭好了工作流和知识库
  • 有些团队偏好 Dify 的开源可私有化部署
  • 有些团队在 FastGPT 上维护了大量的文档向量数据
  • 还有一些团队有完全自研的模型,只需要一个 HTTP 通道

我们的做法是:不做选择题,全都要。 一个后台统一配置,四种引擎自由切换。

引用原文:客服系统多智能体架构深度解析:一个后台,四种 AI 引擎随心切换

统一入口,统一配置

系统通过两个关键配置项控制 AI 引擎的切换——

配置项说明
聊天补全模型 coze / fastgpt / dify / http(或其他 OpenAI 兼容模型名)
接口地址 各平台的 API 端点
接口密钥 API Key

用户在设置页面只需切换一次下拉框,修改接口地址,即可完成从”扣子”到”Dify”的切换,无需重启服务。后端入口通过 BigModelName 做分支分发,然后走各自的分支逻辑,下面逐一拆解。


一、Coze(扣子)智能体

扣子是字节跳动推出的一站式 AI Bot 开发平台,支持可视化搭建工作流、知识库、插件等。

接入方式

用户在扣子后台创建一个 Bot,拿到 Bot ID 和 API Key,然后在客服系统中:

  • 聊天补全模型 → 选择 coze
  • 接口地址 → 填入 Bot ID
  • 接口密钥 → 填入 API Key

实现原理

系统为每个访客自动创建并维护独立的扣子会话,保证访客之间对话隔离、多轮上下文不串扰。核心分三步:

第一步:会话管理。 每个访客首次对话时,系统调用扣子 v1 API https://api.coze.cn/v1/conversation/create 创建一个 conversation_id 并持久化。后续该访客的所有消息都复用同一个会话 ID。

第二步:流式对话。 使用扣子 v3 API 的流式接口 https://api.coze.cn/v3/chat,携带 conversation_id、历史 additional_messages 上下文,设置 stream: trueauto_save_history: true,实现真正的流式多轮对话。

第三步:实时推流。 系统解析扣子返回的 SSE 事件流,监听 event:conversation.message.delta 类型事件,逐字提取 content 字段,并通过 WebSocket 实时推送到前端,给用户”打字机”般的流畅体验。

Coze 模式特点

特性说明
流式输出 ✅ SSE 流式推送,逐字显示
会话隔离 ✅ 自动创建 + 持久化,多轮对话不串扰
历史消息 ✅ 传递最近的问答对作为上下文
适用场景 已用扣子搭建 Bot 的团队,零代码复用

二、Dify 智能体

Dify 是开源的 LLM 应用开发平台,支持可视化编排 AI 工作流、RAG 知识库、Agent 等。与 Coze 理念相似,但核心区别在于支持私有化部署。

接入方式

  • 聊天补全模型 → 选择 dify
  • 接口地址 → 填入 Dify 的 API 根地址(如 http://your-dify-server,系统自动拼接 /chat-messages
  • 接口密钥 → 填入 Dify 应用的 API Key

实现原理

流式对话。 向 Dify 的 /chat-messages 端点发 POST 请求,关键参数:

{
  "response_mode": "streaming",
  "user": "访客ID",
  "query": "用户问题",
  "conversation_id": "会话ID(首次为空)",
  "inputs": {}
}

请求头携带 Authorization: Bearer <API_KEY>,Dify 返回标准 SSE 事件流。

SSE 解析。 与 Coze 不同,Dify 返回的是标准 SSE 格式——以 data: 为前缀的行,每行一个 JSON 对象,系统解析 answer 字段并逐字推送,同时每次都从事件中提取 conversation_id

会话持久化。 对比 Coze 预先创建会话,Dify 的模式更轻量:首次请求不传 conversation_id,由 Dify 自动创建并返回,系统在流式响应首帧中拿到 conversation_id 后持久化到访客属性。当 message_end 事件到来时,流结束。

Dify 模式特点

特性说明
流式输出 ✅ SSE 流式推送
会话管理 ✅ 自动,Dify 侧生成 conversation_id
私有化部署 ✅ 支持,填入内网地址即可
适用场景 有私有化需求的团队、自建 RAG 知识库场景

三、FastGPT 智能体

FastGPT 是另一款知名的开源知识库问答平台,专注 LLM + 知识库的 RAG 能力。

接入方式

  • 聊天补全模型 → 选择 fastgpt
  • 接口地址 → 填入 FastGPT 的 API 地址
  • 接口密钥 → 填入 FastGPT 的 API Key

实现原理

FastGPT 对外暴露的是标准 OpenAI 兼容接口,所以直接走通用 GPT 路径。这个路径的核心能力包括三重能力叠加:

第一层:向量知识库搜索。 用户问题 → Embedding 模型编码 → Qdrant 向量数据库检索 → 取 Top-K 相似文档作为参考知识。

第二层:系统提示词拼接。 将检索到的知识作为 [[quote]] 占位符的值,与预设的 system prompt 合并,形成带上下文的完整 system 消息。同时支持历史 N 条对话的上下文窗口拼接。

第三层:流式调用。 走标准 OpenAI Chat Completion 流式接口,支持 DeepSeek-R1 等推理模型的思考链格式化渲染(用 <pre> 包裹推理过程,正文正常展示)。

FastGPT 模式特点

特性说明
流式输出 ✅ OpenAI 兼容 SSE 流
知识库 ✅ 外挂向量知识库(Qdrant),搜索优化 + 相似度阈值
协议兼容 ✅ 任意 OpenAI 接口兼容的服务都能接入
思考链 ✅ 自动识别 DeepSeek-R1 模型并渲染推理内容
适用场景 已用 FastGPT 搭建知识库的团队;或作通用兼容通道

四、自定义 HTTP 智能体

这是灵活度最高的模式,专为自研模型、私有服务、内部 API 设计。

请求格式(系统 → 你的接口)

系统以 POST + Content-Type: application/json 调用你的接口:

{
  "visitor_id": "访客唯一ID",
  "visitor_name": "访客昵称",
  "avatar": "访客头像URL",
  "content": "用户发送的消息原文",
  "kefu_name": "当前客服名称"
}

响应格式(你的接口 → 系统)

你的接口只需返回一个字段:

{
  "result": "你的智能体回复内容"
}

系统拿到 result 后,自动以客服身份发送给访客。

安全保护

  • URL 空值校验:未配置 chatGPTUrl 时直接终止,打印日志
  • 120 秒超时:超时自动失败,不阻塞主流程
  • 调用失败兜底:网络错误或返回空 result 时,走”未知问题学习”逻辑,不影响服务可用性

实践示例(Python Flask)

仅需 20 行即可接入:

from flask import Flask, request, jsonify

app = Flask(__name__)

@app.route('/my-agent', methods=['POST'])
def my_agent():
    data = request.get_json()
    user_message = data.get("content", "")
    visitor_name = data.get("visitor_name", "用户")

    # 接入你自己的逻辑:
    # - 调用 OpenAI / 文心一言 / 通义千问
    # - 查询知识库 RAG
    # - 基于规则的自动回复
    reply = f"你好 {visitor_name},你问的是:{user_message}。我是自定义智能体!"

    return jsonify({"result": reply})

if __name__ == '__main__':
    app.run(port=5000)

然后在客服系统后台配置:

  • 聊天补全模型 → http
  • 接口地址 → http://你的服务器:5000/my-agent

完成!

HTTP 模式特点

特性说明
流式输出 ❌ 同步等待完整结果
会话上下文 ❌ 需自行维护(可通过 visitor_id 追踪)
灵活度 ⭐⭐⭐⭐⭐ 极高
适用场景 私有模型、内部 API、规则引擎组合

四种模式全景对比

                         用户发送消息
                              │
                    ┌─────────▼─────────┐
                    │  读取 BigModelName  │
                    └─────────┬─────────┘
                              │
       ┌──────────┬──────────┼──────────┬──────────┐
       ▼          ▼          ▼          ▼          ▼
   ┌──────┐  ┌──────┐  ┌──────┐  ┌──────┐  ┌──────────┐
   │ coze │  │ dify │  │fastgpt│ │ http │  │ gpt-3.5  │
   │ 扣子 │  │ Dify │  │FastGPT│ │ 自定义│  │ 等兼容   │
   └──┬───┘  └──┬───┘  └──┬───┘  └──┬───┘  └────┬─────┘
      │         │         │         │            │
      ▼         ▼         ▼         ▼            ▼
   创建会话   无传参    向量检索   POST JSON   OpenAI标准
   SSE流式   Dify返回   prompt拼接  解析result  流式接口
   历史消息  conversation  OpenAI流   120s超时  知识库嵌入
   持久化ID   _id自动返回  deepseek             流式推送
      │         │         │         │            │
      └─────────┴─────────┴─────────┴────────────┘
                              │
                    ┌─────────▼─────────┐
                    │  WebSocket推前端   │
                    └───────────────────┘
对比维度CozeDifyFastGPTHTTP 自定义
流式输出 ✅ SSE ✅ SSE ✅ OpenAI SSE ❌ 同步
会话隔离 ✅ 自动 ✅ 自动 ✅ 历史消息 ❌ 自行实现
私有化部署 ❌ SaaS ✅ 开源 ✅ 开源 ✅ 任意
知识库 扣子内置 Dify 内置 Qdrant 外挂 自行实现
多轮对话 ✅ 多对Q&A ✅ Dify管理 ✅ N条上下文
接入门槛 极低
灵活度 中高 极高
超时控制 SDK管理 120秒

总结

这套架构的核心思想是:把客服系统做成一个纯粹的消息管道,AI 引擎的选择权完全交给用户。

  • Coze — 给用扣子搭建工作流的团队,零代码即插即用
  • Dify — 给需要私有化部署 + 开源可控的团队
  • FastGPT — 给已有知识库的团队,或作为 OpenAI 通用兼容通道
  • HTTP 自定义 — 给有自研能力的团队,完全掌控对话逻辑

而这一切,在后台只是一个下拉框的切换。