跳到主要内容

智能体新建与配置

概述

智能体是 Data Agent 的核心功能之一,主要包含智能体创建与智能体测试两部分,支持用户快速构建业务场景对话逻辑并验证效果,确保 Data Agent 的准确性与流畅性。

前提条件

拥有 ChatBI 「编辑」权限的用户,才可进入「智能体管理」页面进行智能体配置相关操作。

智能体创建

入口:http://<your-domain>/agent/manage/dataset(私有化客户请将 <your-domain> 替换为实际环境地址)。

说明

首次创建智能体时建议基于单表创建,在单表问答准确率达到 80% 后,再扩展其他表进行问答。

  1. 在「Data Agent > 智能体管理」页面,点击「新建智能体」。

  2. 填写基础信息,后续若要对基础信息进行修改,可参考 基础配置

    • 名称(必填):业务视角简单概括当前业务智能体,会作为训练知识给到大模型,最多支持 30 个字符。

    • 问答头像配置:默认为观远 logo,可以由用户自行上传图片,进行前台问答头像变更。

    • 欢迎语配置(选填):默认第一行为欢迎语标题,第二行开始为正文内容。欢迎语支持富文本编辑器与引用特定属性。

    • 描述(选填):帮助业务用户了解当前智能体可以解决哪些业务场景/问题,会作为训练知识给到大模型。

    • 关联数据集(选填):问数回答的数据范围,目前版本支持部分直连数据库和抽取数据集,数据集描述、数据集结构和字段注释会作为模型学习知识。

      说明
      • 直连数据库支持:MySQL、Postgres、Starrocks、Doris、Hive、Presto、Trino 、SQL Server、ClickHouse、kylin
      • 建议提前准备好至少一个可用数据集以提升问答效果。

    展示效果:

  3. 完成智能体创建。

    • 若知识库没有准备好,可点击「直接新建」完成智能体创建,后续可在「业务知识库」界面添加知识。
      知识库相关操作可参考 业务知识库
    • 若知识库已准备好,点击「下一步」配置业务知识集,配置完成后点击「完成」完成智能体创建。
      知识库相关操作可参考 业务知识库
  4. 以上内容全部填写完成后,即可点击「完成」,完成智能体创建。 创建完成后默认进入智能体详情配置页,后续操作可参考 智能体详情配置

  5. (可选)如果想复用已有智能体的知识库,可以通过另存为的方式,快速复制新智能体。

智能体测试

创建完成一个新的智能体后,建议对当前智能体进行测试,智能体测试准确率直接影响 Data Agent 使用的准确性,请确保测试准确率达 90% 以上再启用智能体。

进入测试页面

在智能体详细配置页面,点击右上角的「测试」,进入到测试界面。

测试问答效果

导入问题

在测试页面,支持通过「AI 辅助生成测试问题」、「批量导入」或「手动添加」三种方式来添加测试问题。

  • AI 辅助生成测试问题:系统结合当前主题内已关联的数据集字段,以及用户自定义输入的指标维度定义和生成控制偏好等内容,由 AI 辅助生成测试语料,快速补充测试问题库。

    若对生成的测试问题不满意,可点击「重新生成」。

    勾选需要加入测试集的问题,点击「确认」,即可将问题添加进测试集。

  • 批量导入:下载 Excel 模板,将调研收集的用户问题及回答 SQL 填入后批量上传。

    说明

    问题列表样例中的回答 SQL 非必填,可以仅上传测试问题。上传文件后即开始文件内所有问题条目的测试。

    |450

  • 手动添加:逐条录入问题与回答 SQL,点击「确定」后即开始该问题条目的测试。

    说明
    • 回答 SQL 非必填,可以仅填写问题描述。
    • 若创建智能体时已关联了数据集,则会在「新建问题」页面展示数据集与字段信息。

问题测试与批改

问题上传后系统会自动触发问题测试,大模型会根据当前的数据表和知识,批量生成针对当前问题的 SQL 结果,系统执行该 SQL 并检查其有效性。

SQL 有效性错误时

若 SQL 执行出错,界面会提示 SQL 有效性及批改结果错误。

  1. 点击问题右侧「批改」,可以看到当前大模型生成的 SQL 详情,在问答详情页面支持以下操作:

    • 允许查看和复制消息 ID,提供给产研进行排查。

    • 复制执行 SQL:点击「复制执行 SQL」后,系统会将数据库侧实际执行的 SQL 语句复制到剪贴板,可以将 SQL 粘贴到数据库中进行查询。

    • 以下场景会进行报错提示:

      • 当 AI 模型无法生成有效的 SQL 查询时,系统会显示具体的失败原因:" 问题回答失败,失败原因:xxxx"。此情况通常与模型理解问题或数据结构有关,请尝试重新描述您的需求。
      • 当模型成功生成 SQL 但执行时遇到错误,系统会显示 SQL 验证错误信息:" 当前 SQL 有效性校验错误,错误原因:{xxxxx}"。常见原因包括语法错误、表名或字段名不存在、筛选条件错误等。
      • 当 SQL 执行成功但未返回任何数据时,系统会提示可能的原因:" 当前查询无数据,请检查数据源是否更新正确、行列权限规则是否配置正确 "。这种情况下,建议检查数据源状态和权限配置。

  2. 维护答案集。

    • 如果此时没有答案集,建议用户点击「复制到答案集并编辑」,将 SQL 改正后保存,此时该问题将存储一份正确的 SQL 作为答案。

    • 如果已有答案集或已在答案集中维护了正确 SQL,点击「标记为错误并添加至样例集」,将本条问题加入知识库中。

  3. 返回列表页,勾选本条问题,点击「开始测试」重新测试。SQL 有效性正确后,点击「批改」将问题「标记为正确」。

SQL 有效性正确时

  • 对于没有答案集的问题,需要点击右侧「批改」。问答详情页面支持的操作与 SQL 有效性错误时一致。

    • 若数据结果正确,则点击「标记为正确」,本条测试问题判对,且大模型生成的 SQL 会自动录入到答案集中。
    • 若数据结果错误,则先点击「复制到答案集并编辑」维护答案集,再点击「标记为错误并添加至样例集」,进行知识录入维护。

  • 对于有答案集的问题,系统会进行大模型生成 SQL 的执行结果与答案集 SQL 的执行结果比对,两者数据必须完全一致,则系统自动判定批改结果为正确;如数据不一致,则系统批改结果为错误。

    • 对于系统判对的问题,可以人工再核验一版数据,评估是否要修改判定结果。
    • 对于系统判错的问题,则先点击「答案集」右上方「编辑」维护答案集,再点击「标记为错误并添加至样例集」进行知识录入维护。

启用智能体

在全部测试问题批改完成后,列表上方会生成测试准确率提示,建议智能体测试准确率 90% 及以上后再投入生产。

返回智能体详情配置页,点击「启用」,开启智能体。

知识质量检查

知识质量检查用于对当前智能体做一次全局检查,识别可能影响问答结果的知识冲突。该功能主要检查知识之间是否存在口径、规则或 SQL 逻辑冲突,不用于检查格式、排版或轻微措辞问题。

在智能体详情配置页,点击右上角「知识质量检查」,打开「知识质量全局检查」页面。

检查内容

知识质量检查主要检查以下内容:

  • 通用知识、通用偏好与业务知识是否冲突,例如指标口径不一致、时间范围规则不一致、同义词或业务定义互相矛盾、企业偏好与主题内业务知识说法冲突。
  • QA 问答知识中的 SQL 是否一致,例如问题意图与 SQL 是否一致,SQL 内部逻辑是否自相矛盾,SQL 的筛选、聚合、维度、时间口径是否与知识要求冲突,SQL 使用的表、字段、字段含义、字段类型是否与数据集信息匹配。

检查范围

知识质量检查会检查以下范围:

  • 当前智能体下生效、启用中的知识。
  • 对当前智能体生效的企业偏好。
  • 启用中且 SQL 状态有效的 QA。
  • QA SQL 涉及的数据集表结构信息。
说明

当前版本不检查重复知识、干扰知识、格式排版、轻微措辞优化、未启用知识,以及空 SQL 或无效 SQL 的 QA。

操作步骤

  1. 在「知识质量全局检查」页面,若当前还没有检查结果,点击「开始检查」。

  2. 检查运行中,页面会展示检查进度、已检查数量和当前检查阶段。知识质量检查需要一定时间,关闭窗口后任务会继续执行。如需停止本次检查,可点击「取消检查」。

  3. 检查完成后,页面会展示已检查内容数量、冲突项数量、涉及知识数和检查完成时间。

    • 若未发现知识冲突,页面会提示「未发现知识冲突」。可点击「重新检查」再次发起检查,也可以点击「确认」关闭页面。

    • 若发现知识冲突,页面会按冲突项展示检查结果。点击冲突项右侧展开按钮,可查看冲突名称、冲突来源和知识原文,定位后可到对应知识中修改。

其余操作

点击智能体右下角更多图标,可对智能体进行其他常用操作。

|300

启用/停用

首次创建并测试完成的智能体,需要点击「启用」,将智能体上线。业务用户可在「问数智能体/洞察智能体」页面,看到全部已启用且有权限的智能体。

若该智能体需要下线,点击「停用」,下线当前智能体。停用的智能体会在智能体右上角展示「停用」状态,若想再次开启该智能体,点击「启用」即可。

重命名

点击「重命名」,重命名当前智能体名称。

另存为

点击「另存为」,可根据当前智能体配置快速创建一个新的智能体。

导入导出

导入导出用于在不同环境或不同智能体之间迁移主题配置。导出文件包含当前主题中可迁移的配置;导入时,系统会将文件内容导入到用户选中的目标主题中。

主题导入导出支持以下内容:

内容支持导出的内容
数据集关联及配置信息包括主题与已有数据集的关联关系、字段启停配置、枚举配置等。
样例集 / QA 知识包括问题、SQL、启用状态等。
自定义偏好设置包括通用知识、同义词、指标定义、时间逻辑、展示偏好、SQL 知识、可视化洞察知识等。
业务知识包括业务知识内容和启用状态。
测试集包括用于评测的测试问题、标准 SQL 等。
分析专家包括分析专家配置、推荐问题、报告模板等。
订阅管理包括分析专家相关订阅配置。
主题权限包括用户、用户组的查看、协作、管理权限。
个性化固定回答即 Query Guard 规则,包括触发规则、固定回复、关联用户属性等。
主题配置开关包括问数分析模式、开场白推荐、猜你想问、用户属性、样例匹配、表关系、个性化记忆、洞察开关等主题内部 功能开关
开场白话术包括主题欢迎语、开场白内容。
主题头像 / 分析专家头像包括主题头像和分析专家头像。
表关系配置包括表关系、关联字段、基数、数据集唯一标识等配置。

导入支持「追加导入」和「覆盖导入」两种方式:

  • 追加导入:保留目标主题现有内容,并补充导入文件中的新内容。主题配置开关、开场白等无法追加的内容会按覆盖处理。
  • 覆盖导入:清空目标主题中对应的现有内容,再导入文件中的内容。
说明

主题导入导出主要迁移主题配置和知识资产。以下内容不支持迁移,或导入时会按实际依赖情况跳过:

  • 主题基础信息:不迁移主题名称、主题描述和启停状态。导入操作会将文件内容导入到当前选中的目标主题中。
  • 环境级资源:不迁移 BI 数据集实体、数据源、底层表、大模型绑定、机器人 / 渠道密钥、企业级全局配置等。
  • 用户历史和运行结果:不迁移历史会话、问答记录、已生成报告、图表结果、收藏、反馈、测试运行记录、订阅执行记录、知识质量检查结果等。
  • 外部依赖:如果目标环境找不到用户、用户组、用户属性、外部头像等资源,系统会跳过对应内容。追加导入时,如果目标主题已有头像,系统会保留原头像。

导入完成后,建议检查数据集关联、权限、订阅、表关系和个性化固定回答是否符合预期。

删除

点击「删除」,删除当前智能体,删除操作会进行二次确认以防误删。