AI 设置
配置大模型与故障转移链、知识库向量模型,查看模型可用率、生成质量和 token 用量。
AI 设置 在侧栏底部 管理 组中,只有管理员可见。页面标题为 AI 配置。

模型运行概览
模型可用率、过去 24 小时的调用量(按审计记录统计,需要开启审计)、p95 耗时,以及是否有 provider 连续失败。
模型路由
可以配置多个 provider,按列表顺序组成故障转移链。点 新增 provider 填写:
| 字段 | 说明 |
|---|---|
| 类型 | openai(含任意 OpenAI 兼容网关,如火山方舟、vLLM、Ollama),以及 Azure OpenAI(需要 API 版本和部署名) |
| base url、模型 | 端点地址和模型名 |
| key | 保存后不回显,留空保留现有 key |
| 超时 | 单次调用超时(秒) |
| 推理强度 | 思考模型先推理再作答。自动(推荐)、关、低、高 |
改完点 保存并重载 生效。
多模型故障转移是企业版功能:企业版在第一个 provider 出错时依次切到后面的;其他版本只用第一个启用的 provider,出错时不切换。
知识库向量模型
知识库检索需要一个 Embedding 模型。填写模型 ID;地址和 key 留空时复用聊天模型的端点和 key。点 测试连接,通过后回填向量维度,保存即启用知识库。
更换为维度不同的向量模型时,需要先重建知识库。
生成质量
- 失败案例:用户点了差评或很快改口重问的问题,用于补充评测集和改进提示词。
- 纠错样例:用户纠正过的说法。模型判断为持久事实的写入知识库,其余丢弃,这里都留底。
成本统计
近 30 天按供应商和模型累计的调用次数和输入、输出 token 数。不换算金额,各家单价不同,以账单为准。