Skip to content

模型管理 ​

概述 ​

模型管理是 AI 大模型子系统的「基础设施」配置中心,负责维护对接各家 AI 厂商所需的 API 密钥 以及平台下具体 模型配置。智能对话、知识库、智能写作等业务在发起请求时,都会通过本模块找到对应的密钥与模型参数,再调用底层 AI 框架完成推理。

本模块包含两块内容:

  • API 密钥:按平台维度保存厂商的密钥与访问地址。
  • 模型配置:描述某个平台下具体的模型(类型、能力、超参数、状态等),并关联到对应的密钥。

image-20260930084416995

核心概念 ​

API 密钥(AiApiKey) ​

以「平台」为维度管理密钥。例如同一个 OpenAI 平台只需维护一条密钥记录,其下可挂载多个模型。核心字段:

  • platform:所属平台(见下文平台枚举)。
  • api_key:厂商密钥,数据库加密存储。
  • url:自定义 API 地址(BASE URL),用于兼容第三方代理或私有化部署。
  • status:启用 / 停用。

模型配置(AiModel) ​

在密钥之上描述一个具体模型,例如「gpt-4o」「deepseek-chat」。核心字段:

  • name / model:展示名与厂商模型标识。
  • type:模型类型(聊天 / 图像 / 音频 / 视频 / 向量 / 重排)。
  • key_id:关联所属 API 密钥。
  • sort:排序,越小越靠前。
  • status:启用 / 停用。

两者关系 ​

一个平台密钥下可挂载多个模型;模型通过 key_id 关联密钥。推理时先按模型找到密钥,再从密钥读取真实的 api_key 与 url(模型的 url 字段为保留字段,实际以密钥的 url 为准)。

模型类型 ​

模型类型决定该模型可被哪些业务能力使用,前端会据此动态展示不同参数:

类型值含义典型用途
1聊天 CHAT智能对话、写作
2图像 IMAGE文生图
3音频 VOICE语音合成
4视频 VIDEO视频生成
5向量 EMBEDDING知识库入库 / 检索
6重排 RERANK知识库召回精排

平台枚举(AiPlatformEnum)覆盖了国内外主流厂商,如 OpenAI、AzureOpenAI、Anthropic、Gemini、DeepSeek、TongYi(通义)、YiYan(文心)、ZhiPu(智谱)、XingHuo(星火)、DouBao(豆包)、SiliconFlow(硅基流动)、Moonshot(Kimi)、Ollama、vLLM、Xinference 等,并支持 OpenAICompat / AnthropicCompat 兼容协议接入自建服务。

配置建议 ​

  • 新建模型时务必选择正确类型:仅 CHAT 类型会参与对话与写作,EMBEDDING / RERANK 类型用于知识库检索。
  • 停用模型或密钥后,依赖它的业务将因 validate_api_key 校验失败而提示「密钥不可用」,排查时优先检查状态。
  • BASE URL 发生改变时,将新 url 填在密钥上即可,无需改动模型配置。

前端页面 ​

页面位于 apps/web-ele/src/views/ai/model,分为 apiKey(密钥管理)与 model(模型配置)两个列表页,均基于 Vben 的 useVbenVxeGrid 实现,权限通过 auth 控制按钮显示。

API 密钥管理页 ​

路径:src/views/ai/model/apiKey。提供分页表格与搜索(名称 / 平台 / 状态),支持新建、编辑、删除。表单需填写平台、名称、密钥、BASE URL 与状态。

image-20260930084326443

模型配置管理页 ​

路径:src/views/ai/model/model。提供分页表格与搜索(名字 / 标识 / 平台),操作列支持编辑、删除。

新建 / 编辑表单(src/views/ai/model/model/modules/form.vue + data.ts)具有以下特性:

  • 选择所属平台、模型类型、关联 API 密钥(下拉来自 simple-list)。
  • 当类型为 CHAT 时,动态展示聊天专属参数:能力(视觉 / 工具使用)、最大输出 Token、上下文消息数量、温度参数;非聊天类型则自动隐藏这些项。
  • 排序与状态控制展示顺序与可用范围。