Skip to content

模型管理

「模型管理」用于管理平台上的模型资产,包括模型仓库的发布、编辑、上下架,以及推理部署模板的维护。上架后的模型会出现在「大模型服务 > 模型广场」,也可在创建推理服务时被选用。

入口路径:左侧菜单 AI 智算管理 > 模型管理,页面路由 /admin/ai/model-manage

模型管理菜单与模型仓库列表

页面菜单

页面路由说明
模型仓库/admin/ai/model-manage/registry模型资产列表与发布
创建模型仓库/admin/ai/model-manage/registry/create发布新模型
模型仓库详情/admin/ai/model-manage/registry/detail/:uuid查看模型详情与统计
部署模板/admin/ai/model-manage/deploy-template推理服务部署模板
创建部署模板/admin/ai/model-manage/deploy-template/create新建部署模板

模型仓库

查看模型仓库

  1. 进入 AI 智算管理 > 模型管理 > 模型仓库
  2. 列表展示:模型名称/别名、模型分类、提供方、访问权限、状态(启用/禁用)、关联 AI 路由数量、创建时间。
  3. 使用顶部筛选栏按模型分类、提供方、访问权限、状态、名称查询。
  4. 点击模型名称进入详情页,查看基本信息、关联 AI 路由、调用统计、版本管理。

模型仓库详情页

模型仓库列表页

发布模型

  1. 在模型仓库列表页点击「创建模型」。
  2. 基础信息
    • 模型名称:模型唯一标识,创建后不可修改。
    • 模型别名:展示名称。
    • 模型分类:LLM / Embedding / Vision / Rerank / Audio / 多模态 等。
    • 模型提供方:选择已注册的服务商(如 Qwen、Meta、OpenAI 等)。
    • 访问权限:公开 / 租户 / 项目;租户/项目级需选择归属。
    • 更多属性(可选):发布时间、上下文长度、最大生成长度、参数量、数据类型、描述。
  3. 模型标签
    • 模型场景:如文本生成、代码、多轮对话。
    • 模型大小、上下文长度标签:用于模型广场筛选。
  4. 本地部署
    • 开启「支持本地部署」后,填写模型权重来源:
      • 本地:填写平台存储中的模型路径。
      • ModelScope / HuggingFace:填写仓库 ID 与访问 Token,点击「解析」自动获取文件信息。
    • 选择部署模板:关联一个已创建的部署模板,用于推理服务创建时的默认参数。
    • 模型路径/模型文件:本地路径或解析后自动填充。
  5. 定价信息
    • 配置输入/输出/cached/cache_write_5m/cache_write_1h 五档价格。
    • 按次计费模型可配置按次单价。
  6. 点击「创建」,模型上架完成。

创建模型表单,重点标注基础信息、本地部署、定价

管理模型

  1. 在模型仓库列表页,点击行内「更多操作」或在详情页点击对应按钮:
    • 启用/禁用:控制模型是否在模型广场和推理服务下拉中可见。
    • 编辑:修改别名、标签、部署模板、价格等;模型名称不可修改。
    • 详情:查看模型基本信息、关联的 AI 路由数量、调用统计。
    • 删除:彻底移除模型;若模型已被路由或任务引用,需先解除关联。

部署模板

部署模板定义了推理服务的默认镜像、启动命令、启动参数和健康检查等配置,是「一键部署」和「创建推理服务」时的基础模板。

查看部署模板

  1. 进入 AI 智算管理 > 模型管理 > 部署模板
  2. 列表展示:模板名称、部署类型、推理引擎、镜像、模型分类、状态、创建时间。
  3. 使用顶部筛选栏按部署类型、推理引擎、模型分类、状态、名称查询。
  4. 点击模板名称进入详情页,查看完整配置。

部署模板详情页

部署模板列表页

创建部署模板

  1. 在部署模板列表页点击「创建部署模板」。
  2. 基础信息
    • 模板名称:便于识别的名称。
    • 部署类型:单机(StatefulSet)/ 多机(LWS)。
    • 推理引擎:vLLM / SGLang / MindIE 等;选择后自动过滤可用镜像。
    • 镜像:选择基础镜像或自定义镜像。
    • RDMA 策略是否可编辑:多机模板专用。
    • 模型分类:该模板适用的模型分类。
    • 模板描述:可选。
  3. 部署信息
    • 注解、环境变量:按 key-value 添加。
    • 启动命令:每行一条。
    • 启动参数:使用参数编辑器填写,支持重置为引擎默认值。
    • 更多配置:健康检查、workingDir、hostNetwork、hostIPC、启动用户。
  4. 对于多机模板,需要分别填写 Leader 节点和 Worker 节点的启动命令/参数/更多配置。
  5. 点击「创建」。

部署模板创建表单

使用部署模板

  1. 创建推理服务时,「部署模板」下拉会列出所有已启用且与模型引擎匹配的模板。
  2. 选择模板后,系统会自动填充镜像、启动命令和启动参数,用户仍可按需修改。
  3. 发布模型时,可在「本地部署」步骤关联一个部署模板,作为该模型默认的推理配置。

常见问题

Q:模型广场看不到刚创建的模型? A:检查模型是否已启用、访问权限是否正确、以及当前用户所在工作空间/项目是否在授权范围内。

Q:解析 HuggingFace 仓库失败? A:确认仓库 ID 正确、仓库为公开或已填写有效 Access Token,且平台能访问 HuggingFace 网络。

Q:部署模板中启动参数如何填写? A:使用参数编辑器逐项添加,或点击「重置为默认」恢复引擎推荐参数;高级用户可直接编辑启动命令覆盖。

Q:模型定价如何生效? A:定价信息保存后,会在「计量计费 > Token 治理」中按调用量统计费用;若未配置价格,则调用不计费。

基于 Rise 智算平台 release-2606.v2.2.x 生成