模型广场
「模型广场」是用户发现和部署模型的入口。平台管理员上架的模型会在这里以卡片形式展示,支持多维筛选、性能参考、价格对比,以及一键体验/一键部署。
入口路径:左侧菜单 大模型服务 > 模型广场,页面路由
/admin/model-x/models。

浏览与筛选模型
页面左侧为筛选面板,右侧为模型卡片列表:
- 分类筛选:在左侧点击模型分类(如 LLM、Embedding、Vision、Rerank、Audio)。
- 标签筛选:按模型场景、模型大小、上下文长度、推理引擎、芯片厂商、模型提供方等标签过滤。
- 关键词搜索:在顶部搜索框输入模型名称,实时过滤。
- 可体验开关:打开后只展示支持在线体验的模型。
每个模型卡片展示:
- 模型名称与发布时间
- 模型标签
- 价格:Token 计费显示输入/输出单价;按次计费显示每次单价
- 近 24 小时平均延迟与错误率(作为运行质量参考)
- 模型提供方图标

一键部署模型

- 在模型广场找到目标模型卡片。
- 点击「去部署」(仅对支持本地部署的模型展示)。
- 系统自动跳转至推理服务创建页,并预填:
- 模型来源:模型广场
- 模型:当前模型
- 部署模板:模型关联的默认模板
- 补充选择项目、算力规格、实例数量等信息。
- 点击「创建」,等待服务运行后获取 API 调用地址。

一键体验模型
- 在模型广场找到支持体验的模型卡片。
- 点击「去体验」。
- 系统跳转至 大模型服务 > 在线体验,并自动选中该模型。
- 在对话/生图/语音等页面中直接输入内容进行测试。

模型详情
点击模型名称进入详情页:
- 基本信息:模型分类、上下文长度、最大输出长度、参数量、模型提供方、标签。
- 定价区:展示输入/输出/缓存读/缓存写 5m/缓存写 1h 五档价格。
- 性能参考:近 24 小时延迟、错误率、调用量趋势。
- 部署记录:该模型关联的推理服务列表(若有权限)。

常见问题
Q:为什么有些模型没有「去部署」按钮? A:管理员创建模型时未开启「支持本地部署」,或该模型仅用于外部渠道调用。
Q:价格和性能数据从哪里来的? A:价格来自管理员配置的计费策略;性能数据来自平台近 24 小时真实调用统计,仅供参考。