Lumoswitch 文档

配置 API

配置 API 把模型选择、Lumoswitch Runtime 路由策略、一个或多个对外模型名称和 Virtual Key 限制组合成一个可调用单元。每个配置有一个当前 Access Key;替代式轮换的宽限期内旧 Key 可以短暂并存。

平台模型和接入模型只在资源来源上不同。进入配置 API 后,两者使用相同的候选选择、路由、已启用下游格式和 Access Key 逻辑;平台模型不会获得绕过路由的直接 Key。

概念关系

配置 API
  ├─ 基础信息:名称、启用状态
  ├─ 调度:固定 / 故障转移 / 自动路由 / 最少繁忙 / 最低延迟
  ├─ 候选模型资源
  ├─ 下游输出:对外模型映射与已启用格式
  └─ 当前 Access Key:频率、可用模型

创建配置

1. 基础信息

填写唯一的配置名称,并决定创建后是否立即启用。配置停用时,对应 Access Key 无法调用。

2. 调度方式与候选模型

模式选择要求请求行为
固定模型一个模型资源始终调用同一模型
故障转移一个以上,按优先级排列当前模型失败时继续下一个候选
自动路由两个以上,由轻量到推理排列根据请求复杂度选择 SIMPLEREASONING 层级
最少繁忙两个以上选择活动请求最少的候选
最低延迟两个以上选择已观测响应延迟最低的候选

只有可路由的模型资源应进入候选池。优先选择健康状态明确的资源。

自动路由由 Lumoswitch Runtime 的 auto_router/complexity_router 执行,并启用会话亲和性。最少繁忙和最低延迟通过当前 Access Key 的 router_settings.routing_strategy 执行;切回固定、故障转移或自动路由时会清空旧的 Key 级策略。

3. 下游输出

配置下游客户端使用的一个或多个对外模型名称,并选择开放 OpenAI-compatible、Anthropic Messages 和/或 Gemini generateContent。三种格式都直达Lumoswitch 推理服务。

  • 对外模型名称:下游请求 model 字段使用的名称;一个配置最多可保存 20 个不重复名称。
  • 当前配置:该名称使用当前调度模式和全部候选模型。
  • 指定候选模型:该名称直接映射到一个候选资源,不经过配置级故障转移。

默认创建一个指向“当前配置”的对外模型。需要为不同客户端提供别名或显式开放单个候选时,可以继续添加映射。删除或修改现有名称前,应先更新所有下游客户端。

4. Access Key 限制

可选设置:

  • 每分钟请求数。
  • 允许的模型范围。

默认不额外限制请求频率。生产环境建议按应用容量设置明确上限。

5. 创建并保存 Key

提交后,Lumoswitch 创建配置并生成初始 Access Key。

完整 Access Key 仅在创建完成对话框中显示一次。丢失后无法从列表恢复明文,需要创建新 Key 或新配置。

编辑配置

编辑后,当前 Access Key 保留不变,新调度、输出和限制会立即影响后续调用。生产配置建议:

  1. 先确认新候选模型的健康状态。
  2. 保留至少一个已验证的回退资源。
  3. 最低延迟模式先用非生产流量预热观测数据,再在低流量时段切换。
  4. 低流量时段修改、删除或重定向现有对外模型名称。
  5. 保存后立即发起最小请求并查看仪表盘。

配置预设

配置编辑器中的“我的预设 / 官方预设 / 社区预设”读取真实的 Configuration Template 数据。应用前会按当前区域模型目录执行 preview;缺少必需模型时不会静默降级。个人预设支持保存不可变新版本、发布、收藏、fork、导入、脱敏导出和归档。

调用配置 API

curl "https://api.lumoswitch.com/v1/chat/completions" \
  -H "Authorization: Bearer YOUR_LUMOSWITCH_ACCESS_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "YOUR_CLIENT_FACING_MODEL_NAME",
    "messages": [
      {"role": "user", "content": "Hello"}
    ]
  }'

停用与删除

  • 停用:保留配置和历史关联,但对应 Key 无法继续调用。
  • 删除:撤销配置和对应 Key。已部署客户端将立即失去访问能力。

删除前请确认所有客户端已切换到新配置和 Key。

On this page