同一个平台可能有多个分组。倍率只是计费系数,不等于模型质量、速度或稳定性。更稳妥的顺序是:先确认模型和客户端兼容,再比较分组。
第一步:先确认模型
打开模型广场,复制需要的模型 ID,并查看它当前出现在哪些分组。不要只凭分组名称猜测模型范围;模型映射和可用性可能动态调整。
第二步:比较四个维度
| 维度 | 需要确认什么 | 为什么重要 |
|---|---|---|
| 模型范围 | 目标模型是否在该分组中 | 避免模型不存在或被映射到其他模型 |
| 分组倍率 | 基础费用最终乘以多少 | 决定同等用量下的站内余额扣除 |
| 实时状态 | 负载、可用性和失败情况 | 长任务比短测试更依赖稳定连接 |
| 使用限制 | 是否限定客户端、模型或调用方式 | 避免接口兼容但分组规则不匹配 |
推荐选择路径
- 首次测试:先选支持目标模型、倍率较低且当前可用的分组,用短请求验证配置。
- 日常使用:结合控制台的成功率、速度和实际扣费,保留一个主分组和一个备用分组。
- 长任务或高并发:优先考虑稳定性和额度,不要只看最低倍率。
- 企业或固定质量要求:选择说明明确、限制匹配的分组,并在正式上量前做小批量验证。
调用前的 30 秒检查
- 模型 ID 来自当前模型广场,而不是旧教程或截图。
- API Key 所属分组支持这个模型和客户端。
- Base URL 使用唯一推荐域名
llm.ciyuanmax.art。 - 先发一个短请求,确认响应、用量和扣费记录都正常。