一、模型广场是什么
模型广场是用户发现、比较和开始使用模型的入口。
用户可以在这里完成:
- 查找模型;
- 了解模型适合的任务;
- 查看模型刊例价;
- 查看已配置档位的折后价;
- 识别折后价、全价或不可用模型;
- 打开模型详情;
- 复制调用示例;
- 查看模型监控信息。
模型广场只介绍国内服务。
二、如何选择模型
建议按照业务任务选择,而不是只看模型名称。
文本和对话任务
适合问答、总结、改写、内容生成和知识理解等场景。
代码任务
适合代码生成、解释、调试、重构和工程辅助等场景。
图片任务
适合图片生成、图片理解或图像处理等场景。
视频任务
适合视频生成、视频处理或视频理解等场景。
不同模型的输入、输出和计费方式可能不同,具体以模型详情页说明为准。
三、模型卡片展示什么
模型卡片用于快速比较,不承载所有详细信息。
卡片通常展示:
- 模型名称;
- 模型简介;
- 能力标签或可用状态提示;
- 当前模型的价格摘要;
- 服务档位折扣标签;
- 折后价、全价或不可用状态;
- 进入详情页的入口。
四、价格展示规则
1. 统一刊例价
所有客户看到的模型刊例价来自同一套模型价格基础。
刊例价是模型的基础价格,不随某个客户的折扣配置变化。
2. 有一个档位折扣
如果一个模型只有一个档位配置了折扣,卡片直接展示该档位的折后价和档位名称。
示例:
3. 有多个档位折扣
如果一个模型配置了多个档位折扣,卡片进行简化展示:
- 展示已配置档位中价格最低的折后价;
- 同时标记其他已配置档位的折扣信息;
- 其他档位的完整价格在详情页查看;
- 点击详情页查看每个档位的完整价格。
卡片上的最低价只是价格摘要,不代表当前 API Key 的实际调用价格。实际价格以 API Key 对应的服务档位和模型详情页为准。
4. 全价和不可用状态
模型广场根据账号是否存在任何生效的专属折扣展示状态。
账号没有任何生效的专属折扣
所有模型都可以使用。卡片和详情页展示统一刊例价,并标记“全价”。
账号已经配置过一个或多个模型折扣
当前模型在当前 API Key 档位配置了折扣时,展示该档位折后价并可以调用。当前档位没有配置折扣时,模型标记“不可用”,不能调用,即使该模型在其他档位已经配置折扣也一样。
“全价”和“不可用”不是同一状态:前者只适用于账号完全没有任何生效专属折扣的情况;账号一旦存在折扣,当前模型在当前档位无折扣就是“不可用”。模型没有可用服务链路时同样不可调用。
五、模型筛选和搜索
模型广场可以通过搜索和筛选缩小模型范围。
建议用户结合以下条件筛选:
- 模型名称;
- 模型能力或使用场景;
- 是否有折扣;
- 服务档位;
- 是否为全价;
- 当前可用状态。
“是否有折扣”建议提供“全部 / 有折扣 / 无折扣”三个选项。账号没有任何生效专属折扣时,所有模型都属于“无折扣”,页面状态为“全价”;账号已经配置过任意模型折扣时,必须按照当前服务档位判断:当前模型在该档位有折扣则属于“有折扣”并可用,没有折扣则属于“无折扣”并显示“不可用”。其他档位的折扣不影响当前档位状态。
六、模型详情页
点击模型卡片后进入模型详情页。
模型详情页用于在真正调用前完成确认,通常包含以下内容。
1. 基础信息
- 模型名称;
- 模型标识;
- 模型生产方或能力说明;
- 模型描述;
- 适用场景。
2. 价格信息
刊例价只展示一次,因为所有档位共用同一套刊例价。
已配置折扣的档位拆分展示:
- 经济型折后价;
- 标准型折后价;
- 高质量型折后价。
如果某个档位没有配置折扣,则不展示该档位折后价。
页面同时提示:
示例:
| 价格项目 | 展示内容 |
|---|---|
| 刊例价 | ¥ X / M Tokens |
| 经济型折后价 | ¥ Y / M Tokens |
| 标准型折后价 | 未配置时不可用 |
| 高质量型折后价 | ¥ Z / M Tokens |
| 无折扣提示 | 账号无任何专属折扣时显示“全价”;账号已有折扣且当前模型在当前档位无折扣时显示“不可用” |
3. 接入和计费说明
详情页可以展示模型支持的输入、输出、缓存、图片、视频或其他计费项目。
计费项目因模型而异,详情页会展示当前模型支持的计费单位和计费说明。
4. 调用示例
模型详情页提供可复制的调用示例,例如:
- cURL;
- Python;
- 其他支持的调用方式。
复制调用示例时,可以选择已经创建的 API Key。
七、模型监控
模型详情页提供“监控”入口,用于查看当前模型的调用情况。
模型监控关注单个模型的调用表现和服务状态;用量统计关注账号、API Key、模型和时间范围内的资源消耗。
监控页面会展示当前时间范围和最近更新时间,用户可以结合时间范围观察模型表现变化。
监控页面可以帮助用户判断模型当前是否适合继续使用,通常关注:
- Token 总量;
- 图片生成数量;
- 成功率;
- 错误率;
- 请求次数;
- 端到端延迟;
- Token 使用趋势;
- 成功率趋势;
- 错误率趋势;
- 请求次数趋势;
- 延迟趋势。
监控页面展示当前模型的调用表现。
如果某个模型当前调用异常,用户可以:
- 查看错误率和延迟变化;
- 检查请求参数和 API Key;
- 结合业务要求判断是否需要更换模型;
- 对正式业务优先使用高质量型 API Key。
八、模型可用性和服务档位
用户能够调用的模型,取决于当前 API Key 对应的服务档位和账号可用范围。
需要注意:
- 账号没有任何生效专属折扣时,所有模型按全价可用;账号已有专属折扣时,当前模型在当前 API Key 档位无折扣即不可用;
- API Key 绑定一个档位;
- 当前档位不可用时不会自动跨档位切换;
- 需要更稳定的服务链路时,应使用高质量型 API Key;
- 模型的实际调用方式以详情页最新示例为准。



