一、模型广场是什么

模型广场是用户发现、比较和开始使用模型的入口。

用户可以在这里完成:

  • 查找模型;
  • 了解模型适合的任务;
  • 查看模型刊例价;
  • 查看已配置档位的折后价;
  • 识别折后价、全价或不可用模型;
  • 打开模型详情;
  • 复制调用示例;
  • 查看模型监控信息。

模型广场只介绍国内服务。

二、如何选择模型

建议按照业务任务选择,而不是只看模型名称。

文本和对话任务

适合问答、总结、改写、内容生成和知识理解等场景。

代码任务

适合代码生成、解释、调试、重构和工程辅助等场景。

图片任务

适合图片生成、图片理解或图像处理等场景。

视频任务

适合视频生成、视频处理或视频理解等场景。

不同模型的输入、输出和计费方式可能不同,具体以模型详情页说明为准。

三、模型卡片展示什么

模型卡片用于快速比较,不承载所有详细信息。

卡片通常展示:

  • 模型名称;
  • 模型简介;
  • 能力标签或可用状态提示;
  • 当前模型的价格摘要;
  • 服务档位折扣标签;
  • 折后价、全价或不可用状态;
  • 进入详情页的入口。

四、价格展示规则

1. 统一刊例价

所有客户看到的模型刊例价来自同一套模型价格基础。

刊例价是模型的基础价格,不随某个客户的折扣配置变化。

2. 有一个档位折扣

如果一个模型只有一个档位配置了折扣,卡片直接展示该档位的折后价和档位名称。

示例:

MiniMax M2.5 刊例价:¥0.42 / M Tokens 标准型:¥0.294 / M Tokens

3. 有多个档位折扣

如果一个模型配置了多个档位折扣,卡片进行简化展示:

  • 展示已配置档位中价格最低的折后价;
  • 同时标记其他已配置档位的折扣信息;
  • 其他档位的完整价格在详情页查看;
  • 点击详情页查看每个档位的完整价格。

卡片上的最低价只是价格摘要,不代表当前 API Key 的实际调用价格。实际价格以 API Key 对应的服务档位和模型详情页为准。

4. 全价和不可用状态

模型广场根据账号是否存在任何生效的专属折扣展示状态。

账号没有任何生效的专属折扣

所有模型都可以使用。卡片和详情页展示统一刊例价,并标记“全价”。

账号已经配置过一个或多个模型折扣

当前模型在当前 API Key 档位配置了折扣时,展示该档位折后价并可以调用。当前档位没有配置折扣时,模型标记“不可用”,不能调用,即使该模型在其他档位已经配置折扣也一样。

“全价”和“不可用”不是同一状态:前者只适用于账号完全没有任何生效专属折扣的情况;账号一旦存在折扣,当前模型在当前档位无折扣就是“不可用”。模型没有可用服务链路时同样不可调用。

五、模型筛选和搜索

模型广场可以通过搜索和筛选缩小模型范围。

建议用户结合以下条件筛选:

  • 模型名称;
  • 模型能力或使用场景;
  • 是否有折扣;
  • 服务档位;
  • 是否为全价;
  • 当前可用状态。

“是否有折扣”建议提供“全部 / 有折扣 / 无折扣”三个选项。账号没有任何生效专属折扣时,所有模型都属于“无折扣”,页面状态为“全价”;账号已经配置过任意模型折扣时,必须按照当前服务档位判断:当前模型在该档位有折扣则属于“有折扣”并可用,没有折扣则属于“无折扣”并显示“不可用”。其他档位的折扣不影响当前档位状态。

六、模型详情页

点击模型卡片后进入模型详情页。

模型详情页用于在真正调用前完成确认,通常包含以下内容。

1. 基础信息

  • 模型名称;
  • 模型标识;
  • 模型生产方或能力说明;
  • 模型描述;
  • 适用场景。

2. 价格信息

刊例价只展示一次,因为所有档位共用同一套刊例价。

已配置折扣的档位拆分展示:

  • 经济型折后价;
  • 标准型折后价;
  • 高质量型折后价。

如果某个档位没有配置折扣,则不展示该档位折后价。

页面同时提示:

示例:

价格项目展示内容
刊例价¥ X / M Tokens
经济型折后价¥ Y / M Tokens
标准型折后价未配置时不可用
高质量型折后价¥ Z / M Tokens
无折扣提示账号无任何专属折扣时显示“全价”;账号已有折扣且当前模型在当前档位无折扣时显示“不可用”

3. 接入和计费说明

详情页可以展示模型支持的输入、输出、缓存、图片、视频或其他计费项目。

计费项目因模型而异,详情页会展示当前模型支持的计费单位和计费说明。

4. 调用示例

模型详情页提供可复制的调用示例,例如:

  • cURL;
  • Python;
  • 其他支持的调用方式。

复制调用示例时,可以选择已经创建的 API Key。

七、模型监控

模型详情页提供“监控”入口,用于查看当前模型的调用情况。

模型监控关注单个模型的调用表现和服务状态;用量统计关注账号、API Key、模型和时间范围内的资源消耗。

监控页面会展示当前时间范围和最近更新时间,用户可以结合时间范围观察模型表现变化。

监控页面可以帮助用户判断模型当前是否适合继续使用,通常关注:

  • Token 总量;
  • 图片生成数量;
  • 成功率;
  • 错误率;
  • 请求次数;
  • 端到端延迟;
  • Token 使用趋势;
  • 成功率趋势;
  • 错误率趋势;
  • 请求次数趋势;
  • 延迟趋势。

监控页面展示当前模型的调用表现。

如果某个模型当前调用异常,用户可以:

  1. 查看错误率和延迟变化;
  2. 检查请求参数和 API Key;
  3. 结合业务要求判断是否需要更换模型;
  4. 对正式业务优先使用高质量型 API Key。

八、模型可用性和服务档位

用户能够调用的模型,取决于当前 API Key 对应的服务档位和账号可用范围。

需要注意:

  • 账号没有任何生效专属折扣时,所有模型按全价可用;账号已有专属折扣时,当前模型在当前 API Key 档位无折扣即不可用;
  • API Key 绑定一个档位;
  • 当前档位不可用时不会自动跨档位切换;
  • 需要更稳定的服务链路时,应使用高质量型 API Key;
  • 模型的实际调用方式以详情页最新示例为准。

九、推荐的模型选择顺序

先看任务类型 ↓ 再看模型能力说明 ↓ 查看刊例价和档位价格 ↓ 确认 API Key 对应档位 ↓ 打开详情页查看示例 ↓ 先进行简单调用验证 ↓ 再接入正式业务

相关文档

联系我们
预约咨询
微信咨询
电话咨询
邮件咨询