统一接口调用不同厂商模型。模型版本、价格和可用状态会随上游变化,以控制台实时信息为准。
优先选择推理和代码能力更强的模型,并为长任务设置更宽松的超时时间。
根据质量要求选择更经济的模型,同时限制最大输出 Token,控制单次成本。
不要只依赖一个模型。为超时、限流和上游波动设计重试、降级与告警策略。
公开目录只展示常用示例,完整模型标识和当前状态请登录控制台查看。