GPT-6.1 Sol 在 Responses API 上线 Ultrafast 模式,价格是标准档的 6 倍
用钱换速度:同一个模型,按请求选择更快的输出档位。
// 要点
- 调用 gpt-6.1-sol 时设 service_tier: "ultrafast",缩短生成 token 之间的间隔。
- 面向所有 API 用户开放(受速率限制),支持全球处理以及美国、欧盟数据驻留。
- 定价(输入不超过 272K token,每百万 token):Ultrafast 输入 12 美元、缓存输入 0.60 美元、输出 60 美元;标准档分别为 2 美元、0.10 美元、10 美元。
开发者视角6 倍价格只值得花在用户盯着屏幕等的那一步,比如智能面试里的实时追问;后台批处理没必要。因为是按请求选档,我会只在这一条链路上开,先对比首字和整段耗时,再算一场面试多花多少钱。