GPT-6.1 Sol 官方 API 文本 token 定价,按每 100 万 token 算:
- 标准档:输入 $2,缓存输入 $0.10,缓存写入 $2.50,输出 $10。
- 长上下文:单次请求输入超过 272K token,不是只对超出的部分加价,而是整次请求的输入和缓存费率都按 2 倍算,输出按 1.5 倍算。
- Fast 模式:在标准价基础上整体 2 倍。
- Batch / Flex:比标准价低 50%,也就是半价。
- 区域处理:部分可用地区会额外加 10%。
注意几个坑:模型 ID 是 gpt-6.1-sol;缓存输入和缓存写入是分开计费的;长上下文的倍率是全请求生效,别以为只算超过 272K 的那一截;Fast、Batch/Flex、区域加价这些档位要按你的实际调用方式叠加看。文本之外的模态定价不在这个口径里,别混着算。