这个模型通常用来做什么
低延迟代码补全、Fill-in-the-Middle 与代码生成
低延迟代码补全、Fill-in-the-Middle 与代码生成。以下价格采用 Standard 文本 作为默认展示口径。
低延迟代码补全、Fill-in-the-Middle 与代码生成
Cached Input 为 Standard Input 的 10%;Batch 为标准价 50%。支持 Fill-in-the-Middle;上下文上限同时包含 Input 与 Output Tokens。
不同 Prompt 长度、模态或服务等级可能采用不同费率。缓存存储费按 USD / 1M tokens / hour 展示。
| 条件 | Service Level | Modality | Prompt Tokens | Input | Cached | Output | Cache Storage / h |
|---|---|---|---|---|---|---|---|
| Standard 文本 | standard | text | 不按 Prompt 长度分档 | $0.3 | $0.03 | $0.9 | 不提供 |
| Batch 文本 | batch | text | 不按 Prompt 长度分档 | $0.15 | 不提供 | $0.45 | 不提供 |
价格单位:USD / 1M tokens;存储列额外按小时计。计算器当前只覆盖默认标准文本费率,不会自动计入所有长上下文、多模态、区域或缓存存储条件。