这个模型通常用来做什么
复杂专业工作、代码工程与质量优先的推理任务
复杂专业工作、代码工程与质量优先的推理任务。以下价格采用 Standard 文本,输入 ≤272K 作为默认展示口径。
复杂专业工作、代码工程与质量优先的推理任务
当前 Standard 短上下文文本费率。输入超过 272K 后,整个请求的输入、Cached Input 与缓存写入价格为短上下文的 2 倍,输出为 1.5 倍;区域处理另加 10%。图片输入按视觉 Token 计费,计算器未覆盖。
不同 Prompt 长度、模态或服务等级可能采用不同费率。缓存存储费按 USD / 1M tokens / hour 展示。
| 条件 | Service Level | Modality | Prompt Tokens | Input | Cached | Output | Cache Storage / h |
|---|---|---|---|---|---|---|---|
| Standard 文本,输入 ≤272K | standard | text | 0–272,000 tokens | $5 | $0.5 | $30 | 不提供 |
| Standard 文本,输入 >272K | standard | text | 272,001–1,050,000 tokens | $10 | $1 | $45 | 不提供 |
| Batch 文本,输入 ≤272K | batch | text | 0–272,000 tokens | $2.5 | 不提供 | $15 | 不提供 |
价格单位:USD / 1M tokens;存储列额外按小时计。计算器当前只覆盖默认标准文本费率,不会自动计入所有长上下文、多模态、区域或缓存存储条件。