这个模型通常用来做什么
预算敏感的高频提取、分类、路由与轻量自动化
预算敏感的高频提取、分类、路由与轻量自动化。以下价格采用 Standard 文本,输入 ≤272K 作为默认展示口径。
预算敏感的高频提取、分类、路由与轻量自动化
采用当前 API 文档价格;发布稿仍显示历史价格 $1/$6。输入超过 272K 后,整个请求的输入侧价格为 2 倍、输出为 1.5 倍。
不同 Prompt 长度、模态或服务等级可能采用不同费率。缓存存储费按 USD / 1M tokens / hour 展示。
| 条件 | Service Level | Modality | Prompt Tokens | Input | Cached | Output | Cache Storage / h |
|---|---|---|---|---|---|---|---|
| Standard 文本,输入 ≤272K | standard | text | 0–272,000 tokens | $0.2 | $0.02 | $1.2 | 不提供 |
| Standard 文本,输入 >272K | standard | text | 272,001–1,050,000 tokens | $0.4 | $0.04 | $1.8 | 不提供 |
| Batch 文本,输入 ≤272K | batch | text | 0–272,000 tokens | $0.1 | 不提供 | $0.6 | 不提供 |
价格单位:USD / 1M tokens;存储列额外按小时计。计算器当前只覆盖默认标准文本费率,不会自动计入所有长上下文、多模态、区域或缓存存储条件。