这个模型通常用来做什么
大规模处理、低延迟与需要自适应思考的通用任务
大规模处理、低延迟与需要自适应思考的通用任务。以下价格采用 Paid Standard 文本 作为默认展示口径。
大规模处理、低延迟与需要自适应思考的通用任务
Paid / Standard 文本、图片、视频输入价;Audio input 为 $1/MTok。输出价格包含 thinking tokens,缓存还会产生存储费。
不同 Prompt 长度、模态或服务等级可能采用不同费率。缓存存储费按 USD / 1M tokens / hour 展示。
| 条件 | Service Level | Modality | Prompt Tokens | Input | Cached | Output | Cache Storage / h |
|---|---|---|---|---|---|---|---|
| Standard 文本/图片/视频 | standard | text/image/video | 不按 Prompt 长度分档 | $0.3 | $0.03 | $2.5 | $1 |
| Standard 音频输入 | standard | audio | 不按 Prompt 长度分档 | $1 | $0.1 | $2.5 | $1 |
| Batch 文本/图片/视频 | batch | text/image/video | 不按 Prompt 长度分档 | $0.15 | $0.03 | $1.25 | $1 |
价格单位:USD / 1M tokens;存储列额外按小时计。计算器当前只覆盖默认标准文本费率,不会自动计入所有长上下文、多模态、区域或缓存存储条件。