模型如何计费

LLM、图像、视频和音频模型的计费机制——token 定价、按次生成定价与费用预估

本页说明各类模型的定价方式,以及余额扣费的确切时机。当前费率请查看定价页面或各模型的详情页。典型模型的分步计算示例,请参阅计费示例

LLM 模型(按 token 计费)

LLM 模型按百万 token 定价,输入(提示词)和输出(补全)token 分别有各自的费率:

Cost=Input Tokens1,000,000×Input Price+Output Tokens1,000,000×Output PriceCost = \frac{Input\ Tokens}{1{,}000{,}000} \times Input\ Price + \frac{Output\ Tokens}{1{,}000{,}000} \times Output\ Price

部分模型还适用以下附加定价规则:

  • 缓存输入 token——支持提示词缓存的模型对重复(命中缓存)的输入 token 按更低的缓存费率计费,可显著降低长系统提示词和多轮对话的成本。
  • 多模态输入——图像或音频输入 token 可能有独立的费率。
  • 长上下文档位——少数模型在输入超过一定规模阈值(例如超过 32K 输入 token)后按更高费率计费。具体档位见模型详情页。
  • 按请求计费——极少数模型按每次请求收取固定价格,而非按 token 计费。

LLM 的扣费方式:

  • 费用在请求完成后扣除,依据响应 usage 字段中报告的实际 token 用量。流式和非流式请求的计费方式完全相同。
  • 因供应商错误而失败的请求不会计费
  • 费用异步结算,请求完成后会很快出现在你的用量记录中。

图像模型(按次生成计费)

图像生成按生成的每张图像定价。单价因模型而异,并可能取决于分辨率和其他请求参数。请求多张图像时价格会相应倍增。

  • 提交任务时,全额费用会从你的余额中预留,任务成功后正式扣除。如果任务失败,预留金额会自动释放——参阅退款与失败任务
  • 对于批量端点,如果模型实际交付的图像少于请求数量,只按实际交付的图像收费。
  • 部分图像模型(例如 GPT Image 系列)像 LLM 一样按 token 计费,输入和输出图像 token 的费率见模型页面。

图像工具(放大、背景移除、换脸等)的计费方式相同,按次操作计费。

视频模型(按次生成计费)

大多数视频模型采用取决于输出分辨率的每秒费率定价:

Cost=Rate(resolution)×Duration(seconds)Cost = Rate(resolution) \times Duration(seconds)

部分模型会对额外输入(例如参考图像)收取少量的按件费用。各分辨率档位的每秒费率见模型详情页。与图像任务一样,费用在提交时预留,成功后扣除,任务失败时自动释放。

按 token 计费的视频模型

部分较新的视频模型(例如 Seedance 2.x 系列)按实际生成的视频量计费,以输出视频 token 为计量单位:

Cost=Video Tokens1,000,000×Token Rate×Resolution MultiplierCost = \frac{Video\ Tokens}{1{,}000{,}000} \times Token\ Rate \times Resolution\ Multiplier

Video TokensWidth×Height×FPS×Duration(seconds)1024Video\ Tokens \approx \frac{Width \times Height \times FPS \times Duration(seconds)}{1024}

  • token 费率是模型每百万视频 token 的价格。支持参考视频输入的模型,对包含参考视频的请求可能适用更低的费率。
  • 分辨率乘数按更高输出档位(例如 2K、4K 或超分辨率变体)相对基础档位的比例缩放费用。
  • 由于最终费用取决于实际生成的输出,确切金额在任务完成时计算。提交时会在你的余额上临时冻结一小笔金额,任务完成计费后立即释放。
  • 失败的任务不会计费。

音频模型(按次生成计费)

音频生成按次计费。计费单位因模型而异(例如输出时长或字符数),具体见模型详情页。

提交前预估费用

使用 calculate 端点可以在提交之前获取图像、视频或音频请求的精确价格。它接受与对应生成端点相同的请求体,不会创建任务,也不会扣费:

curl -X POST "https://api.atlascloud.ai/api/v1/model/calculate" \
  -H "Authorization: Bearer your-api-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "bytedance/seedance-2.0/text-to-video",
    "prompt": "A hummingbird hovering over a flower, macro shot",
    "resolution": "1080p",
    "duration": 5
  }'

响应的 data 对象包含:

字段说明
price应用账户折扣后你将被收取的金额
origin_price折扣前的标价
discount你实际支付的标价百分比(100 = 无折扣,70 = 七折)
estimated按 token 计费的模型会返回 true——价格是基于请求的分辨率和时长的估算值
estimated_tokens按 token 计费的模型返回的预估输出视频 token 数

按 token 计费的模型返回的是估算值

对于按 token 计费的视频模型,/calculate 返回的估算值基于请求的分辨率、时长以及(参考视频生视频请求的)输入视频时长。最终费用按实际生成的输出计算,可能会略有差异。

折扣

协商的账户折扣和模型促销会自动应用——你无需在请求时传递任何优惠券。/calculate 端点始终返回你的实际生效价格。批量定价请联系 [email protected]