So werden Modelle abgerechnet

Abrechnungsmechanik für LLM-, Bild-, Video- und Audiomodelle — Token-Preise, Preise pro Generierung und Kostenschätzung

Diese Seite erklärt, wie jeder Modelltyp bepreist wird und wann genau Ihr Guthaben belastet wird. Aktuelle Tarife finden Sie auf der Preisseite oder auf der Detailseite des jeweiligen Modells. Schritt-für-Schritt-Berechnungen für typische Modelle finden Sie unter Abrechnungsbeispiele.

LLM-Modelle (token-basiert)

LLM-Modelle werden pro Million Tokens bepreist, mit separaten Tarifen für Eingabe-Tokens (Prompt) und Ausgabe-Tokens (Completion):

Cost=Input Tokens1,000,000×Input Price+Output Tokens1,000,000×Output PriceCost = \frac{Input\ Tokens}{1{,}000{,}000} \times Input\ Price + \frac{Output\ Tokens}{1{,}000{,}000} \times Output\ Price

Zusätzliche Preisregeln, die für einige Modelle gelten:

  • Gecachte Eingabe-Tokens — Modelle mit Prompt-Caching berechnen wiederholte (gecachte) Eingabe-Tokens zu einem niedrigeren Cache-Tarif, was die Kosten bei langen System-Prompts und mehrstufigen Konversationen erheblich senken kann.
  • Multimodale Eingaben — Bild- oder Audio-Eingabe-Tokens können eigene Tarife haben.
  • Long-Context-Stufen — einige Modelle berechnen höhere Tarife, sobald die Eingabe eine Größenschwelle überschreitet (zum Beispiel über 32K Eingabe-Tokens). Die Stufen sind auf der Detailseite des Modells aufgeführt.
  • Preis pro Anfrage — eine kleine Anzahl von Modellen berechnet einen Pauschalpreis pro Anfrage statt pro Token.

So funktioniert die LLM-Abrechnung:

  • Die Berechnung erfolgt nach Abschluss der Anfrage, basierend auf der tatsächlichen Token-Nutzung, die im usage-Feld der Antwort ausgewiesen wird. Streaming- und Non-Streaming-Anfragen werden identisch abgerechnet.
  • Anfragen, die mit einem Anbieterfehler fehlschlagen, werden nicht abgerechnet.
  • Belastungen werden asynchron verbucht und erscheinen kurz nach der Anfrage in Ihrem Nutzungsverlauf.

Bildmodelle (pro Generierung)

Bildgenerierung wird pro generiertem Bild bepreist. Der Einzelpreis variiert je nach Modell und kann von der Auflösung und anderen Anfrageparametern abhängen. Werden mehrere Bilder angefordert, multipliziert sich der Preis entsprechend.

  • Der volle Betrag wird beim Einreichen der Aufgabe von Ihrem Guthaben reserviert und bei Erfolg der Aufgabe eingezogen. Schlägt die Aufgabe fehl, wird der reservierte Betrag automatisch freigegeben — siehe Erstattungen & fehlgeschlagene Aufgaben.
  • Liefert das Modell bei Batch-Endpunkten weniger Bilder als angefordert, zahlen Sie nur für die tatsächlich gelieferten Bilder.
  • Einige Bildmodelle (zum Beispiel die GPT-Image-Familie) werden wie LLMs token-basiert abgerechnet, mit Tarifen für Eingabe- und Ausgabe-Bild-Tokens auf der Modellseite.

Bild-Tools (Hochskalierung, Hintergrundentfernung, Gesichtstausch usw.) werden auf dieselbe Weise abgerechnet, pro Vorgang.

Videomodelle (pro Generierung)

Die meisten Videomodelle werden mit einem Sekundenpreis bepreist, der von der Ausgabeauflösung abhängt:

Cost=Rate(resolution)×Duration(seconds)Cost = Rate(resolution) \times Duration(seconds)

Einige Modelle berechnen kleinere Zusatzbeträge für zusätzliche Eingaben, etwa Referenzbilder. Die Sekundenpreise für die einzelnen Auflösungsstufen sind auf der Detailseite des Modells aufgeführt. Wie bei Bildaufgaben wird der Betrag beim Einreichen reserviert, bei Erfolg eingezogen und bei Fehlschlag automatisch freigegeben.

Token-basiert abgerechnete Videomodelle

Einige neuere Videomodelle (zum Beispiel die Seedance 2.x-Familie) werden nach der tatsächlich generierten Videomenge abgerechnet, gemessen in Ausgabe-Video-Tokens:

Cost=Video Tokens1,000,000×Token Rate×Resolution MultiplierCost = \frac{Video\ Tokens}{1{,}000{,}000} \times Token\ Rate \times Resolution\ Multiplier

Video TokensWidth×Height×FPS×Duration(seconds)1024Video\ Tokens \approx \frac{Width \times Height \times FPS \times Duration(seconds)}{1024}

  • Der Token-Tarif ist der Preis des Modells pro Million Video-Tokens. Modelle, die Referenzvideo-Eingaben akzeptieren, können für Anfragen mit Referenzvideo einen niedrigeren Tarif anwenden.
  • Der Auflösungsmultiplikator skaliert die Kosten für höhere Ausgabestufen (zum Beispiel 2K, 4K oder Super-Resolution-Varianten) relativ zur Basisstufe.
  • Da die endgültigen Kosten vom generierten Ergebnis abhängen, wird der genaue Betrag beim Abschluss der Aufgabe berechnet. Beim Einreichen wird eine kleine temporäre Sperre auf Ihr Guthaben gelegt und wieder freigegeben, sobald die Aufgabe abgerechnet ist.
  • Fehlgeschlagene Aufgaben werden nicht berechnet.

Audiomodelle (pro Generierung)

Audiogenerierung wird pro Generierung abgerechnet. Die Einheit hängt vom Modell ab (zum Beispiel Ausgabedauer oder Zeichenanzahl) und ist auf der Detailseite des Modells angegeben.

Kosten vor dem Generieren schätzen

Verwenden Sie den Calculate-Endpunkt, um den exakten Preis einer Bild-, Video- oder Audioanfrage vor dem Einreichen zu ermitteln. Er akzeptiert denselben Request-Body wie der entsprechende Generierungsendpunkt und erstellt weder eine Aufgabe noch belastet er Ihr Guthaben:

curl -X POST "https://api.atlascloud.ai/api/v1/model/calculate" \
  -H "Authorization: Bearer your-api-key" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "bytedance/seedance-2.0/text-to-video",
    "prompt": "A hummingbird hovering over a flower, macro shot",
    "resolution": "1080p",
    "duration": 5
  }'

Das data-Objekt der Antwort enthält:

FeldBeschreibung
priceDer Betrag, der Ihnen berechnet würde, mit angewendetem Kontorabatt
origin_priceDer Listenpreis vor Rabatt
discountProzentsatz des Listenpreises, den Sie zahlen (100 = kein Rabatt, 70 = 30 % Rabatt)
estimatedVorhanden und true bei token-basiert abgerechneten Modellen — der Preis ist eine Schätzung auf Basis der angeforderten Auflösung und Dauer
estimated_tokensBei token-basiert abgerechneten Modellen die geschätzten Ausgabe-Video-Tokens

Token-basiert abgerechnete Modelle liefern eine Schätzung

Für token-basiert abgerechnete Videomodelle gibt /calculate eine Schätzung zurück, die aus der angeforderten Auflösung, der Dauer und (bei Referenz-zu-Video-Anfragen) der Dauer Ihrer Eingabevideos abgeleitet wird. Der endgültige Betrag wird aus dem tatsächlich generierten Ergebnis berechnet und kann geringfügig abweichen.

Rabatte

Ausgehandelte Kontorabatte und Modellaktionen werden automatisch angewendet — Sie müssen zur Anfragezeit nie einen Gutschein übergeben. Der /calculate-Endpunkt gibt immer Ihren effektiven Preis zurück. Für Mengenpreise kontaktieren Sie [email protected].