Cara Model Ditagih
Mekanisme tagihan untuk model LLM, gambar, video, dan audio — harga token, harga per pembuatan, dan estimasi biaya
Halaman ini menjelaskan cara setiap jenis model dihargai dan kapan tepatnya saldo Anda dipotong. Untuk tarif terkini, lihat Halaman Harga atau halaman detail setiap model. Untuk perhitungan langkah demi langkah pada model yang umum, lihat Contoh Tagihan.
Model LLM (berbasis token)
Model LLM dihargai per juta token, dengan tarif terpisah untuk token input (prompt) dan output (completion):
Aturan harga tambahan yang berlaku untuk beberapa model:
- Token input yang di-cache — model yang mendukung prompt caching menagih token input berulang (yang di-cache) dengan tarif cache yang lebih rendah, yang dapat mengurangi biaya secara signifikan untuk system prompt yang panjang dan percakapan multi-giliran.
- Input multimodal — token input gambar atau audio dapat memiliki tarif tersendiri.
- Tingkatan konteks panjang — beberapa model mengenakan tarif lebih tinggi saat input melebihi ambang batas ukuran tertentu (misalnya, di atas 32K token input). Tingkatannya tercantum di halaman detail model.
- Harga per permintaan — sejumlah kecil model mengenakan harga tetap per permintaan alih-alih per token.
Cara kerja penagihan LLM:
- Anda ditagih setelah permintaan selesai, berdasarkan penggunaan token aktual yang dilaporkan di field
usagepada respons. Permintaan streaming dan non-streaming ditagih dengan cara yang sama. - Permintaan yang gagal dengan error dari penyedia tidak ditagih.
- Tagihan diselesaikan secara asinkron dan muncul di riwayat penggunaan Anda tak lama setelah permintaan.
Model gambar (per pembuatan)
Pembuatan gambar dihargai per gambar yang dihasilkan. Harga satuan bervariasi berdasarkan model dan dapat bergantung pada resolusi serta parameter permintaan lainnya. Meminta beberapa gambar akan menggandakan harga sesuai jumlahnya.
- Jumlah penuh dicadangkan dari saldo Anda saat Anda mengirimkan tugas dan ditagih ketika tugas berhasil. Jika tugas gagal, jumlah yang dicadangkan otomatis dilepaskan — lihat Pengembalian Dana & Tugas Gagal.
- Untuk endpoint batch, jika model menghasilkan lebih sedikit gambar dari yang diminta, Anda hanya ditagih untuk gambar yang benar-benar dihasilkan.
- Beberapa model gambar (misalnya, keluarga GPT Image) ditagih berbasis token seperti LLM, dengan tarif untuk token gambar input dan output yang ditampilkan di halaman model.
Alat gambar (upscaling, penghapusan latar belakang, pertukaran wajah, dll.) ditagih dengan cara yang sama, per operasi.
Model video (per pembuatan)
Sebagian besar model video dihargai dengan tarif per detik yang bergantung pada resolusi output:
Beberapa model menambahkan biaya per unit yang lebih kecil untuk input tambahan, seperti gambar referensi. Tarif per detik untuk setiap tingkat resolusi tercantum di halaman detail model. Seperti tugas gambar, jumlahnya dicadangkan saat pengiriman, ditagih saat berhasil, dan otomatis dilepaskan jika tugas gagal.
Model video berbasis token
Beberapa model video terbaru (misalnya, keluarga Seedance 2.x) ditagih berdasarkan jumlah video yang benar-benar dihasilkan, diukur dalam token video output:
- Tarif token adalah harga model per juta token video. Model yang menerima input video referensi dapat menerapkan tarif lebih rendah untuk permintaan yang menyertakannya.
- Pengali resolusi menskalakan biaya untuk tingkat output yang lebih tinggi (misalnya, 2K, 4K, atau varian super-resolusi) relatif terhadap tingkat dasar.
- Karena biaya akhir bergantung pada output yang dihasilkan, tagihan pasti dihitung saat tugas selesai. Penahanan sementara dalam jumlah kecil ditempatkan pada saldo Anda saat pengiriman dan dilepaskan segera setelah tugas ditagih.
- Tugas yang gagal tidak ditagih.
Model audio (per pembuatan)
Pembuatan audio ditagih per pembuatan. Unitnya bergantung pada model (misalnya, durasi output atau jumlah karakter) dan ditampilkan di halaman detail model.
Estimasi biaya sebelum membuat
Gunakan endpoint calculate untuk mendapatkan harga pasti dari permintaan gambar, video, atau audio sebelum mengirimkannya. Endpoint ini menerima body permintaan yang sama dengan endpoint pembuatan terkait dan tidak membuat tugas maupun memotong saldo Anda:
curl -X POST "https://api.atlascloud.ai/api/v1/model/calculate" \
-H "Authorization: Bearer your-api-key" \
-H "Content-Type: application/json" \
-d '{
"model": "bytedance/seedance-2.0/text-to-video",
"prompt": "A hummingbird hovering over a flower, macro shot",
"resolution": "1080p",
"duration": 5
}'Objek data pada respons berisi:
| Field | Deskripsi |
|---|---|
price | Jumlah yang akan ditagihkan kepada Anda, dengan diskon akun Anda diterapkan |
origin_price | Harga resmi sebelum diskon |
discount | Persentase harga resmi yang Anda bayar (100 = tanpa diskon, 70 = diskon 30%) |
estimated | Ada dan bernilai true untuk model berbasis token — harganya adalah estimasi berdasarkan resolusi dan durasi yang diminta |
estimated_tokens | Untuk model berbasis token, estimasi token video output |
Model berbasis token mengembalikan estimasi
Untuk model video berbasis token, /calculate mengembalikan estimasi yang diturunkan dari resolusi dan durasi yang diminta, serta (untuk permintaan reference-to-video) durasi video input Anda. Tagihan akhir dihitung dari output yang benar-benar dihasilkan dan mungkin sedikit berbeda.
Diskon
Diskon akun yang dinegosiasikan dan promosi model diterapkan secara otomatis — Anda tidak perlu menyertakan kupon saat mengirim permintaan. Endpoint /calculate selalu mengembalikan harga efektif Anda. Untuk harga volume, hubungi [email protected].
Ringkasan Tagihan
Cara kerja harga dan tagihan Atlas Cloud — bayar-sesuai-penggunaan untuk semua API Model
Contoh Tagihan
Contoh perhitungan harga untuk model LLM, video, gambar, dan audio yang umum — penagihan token LLM, video berbasis token, video per detik, per gambar, gambar berbasis token, dan audio berbasis karakter