Pembanding Harga API AI

Bandingkan biaya OpenAI, Anthropic, Google, DeepSeek, dan 10 penyedia lainnya — 20 model diurutkan dari termurah. Masukkan token bulanan Anda dan lihat langsung biaya bulanan dan tahunan tiap API.

Kalkulator biaya API LLM gratis

Harga model dinyatakan dalam USD per juta token, format yang universal. Kalkulator interaktif dalam bahasa Inggris, tetapi berfungsi untuk semua beban kerja: cukup masukkan angka Anda dan bandingkan hasilnya.

Buka kalkulator

Cara kerja kalkulator

Biaya bulanan = (token masuk ÷ 1M × harga masuk) + (token keluar ÷ 1M × harga keluar). Biaya tahunan adalah angka bulanan × 12.

1

Masukkan penggunaan token Anda

Atur token masuk dan keluar bulanan estimasi Anda dengan slider, atau ketik angka pastinya. Default dimulai dari 1M masuk dan 500K keluar.

2

Pilih beban kerja

Pilih Chat, Kode, Visi, atau Reasoning. Rekomendasi nilai terbaik hanya memfilter model yang benar-benar mendukung kemampuan tersebut.

3

Bandingkan setiap model

Lihat biaya bulanan dan tahunan setiap model yang diurutkan dari termurah, dengan nilai terbaik disorot untuk beban kerja Anda.

Pertanyaan yang sering diajukan

Bagaimana biaya API LLM bulanan dihitung?

Biaya bulanan = (token masuk ÷ 1.000.000) × harga masuk + (token keluar ÷ 1.000.000) × harga keluar. Kalkulator mengalikan token bulanan estimasi Anda dengan tarif tiap model, lalu mengubahnya menjadi biaya tahunan dengan dikalikan 12.

API LLM mana yang paling murah?

Tergantung beban kerja dan komposisi token Anda. Model ekonomis seperti Gemini 2.0 Flash, Mistral Small, dan Amazon Nova Lite menawarkan tarif per juta token terendah, sementara model reasoning jauh lebih mahal. Masukkan volume token Anda yang sebenarnya untuk melihat opsi termurah untuk penggunaan spesifik Anda.

Mengapa token masuk dan keluar memiliki harga berbeda?

Token keluar dihasilkan satu per satu selama proses decoding, yang membutuhkan komputasi lebih besar daripada membaca prompt masuk. Karena itu harga keluar biasanya 2–5 kali lebih tinggi daripada harga masuk pada model yang sama. Beban kerja yang menghasilkan banyak keluaran sangat sensitif terhadap tarif keluar.

Bagaimana cara kerja rekomendasi nilai terbaik?

Untuk beban kerja yang dipilih (Chat, Kode, Visi, atau Reasoning), kalkulator memfilter model yang mendukung kemampuan tersebut dan menyoroti model dengan biaya bulanan terendah. Jika tidak ada model yang mendeklarasikan kemampuan itu, kalkulator jatuh ke model termurah secara keseluruhan.

Apakah harga ini akurat?

Semua angka adalah estimasi yang dikumpulkan dari harga publik dan mungkin tertinggal dari tarif resmi. Gunakan untuk perencanaan dan perbandingan, lalu konfirmasi di halaman harga penyedia sebelum berkomitmen.

Apakah kalkulator memperhitungkan prompt caching dan diskon batch?

Ya. Aktifkan “Prompt caching” untuk menerapkan tarif masuk ter-cache (10–50 % dari tarif standar di OpenAI, Anthropic, dan Google), atau “Batch API” untuk menerapkan diskon 50 % dengan waktu pemrosesan 24 jam. Tabel perbandingan dan rekomendasi nilai terbaik dihitung ulang secara instan.

Bahasa