Jawaban langsung: Jev menagih token masuk saja, 0,042 USD per 1 juta token, dan token keluar gratis. Biaya 1 jalan sama dengan jumlah token masuk seluruh permintaan dikali 0,042 dibagi 1 juta. Audit kami memakai 287 panggilan dan 222.946 token masuk, sehingga tagihannya 0,0094 USD, sekitar Rp 155.

Kondisi utama: angka ini berlaku untuk model jev-1.13 pada 21 September 2026. Batas: harga dapat berubah, dan ukuran state Anda yang menentukan tagihan akhir, bukan jumlah pertanyaan.

Kami menulis panduan ini dari halaman harga resmi TypeSafe dan dari jalan nyata kami sendiri pada 20 September 2026. Angka token berasal dari kolom usage pada jawaban, bukan dari perkiraan.

Yang dihitung dan yang tidak

Model generatif menagih 2 sisi: token yang masuk dan token yang keluar. Jev hanya menagih 1 sisi.

BagianDitagihCatatan
StateYaIsi yang dinilai, dihitung 1 kali per permintaan
Instruksi pertanyaanYaTermasuk kriteria tiap opsi
Jawaban yang kembaliTidakToken keluar gratis
Nama kunci pertanyaanTidakTidak dikirim ke model

Karena token keluar gratis, pertanyaan yang mengembalikan sebaran peluang panjang tidak menambah tagihan. Yang menambah tagihan hanyalah teks yang Anda kirim.

Diagram rumus biaya Jev dalam 3 langkah: hitung token 1 permintaan, kalikan jumlah permintaan, lalu kalikan 0,042 USD per 1 juta token, dengan contoh audit nyata
Rumus 3 langkah, lalu angka nyata dari audit 20 September 2026: 287 panggilan, 222.946 token masuk, 0,0094 USD.

Rumus dan contoh hitungan

Ambil jumlah token masuk dari jawaban, lalu kalikan harganya. Kode berikut melakukannya untuk 1 jalan penuh.

# 1 permintaan, 12 pertanyaan, 1 kali biaya state
total_token = 0
for hasil in jawaban:
    total_token += hasil["usage"]["input_tokens"]

biaya_usd = total_token * 0.042 / 1_000_000
print(f"{total_token} token masuk, {biaya_usd:.4f} USD")

Contoh kecil. Satu balasan chat sepanjang 800 token masuk berharga 0,0000336 USD. Seribu balasan sejenis berharga 0,0336 USD, di bawah Rp 600.

Contoh kami sendiri. Audit 227 sesi memakai 12 pertanyaan per percakapan, 5 pertanyaan per balasan, dan 3 pertanyaan per catatan sesi. Totalnya 1.100 pertanyaan pada 287 panggilan, memakan 222.946 token masuk, dan berhenti pada 0,0094 USD.

Biaya untuk 1.000 keputusan

Tabel berikut memakai 3 ukuran state yang kami temui sendiri. Angkanya perkiraan, dan ukuran permintaan Anda menentukan hasil akhirnya.

Tabel biaya untuk 1.000 catatan pada 3 ukuran state: 300 token, 800 token, dan 3.000 token, dengan biaya 0,0126 sampai 0,1260 USD
Biaya mengikuti ukuran state, bukan jumlah pertanyaan. Menumpuk pertanyaan pada 1 permintaan menahan biaya state agar dihitung 1 kali.
Jenis stateToken per catatan1.000 catatanBiaya
Catatan pendek, misalnya metadata sesi300300.000 token0,0126 USD
Satu balasan chat800800.000 token0,0336 USD
Percakapan penuh3.0003.000.000 token0,1260 USD

Perhatikan bahwa 3 baris di atas memakai jumlah pertanyaan yang sama. Yang berbeda hanya ukuran bahan yang dikirim.

Empat cara menekan tagihan

  • Tumpuk pertanyaan pada 1 permintaan. Biaya state dihitung 1 kali, jadi 12 pertanyaan pada 1 panggilan jauh lebih murah daripada 12 panggilan. Sumber: pola fan-out.
  • Saring state lebih dulu. Kirim bagian yang dibutuhkan pertanyaan, bukan seluruh riwayat. Ini menurunkan biaya dan menaikkan mutu jawaban.
  • Pakai bentuk tertutup, bukan kalimat panjang. Objek JSON pendek memakai token lebih sedikit daripada narasi yang sama isinya.
  • Saring dengan kode sebelum memanggil model. Catatan yang jelas tidak relevan tidak perlu dinilai model sama sekali.

Pada audit kami, pilihan menumpuk 12 pertanyaan pada 1 panggilan menahan jumlah panggilan pada 287, bukan lebih dari 1.000.

Batas laju dan konteks

BatasNilai
Token per detik250.000
Permintaan per menit1.200
Konteks 1 permintaan64k token
State plus pertanyaan terpanjang32k token

Permintaan yang melewati batas laju menerima status 429. SDK resmi mengulang dengan jeda bertambah dan membaca header retry-after. Sumber: halaman models TypeSafe.

Pada audit kami, 8 sampai 12 permintaan serentak tidak pernah menyentuh batas itu.

Membandingkan biaya dengan pekerjaan manusia

Perbandingan yang adil bukan melawan model lain, melainkan melawan cara lama. Membaca 227 percakapan dengan tangan memakan waktu berjam-jam, dan penilaian berubah setelah percakapan ke-20.

Jalan mesin memakan 20,8 detik dan 0,0094 USD, dengan rubrik yang sama untuk seluruh antrean. Cerita lengkapnya ada pada panduan audit percakapan dengan Jev.

Rekomendasi Rama Digital: hitung biaya per keputusan, bukan biaya per bulan. Angka per keputusan yang di bawah 1 sen membuat Anda berani memasang penjaga pada tiap giliran.

Bagian mana yang membuat 1 permintaan menjadi mahal

Satu permintaan memuat 3 bagian yang ditagih. Memahami porsinya membuat Anda tahu bagian mana yang layak dipangkas.

BagianPorsi khasCara memangkas
State70% sampai 90%Saring isinya, kirim bidang yang dipakai pertanyaan saja
Instruksi pertanyaan5% sampai 20%Tulis 1 kalimat yang tepat, bukan 1 paragraf
Kriteria opsi5% sampai 15%Pakai kalimat pendek untuk tiap opsi, bukan contoh panjang

Porsi di atas berasal dari permintaan kami sendiri pada audit 20 September 2026. Bila state Anda berupa percakapan panjang, porsinya bergeser lebih jauh ke state.

Satu pola menghemat paling banyak: jangan mengirim percakapan penuh untuk menilai 1 balasan. Kirim pertanyaan pengunjung dan balasan yang dinilai saja. Pada audit kami, permintaan tingkat balasan memakai sekitar 800 token, sedangkan permintaan tingkat percakapan memakai sampai 3.000 token.

Anggaran untuk 3 ukuran bisnis

Tiga skenario berikut memakai ukuran state 800 token per keputusan. Angkanya perkiraan bulanan, dan ukuran catatan Anda menentukan hasil akhirnya.

SkenarioKeputusan per bulanToken masukBiaya per bulan
Toko kecil, 1 kanal chat3.0002,4 juta0,10 USD
Bisnis menengah, 3 kanal30.00024 juta1,01 USD
Agensi, 20 klien300.000240 juta10,08 USD

Perhatikan bahwa skenario agensi tetap berada di bawah 11 USD per bulan. Pada ukuran ini, biaya bukan lagi pertimbangan utama; mutu rubrik yang menentukan hasilnya.

Kesalahan hitung yang sering terjadi

Tiga kesalahan berikut membuat perkiraan meleset jauh, dan seluruhnya mudah dihindari.

  • Menghitung per pertanyaan, bukan per permintaan. Dua belas pertanyaan pada 1 panggilan memakai 1 kali biaya state, bukan 12 kali.
  • Lupa menghitung kriteria. Daftar opsi yang panjang ikut menjadi token masuk, jadi opsi dengan contoh panjang menaikkan tagihan tiap permintaan.
  • Memakai perkiraan kata, bukan token. Satu kata bahasa Indonesia sering menjadi lebih dari 1 token, jadi bacalah kolom usage, bukan jumlah kata.

Cara paling aman tetap sama: jalankan 10 catatan contoh, baca angka nyatanya, lalu kalikan. Perkiraan dari 10 catatan memberi gambaran yang jauh lebih dekat daripada hitungan di atas kertas.

Satu hal lagi yang mudah terlewat. Catatan yang gagal diproses tetap memakai token masuk, karena teksnya sudah terkirim. Jadi saring catatan kosong dan catatan rusak dengan kode sebelum permintaan dibuat.

Pertanyaan yang sering muncul

Apakah ada biaya bulanan? Halaman harga resmi hanya menyebut harga per token masuk. Periksa halaman itu sebelum Anda menyusun anggaran, karena harga dapat berubah.

Mengapa token keluar gratis? Jev tidak menghasilkan teks. Keluarannya hanya angka dan pilihan, sehingga panjangnya kecil dan tetap.

Bagaimana menghitung biaya sebelum menjalankan? Kirim 10 catatan contoh, baca usage.input_tokens, lalu kalikan dengan jumlah catatan Anda. Perkiraan itu meleset kecil bila ukuran catatan Anda seragam.

Apakah pertanyaan tambahan menambah biaya? Menambah pertanyaan menambah token instruksi, dan itu kecil. Yang membesar adalah state, jadi tumpuk pertanyaan dan jaga statenya tetap ramping.

Berapa biaya memasang penjaga pada tiap giliran chat? Pada ukuran balasan kami, 1 penjaga berharga sekitar 0,00003 USD per giliran. Seribu giliran berhenti di bawah 0,05 USD.

Langkah berikutnya

Batas yang tersisa: angka biaya tidak menjamin mutu jawaban. Rubrik yang buruk tetap menghasilkan keputusan yang buruk, walaupun murah. Kami membahas cara memeriksa klaim sebelum dipakai pada Apa itu meat proxy.

Bila Anda ingin kami menghitung titik keputusan mana yang layak diotomasi lebih dulu, buka AI Diagnostic. Untuk membahasnya lebih dulu, pilih jadwal sesi AI Diagnostic.

Sumber