Langsung ke konten
fedi.software

Teks

Model chat yang diperingkat berdasarkan suara buta pengguna di LMArena, dengan interval kepercayaan setiap rating dan harga saat ini per sejuta token.

Diperbarui · Sumber: LMArena, LiteLLM, models.dev

Biaya per bulan
Tier Model Elo Input / output, per 1 jt Per bulan Konteks Aplikasi Bandingkan
S1.448US$0,959 / US$2,74 1M
A1.441US$0,066 / US$0,26 262K
A1.432US$0,20 / US$0,90Gratis 1M
A1.406— —
A1.405US$0,08 / US$0,32Gratis 205K
B1.403US$0,09 / US$0,30Gratis 256K
A1.401— —
A1.401— 131K
B1.392US$0,27 / US$1,10 205K
B1.377— 131K
B1.359US$0,22 / US$0,88 205K
B1.351US$0,21 / US$0,57 66K
B1.343US$0,132 / US$1,25 1M
B1.340US$0,20 / US$1 205K
B1.336— —
B1.321US$5,21 / US$16,44 16K
B1.311— —
B1.288— —
B1.274— —
C1.263— —
C1.202— —

Tier ditentukan oleh kami: posisi model di papan peringkat dengan hanya menghitung model yang seluruh interval kepercayaannya berada di atasnya. S — 10% teratas, A — hingga 30%, B — hingga 60%, C — hingga 85%, D — sisanya.

Kualitas vs harga rating ke atas, harga gabungan (3 bagian input : 1 output) ke samping, USD per 1 jt token
1.000 1.200 1.400 1.600 US$0,01 US$0,10 US$1 US$10 US$100 Claude Opus 5.5 Claude Fable 5.1 Claude Opus 5

Papan peringkat model chat

Halaman ini memeringkat model chat berdasarkan arena teks LMArena, kategori umum. Caranya: seseorang mengirim pertanyaan, menerima dua jawaban dari model anonim, lalu memilih jawaban yang lebih ia sukai. Ribuan suara semacam itu diolah menjadi nilai bergaya Elo. Jadi nilai ini mencerminkan preferensi pengguna arena, yang kebanyakan menulis dalam bahasa Inggris. Nilai tersebut tidak mengukur kecepatan, biaya, atau kemampuan pada tugas khusus Anda.

Isi setiap baris

Setiap model menampilkan tier, nilai dengan interval kepercayaan 95% dalam bentuk batang, pembuat, tanda “Bobot terbuka”, harga termurah saat ini per 1M token masukan dan keluaran, jendela konteks, serta tren harga 30 hari. Bila aplikasinya ada di katalog kami, muncul tautan untuk mengunduhnya. Klik sebuah baris untuk membuka rincian: penyedia dari yang termurah, modalitas, konteks dan keluaran maksimum, jumlah suara, posisi di sumber, lisensi, tanggal rilis, dan batas pengetahuan.

Membaca interval dan harga

  • Jika interval dua model saling tumpang tindih, selisihnya tidak jelas secara statistik. Karena itu beberapa model bisa berbagi tier teratas.
  • Model dengan kurang dari 300 suara ditandai “Belum ada tier”.
  • Harga adalah yang terendah yang kami temukan di antara penyedia pada hari data, dalam USD.
  • Harga penyedia bisa berbeda dari harga pembuat model; potongan untuk cache, pemrosesan batch, dan harga regional tidak ditampilkan.

Contoh cara memakai

Butuh model untuk membalas pesan pelanggan? Mulailah dari tier atas. Aktifkan filter “Harga rendah”. Lalu bandingkan dua atau tiga kandidat dengan pertanyaan nyata dari pelanggan Anda.

Alat bantu di halaman

Filter memisahkan model berbobot terbuka, gratis, “Harga rendah” (harga gabungan di bawah 1 USD per 1M token), dan pembuat tertentu. Kalkulator “Biaya per bulan” menghitung perkiraan dari jumlah token per bulan dan porsi masukan. Grafik “Kualitas vs harga” memakai harga gabungan dengan perbandingan 3 bagian masukan berbanding 1 bagian keluaran. Centang hingga 4 model untuk melihatnya berdampingan di halaman perbandingan. Untuk pertanyaan seputar kode, lihat juga papan pemrograman.