Bandingkan model AI
Bandingkan hingga empat model secara berdampingan: tier dan Elo di setiap papan peringkat, harga, jendela konteks, dan tanggal rilis.
Diperbarui · Sumber: models.dev
| Metrik | Claude Sonnet 5.5 Anthropic |
|---|---|
| Teks | S 1.467 1.456–1.477 |
| Pemrograman | S 1.519 1.498–1.540 |
| Web dev | S 1.786 1.768–1.804 |
| Agen | S 0,125 0,094–0,156 |
| Input / output, per 1 jt | US$2 / US$10 |
| Jendela konteks | 1M |
| Output maks. | 128K |
| Dirilis | 28 September 2026 |
| Batas pengetahuan | 2026-06 |
| Lisensi | — |
| Input | teks, gambar, file |
| Aplikasi | — |
Membandingkan model secara berdampingan
Halaman perbandingan menempatkan hingga 4 model AI dalam kolom-kolom yang berdampingan. Untuk setiap model tampil tier dan nilainya di semua papan peringkat tempat model itu tercatat, harga per satuan, jendela konteks, keluaran maksimum, modalitas, tanda bobot terbuka, dan tanggal rilis. Halaman ini paling berguna ketika Anda sudah punya dua atau tiga kandidat dan tinggal memutuskan.
Cara menambahkan model
Ada dua jalan. Ketik nama model di setiap kolom lalu pilih dari daftar. Atau centang kotak “Bandingkan” di tabel papan peringkat mana pun, misalnya teks atau pemrograman. Tombol kosongkan mengembalikan halaman ke awal. Tautan perbandingan bisa disalin untuk dibagikan ke rekan kerja.
Tiga hal yang sering disalahpahami
- Nilai antarpapan tidak setara. Elo dari papan teks dan “Skor” dari papan agen memakai skala berbeda. Menyandingkan keduanya tidak bermakna. Bandingkan nilai di dalam papan yang sama saja.
- Sel kosong bukan nol. Artinya sumber tidak punya data itu untuk model tersebut.
- Harga dan konteks saling terkait. Model murah dengan konteks pendek bisa jadi mahal jika pekerjaan Anda butuh banyak panggilan.
Contoh keputusan
Misalkan Anda butuh model untuk menjawab pertanyaan pelanggan dalam bahasa Indonesia. Ambil tiga kandidat dari papan teks, masukkan ke perbandingan, lalu lihat tier, harga masukan dan keluaran, serta konteks dalam satu layar. Jika dua model berada di tier yang sama, biasanya harga yang menentukan. Setelah itu, uji keduanya dengan contoh pertanyaan nyata.
Setelah membandingkan
Catat alasan pilihan Anda: tier, harga, dan konteks. Catatan ini berguna saat model baru muncul dan Anda perlu menilai ulang. Buka kembali perbandingan beberapa minggu kemudian, karena harga dan peringkat berubah.
Tentang tautan yang dibagikan
Tautan dengan model pilihan dibuat untuk berbagi. Mesin pencari hanya mengindeks halaman perbandingan kosong; kombinasi tertentu tidak menjadi halaman tersendiri. Nilai berasal dari LMArena; harga, konteks, dan modalitas dari models.dev dan LiteLLM, dengan pembaruan harian.