Langsung ke konten
fedi.software

Bandingkan model AI

Bandingkan hingga empat model secara berdampingan: tier dan Elo di setiap papan peringkat, harga, jendela konteks, dan tanggal rilis.

Diperbarui · Sumber: models.dev

Metrik DeepSeek V3.2 DeepSeek
Teks A 1.424 1.421–1.428
Pemrograman A 1.454 1.447–1.460
Web dev C 1.362 1.353–1.371
Input / output, per 1 jt US$0,18 / US$0,35
Jendela konteks 164K
Output maks. 64K
Dirilis 1 Desember 2025
Batas pengetahuan 2024-12
Lisensi —
Input teks
Aplikasi —

Membandingkan model secara berdampingan

Halaman perbandingan menempatkan hingga 4 model AI dalam kolom-kolom yang berdampingan. Untuk setiap model tampil tier dan nilainya di semua papan peringkat tempat model itu tercatat, harga per satuan, jendela konteks, keluaran maksimum, modalitas, tanda bobot terbuka, dan tanggal rilis. Halaman ini paling berguna ketika Anda sudah punya dua atau tiga kandidat dan tinggal memutuskan.

Cara menambahkan model

Ada dua jalan. Ketik nama model di setiap kolom lalu pilih dari daftar. Atau centang kotak “Bandingkan” di tabel papan peringkat mana pun, misalnya teks atau pemrograman. Tombol kosongkan mengembalikan halaman ke awal. Tautan perbandingan bisa disalin untuk dibagikan ke rekan kerja.

Tiga hal yang sering disalahpahami

  • Nilai antarpapan tidak setara. Elo dari papan teks dan “Skor” dari papan agen memakai skala berbeda. Menyandingkan keduanya tidak bermakna. Bandingkan nilai di dalam papan yang sama saja.
  • Sel kosong bukan nol. Artinya sumber tidak punya data itu untuk model tersebut.
  • Harga dan konteks saling terkait. Model murah dengan konteks pendek bisa jadi mahal jika pekerjaan Anda butuh banyak panggilan.

Contoh keputusan

Misalkan Anda butuh model untuk menjawab pertanyaan pelanggan dalam bahasa Indonesia. Ambil tiga kandidat dari papan teks, masukkan ke perbandingan, lalu lihat tier, harga masukan dan keluaran, serta konteks dalam satu layar. Jika dua model berada di tier yang sama, biasanya harga yang menentukan. Setelah itu, uji keduanya dengan contoh pertanyaan nyata.

Setelah membandingkan

Catat alasan pilihan Anda: tier, harga, dan konteks. Catatan ini berguna saat model baru muncul dan Anda perlu menilai ulang. Buka kembali perbandingan beberapa minggu kemudian, karena harga dan peringkat berubah.

Tentang tautan yang dibagikan

Tautan dengan model pilihan dibuat untuk berbagi. Mesin pencari hanya mengindeks halaman perbandingan kosong; kombinasi tertentu tidak menjadi halaman tersendiri. Nilai berasal dari LMArena; harga, konteks, dan modalitas dari models.dev dan LiteLLM, dengan pembaruan harian.