Langsung ke konten
fedi.software

Bandingkan model AI

Bandingkan hingga empat model secara berdampingan: tier dan Elo di setiap papan peringkat, harga, jendela konteks, dan tanggal rilis.

Diperbarui

Metrik hunyuan-t1-20250711 Tencent
Teks A 1.401 1.392–1.409
Pemrograman B 1.389 1.370–1.409
Input / output, per 1 jt —
Jendela konteks 131K
Output maks. 16K
Dirilis 11 Juli 2025
Batas pengetahuan —
Lisensi —
Input teks
Aplikasi —

Membandingkan model secara berdampingan

Halaman perbandingan menempatkan hingga 4 model AI dalam kolom-kolom yang berdampingan. Untuk setiap model tampil tier dan nilainya di semua papan peringkat tempat model itu tercatat, harga per satuan, jendela konteks, keluaran maksimum, modalitas, tanda bobot terbuka, dan tanggal rilis. Halaman ini paling berguna ketika Anda sudah punya dua atau tiga kandidat dan tinggal memutuskan.

Cara menambahkan model

Ada dua jalan. Ketik nama model di setiap kolom lalu pilih dari daftar. Atau centang kotak “Bandingkan” di tabel papan peringkat mana pun, misalnya teks atau pemrograman. Tombol kosongkan mengembalikan halaman ke awal. Tautan perbandingan bisa disalin untuk dibagikan ke rekan kerja.

Tiga hal yang sering disalahpahami

  • Nilai antarpapan tidak setara. Elo dari papan teks dan “Skor” dari papan agen memakai skala berbeda. Menyandingkan keduanya tidak bermakna. Bandingkan nilai di dalam papan yang sama saja.
  • Sel kosong bukan nol. Artinya sumber tidak punya data itu untuk model tersebut.
  • Harga dan konteks saling terkait. Model murah dengan konteks pendek bisa jadi mahal jika pekerjaan Anda butuh banyak panggilan.

Contoh keputusan

Misalkan Anda butuh model untuk menjawab pertanyaan pelanggan dalam bahasa Indonesia. Ambil tiga kandidat dari papan teks, masukkan ke perbandingan, lalu lihat tier, harga masukan dan keluaran, serta konteks dalam satu layar. Jika dua model berada di tier yang sama, biasanya harga yang menentukan. Setelah itu, uji keduanya dengan contoh pertanyaan nyata.

Setelah membandingkan

Catat alasan pilihan Anda: tier, harga, dan konteks. Catatan ini berguna saat model baru muncul dan Anda perlu menilai ulang. Buka kembali perbandingan beberapa minggu kemudian, karena harga dan peringkat berubah.

Tentang tautan yang dibagikan

Tautan dengan model pilihan dibuat untuk berbagi. Mesin pencari hanya mengindeks halaman perbandingan kosong; kombinasi tertentu tidak menjadi halaman tersendiri. Nilai berasal dari LMArena; harga, konteks, dan modalitas dari models.dev dan LiteLLM, dengan pembaruan harian.