Langsung ke konten
fedi.software

GLM 5.1 di fedi-index

Skor di setiap kategori, komponennya, nilai, eksekusi lokal, dan riwayat.

fedi-index · Umum

A 1.432 ±5

Persentil 83 · #51

Disukai orang / Menyelesaikan tugas

1.445 / 1.415

Suara manusia vs benchmark, Elo-eq

Nilai

+36

US$2,14 per 1 juta token, median dari 42 penyedia · vendor US$2,15

Di perangkat Anda

Tidak muat di perangkat referensi.

Rincian skor

A Umum 1.432 [1.427–1.437] Persentil 83 · #51 · komponen: 9
Sumber Komponen Nilai Elo-eq Bobot Diukur Varian
Epoch AI eci 150 ±0,90 1.436 ±7 33,9% 2026-04-07 —
LMArena text/overall 1.461 ±1,87 1.462 ±2 15,6% 2026-10-02 —
LMArena text/hard_prompts 1.472 ±2,17 1.459 ±2 15,6% 2026-10-02 —
LMArena text/instruction_following 1.451 ±2,63 1.461 ±2 7,7% 2026-10-02 —
LMArena text/expert 1.476 ±4,14 1.457 ±3 7,5% 2026-10-02 —
LMArena text/longer_query 1.466 ±2,51 1.462 ±2 3,9% 2026-10-02 —
Epoch AI simpleqa_verified peluruhan ×0,61 0,34 ±0,01 1.404 ±5 3,8% 2026-08-27 —
LMArena text/multi_turn 1.472 ±3,51 1.464 ±3 3,8% 2026-10-02 —
Epoch AI gpqa_diamond peluruhan ×0,26 0,90 ±0,02 1.458 ±10 1,3% 2026-08-10 —

Bobot adalah porsi komponen dalam skor (sisanya adalah nilai prior yang menarik model dengan sedikit data ke median populasi). Metodologi

A Coding 1.434 [1.430–1.437] Persentil 85 · #43 · komponen: 3
Sumber Komponen Nilai Elo-eq Bobot Diukur Varian
LMArena webdev/overall 1.508 ±3,44 1.452 ±1 39,6% 2026-10-01 —
LMArena text/coding 1.486 ±2,86 1.458 ±3 38,7% 2026-10-02 —
Epoch AI swe_bench_verified peluruhan ×0,37 0,74 ±0,02 1.454 ±10 13,4% 2026-05-15 —

Bobot adalah porsi komponen dalam skor (sisanya adalah nilai prior yang menarik model dengan sedikit data ke median populasi). Metodologi

A Matematika 1.418 [1.410–1.426] Persentil 82 · #46 · komponen: 2
Sumber Komponen Nilai Elo-eq Bobot Diukur Varian
LMArena text/math 1.473 ±5,85 1.463 ±6 50,4% 2026-10-02 —
Epoch AI frontiermath_t1_3 peluruhan ×0,86 0,37 ±0,03 1.401 ±6 42,4% 2026-08-29 —

Bobot adalah porsi komponen dalam skor (sisanya adalah nilai prior yang menarik model dengan sedikit data ke median populasi). Metodologi

A Menulis 1.459 [1.454–1.463] Persentil 91 · #24 · komponen: 2 sementara
Sumber Komponen Nilai Elo-eq Bobot Diukur Varian
LMArena text/creative_writing 1.452 ±3,37 1.482 ±3 62,0% 2026-10-02 —
LMArena text/longer_query 1.466 ±2,51 1.462 ±2 31,9% 2026-10-02 —

Bobot adalah porsi komponen dalam skor (sisanya adalah nilai prior yang menarik model dengan sedikit data ke median populasi). Metodologi

A Bahasa: 繁體中文 1.448 [1.441–1.456] Persentil 88 · #27 · komponen: 1 sementara
Sumber Komponen Nilai Elo-eq Bobot Diukur Varian
LMArena text/chinese 1.515 ±5,06 1.465 ±4 93,7% 2026-10-02 —

Bobot adalah porsi komponen dalam skor (sisanya adalah nilai prior yang menarik model dengan sedikit data ke median populasi). Metodologi

A Bahasa: Deutsch 1.437 [1.421–1.453] Persentil 85 · #23 · komponen: 1 sementara
Sumber Komponen Nilai Elo-eq Bobot Diukur Varian
LMArena text/german 1.464 ±10 1.457 ±9 92,2% 2026-10-02 —

Bobot adalah porsi komponen dalam skor (sisanya adalah nilai prior yang menarik model dengan sedikit data ke median populasi). Metodologi

A Bahasa: English 1.452 [1.447–1.457] Persentil 91 · #26 · komponen: 1 sementara
Sumber Komponen Nilai Elo-eq Bobot Diukur Varian
LMArena text/english 1.476 ±2,42 1.468 ±3 94,0% 2026-10-02 —

Bobot adalah porsi komponen dalam skor (sisanya adalah nilai prior yang menarik model dengan sedikit data ke median populasi). Metodologi

A Bahasa: Español 1.443 [1.431–1.456] Persentil 88 · #18 · komponen: 1 sementara
Sumber Komponen Nilai Elo-eq Bobot Diukur Varian
LMArena text/spanish 1.468 ±7,36 1.461 ±7 93,0% 2026-10-02 —

Bobot adalah porsi komponen dalam skor (sisanya adalah nilai prior yang menarik model dengan sedikit data ke median populasi). Metodologi

A Bahasa: Français 1.438 [1.425–1.450] Persentil 81 · #27 · komponen: 1 sementara
Sumber Komponen Nilai Elo-eq Bobot Diukur Varian
LMArena text/french 1.475 ±7,56 1.456 ±7 93,0% 2026-10-02 —

Bobot adalah porsi komponen dalam skor (sisanya adalah nilai prior yang menarik model dengan sedikit data ke median populasi). Metodologi

A Bahasa: 日本語 1.432 [1.416–1.449] Persentil 80 · #26 · komponen: 1 sementara
Sumber Komponen Nilai Elo-eq Bobot Diukur Varian
LMArena text/japanese 1.434 ±12 1.452 ±9 92,2% 2026-10-02 —

Bobot adalah porsi komponen dalam skor (sisanya adalah nilai prior yang menarik model dengan sedikit data ke median populasi). Metodologi

A Bahasa: 한국어 1.432 [1.419–1.446] Persentil 80 · #28 · komponen: 1 sementara
Sumber Komponen Nilai Elo-eq Bobot Diukur Varian
LMArena text/korean 1.420 ±9,72 1.450 ±7 92,8% 2026-10-02 —

Bobot adalah porsi komponen dalam skor (sisanya adalah nilai prior yang menarik model dengan sedikit data ke median populasi). Metodologi

B Bahasa: Polski 1.428 [1.414–1.442] Persentil 74 · #35 · komponen: 1 sementara
Sumber Komponen Nilai Elo-eq Bobot Diukur Varian
LMArena text/polish 1.445 ±9,05 1.446 ±8 92,7% 2026-10-02 —

Bobot adalah porsi komponen dalam skor (sisanya adalah nilai prior yang menarik model dengan sedikit data ke median populasi). Metodologi

A Bahasa: Русский 1.439 [1.432–1.446] Persentil 84 · #38 · komponen: 1 sementara
Sumber Komponen Nilai Elo-eq Bobot Diukur Varian
LMArena text/russian 1.453 ±3,92 1.455 ±4 93,8% 2026-10-02 —

Bobot adalah porsi komponen dalam skor (sisanya adalah nilai prior yang menarik model dengan sedikit data ke median populasi). Metodologi

Riwayat

fedi-index per bulan
Data yang sama dalam tabel
Model 2026-10
GLM 5.1 1.432 A

Lencana

Tampilkan fedi-index model di situs Anda atau di README. Lencana diperbarui otomatis dan menautkan ke halaman ini.

fedi-index: GLM 5.1

Data CC BY 4.0: pertahankan tautan ke fedi.software.