Langsung ke konten
fedi.software

GPT-4.1 Mini di fedi-index

Skor di setiap kategori, komponennya, nilai, eksekusi lokal, dan riwayat.

fedi-index · Umum

C 1.327 ±6

Persentil 40 · #175

Disukai orang / Menyelesaikan tugas

1.337 / 1.311

Suara manusia vs benchmark, Elo-eq

Nilai

-42

US$0,70 per 1 juta token, median dari 23 penyedia · vendor US$0,70

Di perangkat Anda

Bobot tertutup: hanya cloud.

Rincian skor

C Umum 1.327 [1.321–1.334] Persentil 40 · #175 · komponen: 9
Sumber Komponen Nilai Elo-eq Bobot Diukur Varian
Epoch AI eci 135 ±1,37 1.320 ±11 29,6% 2025-04-14 —
LMArena text/overall 1.340 ±2,20 1.340 ±2 16,8% 2026-10-02 —
LMArena text/hard_prompts 1.349 ±2,88 1.348 ±3 16,7% 2026-10-02 —
LMArena text/instruction_following 1.332 ±3,31 1.349 ±3 8,2% 2026-10-02 —
LMArena text/expert 1.338 ±6,62 1.344 ±5 7,6% 2026-10-02 —
Epoch AI simpleqa_verified peluruhan ×0,61 0,13 ±0,01 1.337 ±3 4,4% 2026-08-31 —
LMArena text/multi_turn 1.354 ±3,88 1.357 ±4 4,1% 2026-10-02 —
LMArena text/longer_query 1.344 ±3,82 1.348 ±4 4,1% 2026-10-02 —
Epoch AI gpqa_diamond peluruhan ×0,26 0,66 ±0,03 1.346 ±13 1,2% 2025-04-14 —

Bobot adalah porsi komponen dalam skor (sisanya adalah nilai prior yang menarik model dengan sedikit data ke median populasi). Metodologi

C Coding 1.337 [1.331–1.343] Persentil 38 · #172 · komponen: 1 sementara
Sumber Komponen Nilai Elo-eq Bobot Diukur Varian
LMArena text/coding 1.367 ±3,83 1.352 ±3 90,1% 2026-10-02 —

Bobot adalah porsi komponen dalam skor (sisanya adalah nilai prior yang menarik model dengan sedikit data ke median populasi). Metodologi

C Matematika 1.328 [1.322–1.334] Persentil 38 · #158 · komponen: 2
Sumber Komponen Nilai Elo-eq Bobot Diukur Varian
LMArena text/math 1.343 ±5,67 1.338 ±5 48,2% 2026-10-02 —
Epoch AI frontiermath_t1_3 peluruhan ×0,86 0,07 ±0,01 1.336 ±3 45,0% 2026-08-27 —

Bobot adalah porsi komponen dalam skor (sisanya adalah nilai prior yang menarik model dengan sedikit data ke median populasi). Metodologi

C Vision 1.355 [1.350–1.360] Persentil 30 · #79 · komponen: 3 sementara
Sumber Komponen Nilai Elo-eq Bobot Diukur Varian
LMArena vision/overall 1.181 ±3,81 1.368 ±3 63,9% 2026-10-02 —
LMArena vision/ocr 1.188 ±4,81 1.363 ±5 15,4% 2026-10-02 —
LMArena vision/diagram 1.182 ±6,95 1.359 ±6 14,4% 2026-10-02 —

Bobot adalah porsi komponen dalam skor (sisanya adalah nilai prior yang menarik model dengan sedikit data ke median populasi). Metodologi

C Menulis 1.325 [1.319–1.331] Persentil 44 · #151 · komponen: 2 sementara
Sumber Komponen Nilai Elo-eq Bobot Diukur Varian
LMArena text/creative_writing 1.300 ±4,45 1.326 ±4 61,8% 2026-10-02 —
LMArena text/longer_query 1.344 ±3,82 1.348 ±4 31,9% 2026-10-02 —

Bobot adalah porsi komponen dalam skor (sisanya adalah nilai prior yang menarik model dengan sedikit data ke median populasi). Metodologi

C Bahasa: 繁體中文 1.310 [1.301–1.319] Persentil 30 · #157 · komponen: 1 sementara
Sumber Komponen Nilai Elo-eq Bobot Diukur Varian
LMArena text/chinese 1.329 ±6,15 1.318 ±5 93,5% 2026-10-02 —

Bobot adalah porsi komponen dalam skor (sisanya adalah nilai prior yang menarik model dengan sedikit data ke median populasi). Metodologi

C Bahasa: Deutsch 1.347 [1.332–1.361] Persentil 32 · #98 · komponen: 1 sementara
Sumber Komponen Nilai Elo-eq Bobot Diukur Varian
LMArena text/german 1.349 ±9,36 1.358 ±8 92,5% 2026-10-02 —

Bobot adalah porsi komponen dalam skor (sisanya adalah nilai prior yang menarik model dengan sedikit data ke median populasi). Metodologi

C Bahasa: English 1.333 [1.327–1.338] Persentil 40 · #164 · komponen: 1 sementara
Sumber Komponen Nilai Elo-eq Bobot Diukur Varian
LMArena text/english 1.356 ±2,76 1.341 ±3 93,9% 2026-10-02 —

Bobot adalah porsi komponen dalam skor (sisanya adalah nilai prior yang menarik model dengan sedikit data ke median populasi). Metodologi

D Bahasa: Español 1.314 [1.296–1.332] Persentil 13 · #130 · komponen: 1 sementara
Sumber Komponen Nilai Elo-eq Bobot Diukur Varian
LMArena text/spanish 1.320 ±11 1.324 ±10 91,8% 2026-10-02 —

Bobot adalah porsi komponen dalam skor (sisanya adalah nilai prior yang menarik model dengan sedikit data ke median populasi). Metodologi

D Bahasa: Français 1.334 [1.313–1.355] Persentil 16 · #114 · komponen: 1 sementara
Sumber Komponen Nilai Elo-eq Bobot Diukur Varian
LMArena text/french 1.357 ±13 1.347 ±12 90,7% 2026-10-02 —

Bobot adalah porsi komponen dalam skor (sisanya adalah nilai prior yang menarik model dengan sedikit data ke median populasi). Metodologi

C Bahasa: 日本語 1.335 [1.321–1.348] Persentil 25 · #96 · komponen: 1 sementara
Sumber Komponen Nilai Elo-eq Bobot Diukur Varian
LMArena text/japanese 1.291 ±10 1.345 ±8 92,8% 2026-10-02 —

Bobot adalah porsi komponen dalam skor (sisanya adalah nilai prior yang menarik model dengan sedikit data ke median populasi). Metodologi

C Bahasa: 한국어 1.346 [1.331–1.361] Persentil 25 · #102 · komponen: 1 sementara
Sumber Komponen Nilai Elo-eq Bobot Diukur Varian
LMArena text/korean 1.298 ±11 1.357 ±8 92,4% 2026-10-02 —

Bobot adalah porsi komponen dalam skor (sisanya adalah nilai prior yang menarik model dengan sedikit data ke median populasi). Metodologi

D Bahasa: Polski 1.335 [1.326–1.345] Persentil 14 · #113 · komponen: 1 sementara
Sumber Komponen Nilai Elo-eq Bobot Diukur Varian
LMArena text/polish 1.326 ±6,22 1.345 ±5 93,4% 2026-10-02 —

Bobot adalah porsi komponen dalam skor (sisanya adalah nilai prior yang menarik model dengan sedikit data ke median populasi). Metodologi

C Bahasa: Русский 1.330 [1.321–1.338] Persentil 34 · #155 · komponen: 1 sementara
Sumber Komponen Nilai Elo-eq Bobot Diukur Varian
LMArena text/russian 1.324 ±5,38 1.338 ±5 93,6% 2026-10-02 —

Bobot adalah porsi komponen dalam skor (sisanya adalah nilai prior yang menarik model dengan sedikit data ke median populasi). Metodologi

Riwayat

fedi-index per bulan
Data yang sama dalam tabel
Model 2026-10
GPT-4.1 Mini 1.327 C

Lencana

Tampilkan fedi-index model di situs Anda atau di README. Lencana diperbarui otomatis dan menautkan ke halaman ini.

fedi-index: GPT-4.1 Mini

Data CC BY 4.0: pertahankan tautan ke fedi.software.