ข้ามไปยังเนื้อหา
fedi.software

GLM 5.1 ใน fedi-index

คะแนนในทุกหมวด องค์ประกอบของคะแนน ความคุ้มค่า การรันบนเครื่อง และประวัติ

fedi-index · ภาพรวม

A 1,432 ±5

เปอร์เซ็นไทล์ 83 · #51

คนชอบ / แก้โจทย์

1,445 / 1,415

โหวตจากผู้คนเทียบกับเบนช์มาร์ก, Elo-eq

ความคุ้มค่า

+36

US$2.13 ต่อ 1M โทเค็น, ค่ามัธยฐานจาก 42 ผู้ให้บริการ · ราคาผู้พัฒนา US$2.15

บนฮาร์ดแวร์ของคุณ

ไม่สามารถรันบนเครื่องอ้างอิงได้

รายละเอียดคะแนน

A ภาพรวม 1,432 [1,427–1,437] เปอร์เซ็นไทล์ 83 · #51 · องค์ประกอบ: 9
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
Epoch AI eci 150 ±0.90 1,436 ±7 33.9% 2026-04-07 —
LMArena text/overall 1,461 ±1.87 1,462 ±2 15.6% 2026-10-02 —
LMArena text/hard_prompts 1,472 ±2.17 1,459 ±2 15.6% 2026-10-02 —
LMArena text/instruction_following 1,451 ±2.63 1,461 ±2 7.7% 2026-10-02 —
LMArena text/expert 1,476 ±4.14 1,457 ±3 7.5% 2026-10-02 —
LMArena text/longer_query 1,466 ±2.51 1,462 ±2 3.9% 2026-10-02 —
Epoch AI simpleqa_verified ลดทอน ×0.61 0.34 ±0.01 1,404 ±5 3.8% 2026-08-27 —
LMArena text/multi_turn 1,472 ±3.51 1,464 ±3 3.8% 2026-10-02 —
Epoch AI gpqa_diamond ลดทอน ×0.26 0.90 ±0.02 1,458 ±10 1.3% 2026-08-10 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A เขียนโค้ด 1,434 [1,430–1,437] เปอร์เซ็นไทล์ 85 · #43 · องค์ประกอบ: 3
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena webdev/overall 1,508 ±3.44 1,452 ±1 39.6% 2026-10-01 —
LMArena text/coding 1,486 ±2.86 1,458 ±3 38.7% 2026-10-02 —
Epoch AI swe_bench_verified ลดทอน ×0.37 0.74 ±0.02 1,454 ±10 13.4% 2026-05-15 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A คณิตศาสตร์ 1,418 [1,410–1,426] เปอร์เซ็นไทล์ 82 · #46 · องค์ประกอบ: 2
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/math 1,473 ±5.85 1,463 ±6 50.4% 2026-10-02 —
Epoch AI frontiermath_t1_3 ลดทอน ×0.86 0.37 ±0.03 1,401 ±6 42.4% 2026-08-29 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A งานเขียน 1,459 [1,454–1,463] เปอร์เซ็นไทล์ 91 · #24 · องค์ประกอบ: 2 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/creative_writing 1,452 ±3.37 1,482 ±3 62.0% 2026-10-02 —
LMArena text/longer_query 1,466 ±2.51 1,462 ±2 31.9% 2026-10-02 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: 繁體中文 1,448 [1,441–1,456] เปอร์เซ็นไทล์ 88 · #27 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/chinese 1,515 ±5.06 1,465 ±4 93.7% 2026-10-02 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: Deutsch 1,437 [1,421–1,453] เปอร์เซ็นไทล์ 85 · #23 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/german 1,464 ±10 1,457 ±9 92.2% 2026-10-02 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: English 1,452 [1,447–1,457] เปอร์เซ็นไทล์ 91 · #26 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/english 1,476 ±2.42 1,468 ±3 94.0% 2026-10-02 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: Español 1,443 [1,431–1,456] เปอร์เซ็นไทล์ 88 · #18 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/spanish 1,468 ±7.36 1,461 ±7 93.0% 2026-10-02 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: Français 1,438 [1,425–1,450] เปอร์เซ็นไทล์ 81 · #27 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/french 1,475 ±7.56 1,456 ±7 93.0% 2026-10-02 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: 日本語 1,432 [1,416–1,449] เปอร์เซ็นไทล์ 80 · #26 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/japanese 1,434 ±12 1,452 ±9 92.2% 2026-10-02 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: 한국어 1,432 [1,419–1,446] เปอร์เซ็นไทล์ 80 · #28 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/korean 1,420 ±9.72 1,450 ±7 92.8% 2026-10-02 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

B ภาษา: Polski 1,428 [1,414–1,442] เปอร์เซ็นไทล์ 74 · #35 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/polish 1,445 ±9.05 1,446 ±8 92.7% 2026-10-02 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: Русский 1,439 [1,432–1,446] เปอร์เซ็นไทล์ 84 · #38 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/russian 1,453 ±3.92 1,455 ±4 93.8% 2026-10-02 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

ประวัติ

fedi-index รายเดือน
ดูแบบตาราง
โมเดล 2026-10
GLM 5.1 1,432 A

แบดจ์

แสดง fedi-index ของโมเดลบนเว็บไซต์หรือใน README ของคุณ แบดจ์อัปเดตอัตโนมัติและลิงก์มายังหน้านี้

fedi-index: GLM 5.1

ข้อมูลเป็น CC BY 4.0: โปรดคงลิงก์ไปยัง fedi.software