ข้ามไปยังเนื้อหา
fedi.software

GLM 5.2 ใน fedi-index

คะแนนในทุกหมวด องค์ประกอบของคะแนน ความคุ้มค่า การรันบนเครื่อง และประวัติ

fedi-index · ภาพรวม

A 1,442 ±5

เปอร์เซ็นไทล์ 88 · #37

คนชอบ / แก้โจทย์

1,453 / 1,427

โหวตจากผู้คนเทียบกับเบนช์มาร์ก, Elo-eq

ความคุ้มค่า

+45

US$2.15 ต่อ 1M โทเค็น, ค่ามัธยฐานจาก 73 ผู้ให้บริการ · ราคาผู้พัฒนา US$2.15

บนฮาร์ดแวร์ของคุณ

ไม่สามารถรันบนเครื่องอ้างอิงได้

รายละเอียดคะแนน

A ภาพรวม 1,442 [1,437–1,447] เปอร์เซ็นไทล์ 88 · #37 · องค์ประกอบ: 9
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
Epoch AI eci 152 ±1.02 1,452 ±8 32.9% 2026-06-16 —
LMArena text/overall 1,470 ±2.18 1,470 ±2 15.8% 2026-10-02 max
LMArena text/hard_prompts 1,480 ±2.49 1,467 ±2 15.8% 2026-10-02 max
LMArena text/instruction_following 1,465 ±2.97 1,475 ±3 7.8% 2026-10-02 max
LMArena text/expert 1,486 ±4.61 1,465 ±4 7.6% 2026-10-02 max
LMArena text/longer_query 1,480 ±2.82 1,475 ±3 3.9% 2026-10-02 max
Epoch AI simpleqa_verified ลดทอน ×0.61 0.34 ±0.02 1,405 ±5 3.9% 2026-08-27 max
LMArena text/multi_turn 1,468 ±3.91 1,461 ±4 3.8% 2026-10-02 max
Epoch AI gpqa_diamond ลดทอน ×0.26 0.92 ±0.02 1,467 ±8 1.5% 2026-06-24 max

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A เขียนโค้ด 1,448 [1,444–1,451] เปอร์เซ็นไทล์ 92 · #23 · องค์ประกอบ: 3
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena webdev/overall 1,605 ±3.24 1,480 ±1 39.5% 2026-10-01 max
LMArena text/coding 1,484 ±3.24 1,456 ±3 38.3% 2026-10-02 max
Epoch AI swe_bench_verified ลดทอน ×0.37 0.79 ±0.02 1,477 ±10 13.9% 2026-06-25 max

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

B เอเจนต์ 1,454 [1,449–1,459] เปอร์เซ็นไทล์ 77 · #14 · องค์ประกอบ: 2
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena agent/overall 0.03 ±0.00 1,472 ±2 66.6% 2026-10-02 max
τ²-bench (Sierra) tau2/banking_knowledge ลดทอน ×0.76 0.37 ±0.05 1,476 ±8 26.3% 2026-07-24 xhigh

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A คณิตศาสตร์ 1,442 [1,434–1,450] เปอร์เซ็นไทล์ 89 · #29 · องค์ประกอบ: 3
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/math 1,484 ±6.76 1,474 ±6 51.5% 2026-10-02 max
Epoch AI frontiermath_t1_3 ลดทอน ×0.86 0.59 ±0.03 1,449 ±6 29.7% 2026-06-19 max
Epoch AI frontiermath_t4 ลดทอน ×0.86 0.29 ±0.07 1,439 ±12 11.1% 2026-06-19 max

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A งานเขียน 1,470 [1,465–1,475] เปอร์เซ็นไทล์ 95 · #15 · องค์ประกอบ: 2 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/creative_writing 1,464 ±3.73 1,494 ±4 61.9% 2026-10-02 max
LMArena text/longer_query 1,480 ±2.82 1,475 ±3 32.0% 2026-10-02 max

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: 繁體中文 1,452 [1,444–1,460] เปอร์เซ็นไทล์ 90 · #22 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/chinese 1,520 ±5.54 1,469 ±4 93.6% 2026-10-02 max

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: Deutsch 1,438 [1,422–1,456] เปอร์เซ็นไทล์ 85 · #22 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/german 1,466 ±11 1,459 ±9 92.0% 2026-10-02 max

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: English 1,451 [1,445–1,456] เปอร์เซ็นไทล์ 90 · #29 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/english 1,474 ±2.78 1,467 ±3 93.9% 2026-10-02 max

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: Español 1,450 [1,435–1,464] เปอร์เซ็นไทล์ 93 · #11 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/spanish 1,477 ±8.74 1,470 ±8 92.5% 2026-10-02 max

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: Français 1,440 [1,426–1,454] เปอร์เซ็นไทล์ 82 · #25 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/french 1,478 ±8.33 1,458 ±8 92.7% 2026-10-02 max

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: 日本語 1,444 [1,427–1,460] เปอร์เซ็นไทล์ 86 · #19 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/japanese 1,450 ±12 1,464 ±9 92.1% 2026-10-02 max

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: 한국어 1,451 [1,436–1,466] เปอร์เซ็นไทล์ 90 · #14 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/korean 1,447 ±11 1,471 ±8 92.5% 2026-10-02 max

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

B ภาษา: Polski 1,432 [1,415–1,449] เปอร์เซ็นไทล์ 78 · #29 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/polish 1,453 ±11 1,452 ±9 92.0% 2026-10-02 max

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: Русский 1,450 [1,443–1,458] เปอร์เซ็นไทล์ 88 · #28 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/russian 1,467 ±4.45 1,467 ±4 93.7% 2026-10-02 max

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

ประวัติ

fedi-index รายเดือน
ดูแบบตาราง
โมเดล 2026-10
GLM 5.2 1,442 A

แบดจ์

แสดง fedi-index ของโมเดลบนเว็บไซต์หรือใน README ของคุณ แบดจ์อัปเดตอัตโนมัติและลิงก์มายังหน้านี้

fedi-index: GLM 5.2

ข้อมูลเป็น CC BY 4.0: โปรดคงลิงก์ไปยัง fedi.software