ข้ามไปยังเนื้อหา
fedi.software

Gemini 2.5 Pro ใน fedi-index

คะแนนในทุกหมวด องค์ประกอบของคะแนน ความคุ้มค่า การรันบนเครื่อง และประวัติ

fedi-index · ภาพรวม

B 1,413 ±5

เปอร์เซ็นไทล์ 76 · #71

คนชอบ / แก้โจทย์

1,433 / 1,387

โหวตจากผู้คนเทียบกับเบนช์มาร์ก, Elo-eq

ความคุ้มค่า

+5

US$3.44 ต่อ 1M โทเค็น, ค่ามัธยฐานจาก 28 ผู้ให้บริการ · ราคาผู้พัฒนา US$3.44

บนฮาร์ดแวร์ของคุณ

น้ำหนักแบบปิด: ใช้ได้บนคลาวด์เท่านั้น

รายละเอียดคะแนน

B ภาพรวม 1,413 [1,408–1,418] เปอร์เซ็นไทล์ 76 · #71 · องค์ประกอบ: 8
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
Epoch AI eci 145 ±0.77 1,401 ±6 39.3% 2025-06-05 —
LMArena text/overall 1,458 ±1.24 1,458 ±1 15.1% 2026-10-02 —
LMArena text/hard_prompts 1,455 ±1.59 1,444 ±1 15.1% 2026-10-02 —
LMArena text/instruction_following 1,436 ±1.95 1,447 ±2 7.5% 2026-10-02 —
LMArena text/expert 1,452 ±3.46 1,437 ±3 7.4% 2026-10-02 —
LMArena text/longer_query 1,449 ±2.00 1,446 ±2 3.8% 2026-10-02 —
LMArena text/multi_turn 1,453 ±2.39 1,447 ±2 3.7% 2026-10-02 —
Epoch AI gpqa_diamond ลดทอน ×0.26 0.85 ±0.02 1,436 ±10 1.4% 2025-11-16 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

B เขียนโค้ด 1,367 [1,363–1,372] เปอร์เซ็นไทล์ 52 · #135 · องค์ประกอบ: 3
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena webdev/overall 1,227 ±8.07 1,372 ±2 49.2% 2026-10-01 —
LMArena text/coding ค่าผิดปกติ 1,452 ±2.15 1,427 ±2 24.8% 2026-10-02 —
Epoch AI swe_bench_verified ลดทอน ×0.37 0.58 ±0.02 1,368 ±12 15.6% 2026-02-13 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

D เอเจนต์ 1,392 [1,382–1,401] เปอร์เซ็นไทล์ 10 · #52 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
τ²-bench (Sierra) tau2/banking_knowledge ลดทอน ×0.76 0.14 ±0.03 1,436 ±6 80.9% 2026-05-05 high

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

B คณิตศาสตร์ 1,400 [1,395–1,404] เปอร์เซ็นไทล์ 70 · #76 · องค์ประกอบ: 3
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/math 1,450 ±3.52 1,441 ±3 50.9% 2026-10-02 —
Epoch AI frontiermath_t1_3 ลดทอน ×0.86 0.25 ±0.03 1,374 ±6 27.1% 2026-06-11 —
Epoch AI frontiermath_t4 ลดทอน ×0.86 0.00 ±0.00 1,393 ±0 15.4% 2026-06-11 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

B ภาพ 1,427 [1,424–1,430] เปอร์เซ็นไทล์ 63 · #42 · องค์ประกอบ: 3 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena vision/overall 1,263 ±2.32 1,442 ±2 63.0% 2026-10-02 —
LMArena vision/ocr 1,270 ±2.44 1,443 ±2 15.7% 2026-10-02 —
LMArena vision/diagram 1,274 ±3.58 1,440 ±3 15.4% 2026-10-02 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A งานเขียน 1,455 [1,451–1,458] เปอร์เซ็นไทล์ 88 · #33 · องค์ประกอบ: 2 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/creative_writing 1,454 ±2.59 1,483 ±3 62.3% 2026-10-02 —
LMArena text/longer_query 1,449 ±2.00 1,446 ±2 31.6% 2026-10-02 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: 繁體中文 1,444 [1,439–1,449] เปอร์เซ็นไทล์ 86 · #33 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/chinese 1,508 ±3.41 1,459 ±3 93.9% 2026-10-02 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: Deutsch 1,458 [1,448–1,469] เปอร์เซ็นไทล์ 95 · #8 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/german 1,486 ±6.41 1,477 ±6 93.4% 2026-10-02 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: English 1,435 [1,431–1,438] เปอร์เซ็นไทล์ 86 · #40 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/english 1,458 ±1.69 1,449 ±2 94.0% 2026-10-02 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: Español 1,450 [1,440–1,459] เปอร์เซ็นไทล์ 93 · #12 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/spanish 1,474 ±5.66 1,467 ±5 93.4% 2026-10-02 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

B ภาษา: Français 1,436 [1,424–1,447] เปอร์เซ็นไทล์ 78 · #30 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/french 1,472 ±6.81 1,453 ±6 93.2% 2026-10-02 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: 日本語 1,455 [1,444–1,465] เปอร์เซ็นไทล์ 88 · #16 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/japanese 1,462 ±7.52 1,473 ±6 93.4% 2026-10-02 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: 한국어 1,444 [1,435–1,454] เปอร์เซ็นไทล์ 88 · #17 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/korean 1,434 ±6.66 1,461 ±5 93.5% 2026-10-02 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: Polski 1,457 [1,451–1,464] เปอร์เซ็นไทล์ 91 · #13 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/polish 1,479 ±4.29 1,474 ±4 93.8% 2026-10-02 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: Русский 1,446 [1,441–1,450] เปอร์เซ็นไทล์ 87 · #31 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/russian 1,461 ±2.88 1,461 ±3 94.0% 2026-10-02 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

ประวัติ

fedi-index รายเดือน
ดูแบบตาราง
โมเดล 2026-10
Gemini 2.5 Pro 1,413 B

แบดจ์

แสดง fedi-index ของโมเดลบนเว็บไซต์หรือใน README ของคุณ แบดจ์อัปเดตอัตโนมัติและลิงก์มายังหน้านี้

fedi-index: Gemini 2.5 Pro

ข้อมูลเป็น CC BY 4.0: โปรดคงลิงก์ไปยัง fedi.software