ข้ามไปยังเนื้อหา
fedi.software

Gemini 3.5 Flash ใน fedi-index

คะแนนในทุกหมวด องค์ประกอบของคะแนน ความคุ้มค่า การรันบนเครื่อง และประวัติ

fedi-index · ภาพรวม

A 1,457 ±5

เปอร์เซ็นไทล์ 93 · #22

คนชอบ / แก้โจทย์

1,460 / 1,453

โหวตจากผู้คนเทียบกับเบนช์มาร์ก, Elo-eq

ความคุ้มค่า

+49

US$3.38 ต่อ 1M โทเค็น, ค่ามัธยฐานจาก 29 ผู้ให้บริการ · ราคาผู้พัฒนา US$3.38

บนฮาร์ดแวร์ของคุณ

น้ำหนักแบบปิด: ใช้ได้บนคลาวด์เท่านั้น

รายละเอียดคะแนน

A ภาพรวม 1,457 [1,452–1,462] เปอร์เซ็นไทล์ 93 · #22 · องค์ประกอบ: 9
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
Epoch AI eci 154 ±1.02 1,473 ±8 32.8% 2026-05-19 —
LMArena text/overall 1,482 ±1.98 1,482 ±2 15.8% 2026-10-02 high
LMArena text/hard_prompts 1,488 ±2.33 1,474 ±2 15.8% 2026-10-02 high
LMArena text/instruction_following 1,467 ±2.85 1,476 ±3 7.8% 2026-10-02 high
LMArena text/expert 1,495 ±4.36 1,472 ±4 7.6% 2026-10-02 high
LMArena text/longer_query 1,482 ±2.71 1,477 ±2 3.9% 2026-10-02 high
Epoch AI simpleqa_verified ลดทอน ×0.61 0.66 ±0.01 1,505 ±5 3.9% 2026-08-27 high
LMArena text/multi_turn 1,481 ±3.77 1,472 ±3 3.8% 2026-10-02 high
Epoch AI gpqa_diamond ลดทอน ×0.26 0.93 ±0.02 1,471 ±8 1.5% 2026-05-22 high

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A เขียนโค้ด 1,439 [1,435–1,442] เปอร์เซ็นไทล์ 89 · #31 · องค์ประกอบ: 3
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena webdev/overall 1,499 ±3.69 1,449 ±1 39.4% 2026-10-01 high
LMArena text/coding 1,492 ±3.09 1,464 ±3 38.3% 2026-10-02 high
Epoch AI swe_bench_verified ลดทอน ×0.37 0.79 ±0.02 1,480 ±10 14.0% 2026-06-01 high

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A คณิตศาสตร์ 1,454 [1,446–1,461] เปอร์เซ็นไทล์ 92 · #20 · องค์ประกอบ: 3
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/math 1,504 ±6.37 1,493 ±6 51.7% 2026-10-02 high
Epoch AI frontiermath_t1_3 ลดทอน ×0.86 0.63 ±0.03 1,457 ±6 29.6% 2026-06-10 high
Epoch AI frontiermath_t4 ลดทอน ×0.86 0.27 ±0.07 1,435 ±11 11.2% 2026-06-10 high

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาพ 1,467 [1,463–1,472] เปอร์เซ็นไทล์ 93 · #9 · องค์ประกอบ: 3 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena vision/overall 1,310 ±3.61 1,484 ±3 63.3% 2026-10-02 high
LMArena vision/ocr 1,316 ±3.79 1,487 ±4 15.6% 2026-10-02 medium
LMArena vision/diagram 1,326 ±5.69 1,486 ±5 14.9% 2026-10-02 medium

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A งานเขียน 1,474 [1,470–1,479] เปอร์เซ็นไทล์ 96 · #13 · องค์ประกอบ: 2 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/creative_writing 1,470 ±3.76 1,500 ±4 61.8% 2026-10-02 medium
LMArena text/longer_query 1,482 ±2.71 1,477 ±2 32.0% 2026-10-02 high

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: 繁體中文 1,457 [1,449–1,465] เปอร์เซ็นไทล์ 93 · #16 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/chinese 1,526 ±5.35 1,474 ±4 93.7% 2026-10-02 high

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: Deutsch 1,460 [1,442–1,478] เปอร์เซ็นไทล์ 96 · #7 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/german 1,494 ±12 1,483 ±10 91.7% 2026-10-02 medium

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: English 1,456 [1,451–1,462] เปอร์เซ็นไทล์ 94 · #18 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/english 1,480 ±2.64 1,473 ±3 93.9% 2026-10-02 high

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: Español 1,452 [1,438–1,466] เปอร์เซ็นไทล์ 94 · #10 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/spanish 1,479 ±8.55 1,472 ±8 92.6% 2026-10-02 high

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: Français 1,448 [1,434–1,463] เปอร์เซ็นไทล์ 87 · #18 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/french 1,488 ±8.56 1,468 ±8 92.6% 2026-10-02 high

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: 日本語 1,468 [1,451–1,485] เปอร์เซ็นไทล์ 94 · #8 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/japanese 1,486 ±13 1,491 ±9 92.0% 2026-10-02 high

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: 한국어 1,454 [1,439–1,469] เปอร์เซ็นไทล์ 92 · #12 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/korean 1,452 ±11 1,475 ±8 92.5% 2026-10-02 medium

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: Polski 1,485 [1,468–1,502] เปอร์เซ็นไทล์ 100 · #1 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/polish 1,521 ±11 1,510 ±9 92.0% 2026-10-02 high

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: Русский 1,472 [1,465–1,479] เปอร์เซ็นไทล์ 95 · #12 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/russian 1,492 ±4.40 1,490 ±4 93.7% 2026-10-02 high

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

ประวัติ

fedi-index รายเดือน
ดูแบบตาราง
โมเดล 2026-10
Gemini 3.5 Flash 1,457 A

แบดจ์

แสดง fedi-index ของโมเดลบนเว็บไซต์หรือใน README ของคุณ แบดจ์อัปเดตอัตโนมัติและลิงก์มายังหน้านี้

fedi-index: Gemini 3.5 Flash

ข้อมูลเป็น CC BY 4.0: โปรดคงลิงก์ไปยัง fedi.software