ข้ามไปยังเนื้อหา
fedi.software

DeepSeek V4 Pro 0423 ใน fedi-index

คะแนนในทุกหมวด องค์ประกอบของคะแนน ความคุ้มค่า การรันบนเครื่อง และประวัติ

fedi-index · ภาพรวม

A 1,427 ±5

เปอร์เซ็นไทล์ 82 · #54

คนชอบ / แก้โจทย์

1,437 / 1,415

โหวตจากผู้คนเทียบกับเบนช์มาร์ก, Elo-eq

ความคุ้มค่า

+33

US$1.91 ต่อ 1M โทเค็น, ค่ามัธยฐานจาก 49 ผู้ให้บริการ

บนฮาร์ดแวร์ของคุณ

ไม่สามารถรันบนเครื่องอ้างอิงได้

รายละเอียดคะแนน

A ภาพรวม 1,427 [1,422–1,432] เปอร์เซ็นไทล์ 82 · #54 · องค์ประกอบ: 9
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
Epoch AI eci 149 ±0.87 1,431 ±7 34.5% 2026-04-24 —
LMArena text/overall 1,451 ±1.98 1,451 ±2 15.6% 2026-10-02 —
LMArena text/hard_prompts 1,461 ±2.33 1,450 ±2 15.6% 2026-10-02 —
LMArena text/expert 1,463 ±4.29 1,446 ±4 7.5% 2026-10-02 —
LMArena text/instruction_following 1,447 ±5.25 1,458 ±5 7.2% 2026-10-02 high
Epoch AI simpleqa_verified ลดทอน ×0.61 0.47 ±0.02 1,445 ±5 3.8% 2026-08-27 max
LMArena text/multi_turn 1,467 ±3.57 1,460 ±3 3.8% 2026-10-02 —
LMArena text/longer_query 1,458 ±4.71 1,454 ±4 3.7% 2026-10-02 high
Epoch AI gpqa_diamond ลดทอน ×0.26 0.91 ±0.02 1,463 ±10 1.3% 2026-08-06 high

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A เขียนโค้ด 1,439 [1,434–1,444] เปอร์เซ็นไทล์ 90 · #30 · องค์ประกอบ: 3
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena webdev/overall 1,583 ±4.76 1,473 ±1 40.6% 2026-10-01 high
LMArena text/coding 1,469 ±5.79 1,443 ±5 36.6% 2026-10-02 high
Epoch AI swe_bench_verified ลดทอน ×0.37 0.78 ±0.02 1,472 ±10 14.2% 2026-06-18 max

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

B เอเจนต์ 1,435 [1,428–1,442] เปอร์เซ็นไทล์ 54 · #27 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena agent/overall 0.01 ±0.01 1,461 ±4 90.0% 2026-10-02 high-0813

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

B คณิตศาสตร์ 1,413 [1,407–1,420] เปอร์เซ็นไทล์ 79 · #54 · องค์ประกอบ: 3
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/math 1,455 ±6.01 1,446 ±6 49.7% 2026-10-02 high
Epoch AI frontiermath_t1_3 ลดทอน ×0.86 0.45 ±0.03 1,419 ±6 27.8% 2026-06-17 max
Epoch AI frontiermath_t4 ลดทอน ×0.86 0.02 ±0.02 1,396 ±4 15.4% 2026-06-17 max

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A งานเขียน 1,452 [1,446–1,457] เปอร์เซ็นไทล์ 87 · #36 · องค์ประกอบ: 2 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/creative_writing 1,446 ±3.69 1,475 ±4 62.9% 2026-10-02 —
LMArena text/longer_query 1,458 ±4.71 1,454 ±4 30.8% 2026-10-02 high

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

B ภาษา: 繁體中文 1,427 [1,419–1,435] เปอร์เซ็นไทล์ 76 · #54 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/chinese 1,486 ±5.57 1,442 ±4 93.6% 2026-10-02 high

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

B ภาษา: Deutsch 1,432 [1,417–1,447] เปอร์เซ็นไทล์ 80 · #30 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/german 1,457 ±9.86 1,451 ±8 92.4% 2026-10-02 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: English 1,436 [1,430–1,440] เปอร์เซ็นไทล์ 86 · #39 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/english 1,459 ±2.60 1,450 ±3 93.9% 2026-10-02 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

B ภาษา: Español 1,434 [1,421–1,447] เปอร์เซ็นไทล์ 80 · #31 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/spanish 1,458 ±7.78 1,452 ±7 92.9% 2026-10-02 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

B ภาษา: Français 1,435 [1,422–1,447] เปอร์เซ็นไทล์ 78 · #31 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/french 1,472 ±7.44 1,452 ±7 93.0% 2026-10-02 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: 日本語 1,441 [1,425–1,458] เปอร์เซ็นไทล์ 84 · #21 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/japanese 1,447 ±12 1,462 ±9 92.2% 2026-10-02 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: Polski 1,441 [1,427–1,455] เปอร์เซ็นไทล์ 84 · #22 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/polish 1,462 ±9.13 1,459 ±8 92.7% 2026-10-02 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

A ภาษา: Русский 1,439 [1,432–1,446] เปอร์เซ็นไทล์ 84 · #39 · องค์ประกอบ: 1 เบื้องต้น
แหล่งข้อมูล องค์ประกอบ ค่า Elo-eq น้ำหนัก วันที่วัด รุ่นย่อย
LMArena text/russian 1,453 ±4.18 1,455 ±4 93.8% 2026-10-02 —

น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี

ประวัติ

fedi-index รายเดือน
ดูแบบตาราง
โมเดล 2026-10
DeepSeek V4 Pro 0423 1,427 A

แบดจ์

แสดง fedi-index ของโมเดลบนเว็บไซต์หรือใน README ของคุณ แบดจ์อัปเดตอัตโนมัติและลิงก์มายังหน้านี้

fedi-index: DeepSeek V4 Pro 0423

ข้อมูลเป็น CC BY 4.0: โปรดคงลิงก์ไปยัง fedi.software