GPT-6 Astra ใน fedi-index
คะแนนในทุกหมวด องค์ประกอบของคะแนน ความคุ้มค่า การรันบนเครื่อง และประวัติ
fedi-index · ภาพรวม
A 1,463 ±8
เปอร์เซ็นไทล์ 95 · #16
คนชอบ / แก้โจทย์
1,437 / 1,514
โหวตจากผู้คนเทียบกับเบนช์มาร์ก, Elo-eq
ความคุ้มค่า
+12
US$20 ต่อ 1M โทเค็น, ค่ามัธยฐานจาก 24 ผู้ให้บริการ · ราคาผู้พัฒนา US$20
บนฮาร์ดแวร์ของคุณ
น้ำหนักแบบปิด: ใช้ได้บนคลาวด์เท่านั้น
รายละเอียดคะแนน
A ภาพรวม 1,463 [1,455–1,471] เปอร์เซ็นไทล์ 95 · #16 · องค์ประกอบ: 9
| แหล่งข้อมูล | องค์ประกอบ | ค่า | Elo-eq | น้ำหนัก | วันที่วัด | รุ่นย่อย |
|---|---|---|---|---|---|---|
| Epoch AI |
eci
|
166 ±2.07 | 1,568 ±16 | 23.7% | 2026-09-03 | — |
| LMArena |
text/overall
|
1,442 ±3.49 | 1,442 ±4 | 18.7% | 2026-10-02 | max |
| LMArena |
text/hard_prompts
|
1,463 ±4.23 | 1,452 ±4 | 18.5% | 2026-10-02 | max |
| LMArena |
text/instruction_following
|
1,455 ±5.69 | 1,465 ±5 | 8.7% | 2026-10-02 | max |
| LMArena |
text/expert
|
1,492 ±10 | 1,470 ±8 | 7.6% | 2026-10-02 | max |
| Epoch AI |
simpleqa_verified
ลดทอน ×0.61 |
0.76 ±0.01 | 1,535 ±4 | 4.9% | 2026-08-30 | max |
| LMArena |
text/longer_query
|
1,458 ±5.12 | 1,455 ±5 | 4.5% | 2026-10-02 | max |
| LMArena |
text/multi_turn
|
1,452 ±8.60 | 1,446 ±8 | 3.9% | 2026-10-02 | max |
| Epoch AI |
gpqa_diamond
ค่าผิดปกติ ลดทอน ×0.26 |
0.96 ±0.01 | 1,485 ±6 | 1.0% | 2026-08-30 | max |
น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี
A เขียนโค้ด 1,471 [1,467–1,474] เปอร์เซ็นไทล์ 98 · #6 · องค์ประกอบ: 2 เบื้องต้น
| แหล่งข้อมูล | องค์ประกอบ | ค่า | Elo-eq | น้ำหนัก | วันที่วัด | รุ่นย่อย |
|---|---|---|---|---|---|---|
| LMArena |
webdev/overall
|
1,788 ±5.25 | 1,532 ±2 | 60.7% | 2026-10-01 | max |
| LMArena |
text/coding
ค่าผิดปกติ |
1,489 ±6.62 | 1,460 ±6 | 26.5% | 2026-10-02 | max |
น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี
A เอเจนต์ 1,481 [1,472–1,491] เปอร์เซ็นไทล์ 96 · #3 · องค์ประกอบ: 1 เบื้องต้น
| แหล่งข้อมูล | องค์ประกอบ | ค่า | Elo-eq | น้ำหนัก | วันที่วัด | รุ่นย่อย |
|---|---|---|---|---|---|---|
| LMArena |
agent/overall
|
0.12 ±0.01 | 1,514 ±5 | 89.5% | 2026-10-02 | max |
น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี
S คณิตศาสตร์ 1,478 [1,468–1,488] เปอร์เซ็นไทล์ 98 · #6 · องค์ประกอบ: 3
| แหล่งข้อมูล | องค์ประกอบ | ค่า | Elo-eq | น้ำหนัก | วันที่วัด | รุ่นย่อย |
|---|---|---|---|---|---|---|
| LMArena |
text/math
|
1,469 ±14 | 1,459 ±13 | 37.4% | 2026-10-02 | max |
| Epoch AI |
frontiermath_t1_3
ลดทอน ×0.86 |
0.94 ±0.01 | 1,524 ±3 | 36.4% | 2026-08-30 | max |
| Epoch AI |
frontiermath_t4
ลดทอน ×0.86 |
0.98 ±0.02 | 1,548 ±4 | 17.8% | 2026-08-30 | high |
น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี
B ภาพ 1,441 [1,434–1,448] เปอร์เซ็นไทล์ 75 · #29 · องค์ประกอบ: 3 เบื้องต้น
| แหล่งข้อมูล | องค์ประกอบ | ค่า | Elo-eq | น้ำหนัก | วันที่วัด | รุ่นย่อย |
|---|---|---|---|---|---|---|
| LMArena |
vision/overall
|
1,280 ±5.74 | 1,456 ±5 | 65.1% | 2026-10-02 | max |
| LMArena |
vision/ocr
|
1,292 ±6.70 | 1,464 ±6 | 15.4% | 2026-10-02 | max |
| LMArena |
vision/diagram
|
1,299 ±11 | 1,463 ±10 | 12.7% | 2026-10-02 | max |
น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี
A งานเขียน 1,434 [1,424–1,443] เปอร์เซ็นไทล์ 80 · #54 · องค์ประกอบ: 2 เบื้องต้น
| แหล่งข้อมูล | องค์ประกอบ | ค่า | Elo-eq | น้ำหนัก | วันที่วัด | รุ่นย่อย |
|---|---|---|---|---|---|---|
| LMArena |
text/creative_writing
|
1,419 ±7.11 | 1,448 ±7 | 59.7% | 2026-10-02 | max |
| LMArena |
text/longer_query
|
1,458 ±5.12 | 1,455 ±5 | 33.4% | 2026-10-02 | max |
น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี
B ภาษา: 繁體中文 1,424 [1,408–1,440] เปอร์เซ็นไทล์ 75 · #56 · องค์ประกอบ: 1 เบื้องต้น
| แหล่งข้อมูล | องค์ประกอบ | ค่า | Elo-eq | น้ำหนัก | วันที่วัด | รุ่นย่อย |
|---|---|---|---|---|---|---|
| LMArena |
text/chinese
|
1,487 ±11 | 1,443 ±9 | 92.2% | 2026-10-02 | max |
น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี
B ภาษา: English 1,424 [1,414–1,434] เปอร์เซ็นไทล์ 76 · #66 · องค์ประกอบ: 1 เบื้องต้น
| แหล่งข้อมูล | องค์ประกอบ | ค่า | Elo-eq | น้ำหนัก | วันที่วัด | รุ่นย่อย |
|---|---|---|---|---|---|---|
| LMArena |
text/english
|
1,448 ±5.10 | 1,439 ±5 | 93.4% | 2026-10-02 | max |
น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี
B ภาษา: Русский 1,425 [1,410–1,439] เปอร์เซ็นไทล์ 77 · #55 · องค์ประกอบ: 1 เบื้องต้น
| แหล่งข้อมูล | องค์ประกอบ | ค่า | Elo-eq | น้ำหนัก | วันที่วัด | รุ่นย่อย |
|---|---|---|---|---|---|---|
| LMArena |
text/russian
|
1,440 ±8.83 | 1,443 ±8 | 92.6% | 2026-10-02 | max |
น้ำหนักคือสัดส่วนขององค์ประกอบในคะแนน (ส่วนที่เหลือคือค่าก่อนหน้า ซึ่งดึงโมเดลที่มีข้อมูลน้อยเข้าหาค่ามัธยฐานของกลุ่ม) ระเบียบวิธี
ประวัติ
ดูแบบตาราง
| โมเดล | 2026-10 |
|---|---|
| GPT-6 Astra | 1,463 A |
แบดจ์
แสดง fedi-index ของโมเดลบนเว็บไซต์หรือใน README ของคุณ แบดจ์อัปเดตอัตโนมัติและลิงก์มายังหน้านี้
ข้อมูลเป็น CC BY 4.0: โปรดคงลิงก์ไปยัง fedi.software