Zum Inhalt springen
fedi.software

Qwen3 235B A22B Thinking 2507 im fedi-index

Der Wert in jedem Bereich, woraus er besteht, Preis-Leistung, lokaler Betrieb und Verlauf.

fedi-index · Allgemein

B 1’389 ±5

Perzentil 62 · #112

Menschen bevorzugen / Löst Aufgaben

1’398 / 1’378

Menschliche Stimmen vs. Benchmarks, Elo-eq

Preis-Leistung

+12

$ 0.975 pro 1 Mio. Tokens, Median von 11 Anbietern

Auf deiner Hardware

Geschlossene Gewichte: nur Cloud.

Aufschlüsselung des Werts

B Allgemein 1’389 [1’383–1’394] Perzentil 62 · #112 · Komponenten: 9
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
Epoch AI eci 144 ±0.86 1’389 ±7 36.6% 2025-07-25 —
LMArena text/overall 1’415 ±3.34 1’415 ±3 16.0% 2026-10-02 —
LMArena text/hard_prompts 1’416 ±4.83 1’409 ±4 15.5% 2026-10-02 —
LMArena text/instruction_following 1’385 ±6.36 1’399 ±6 7.2% 2026-10-02 —
LMArena text/expert 1’460 ±14 1’444 ±12 5.2% 2026-10-02 —
Epoch AI simpleqa_verified Alterung ×0.61 0.40 ±0.02 1’424 ±5 4.0% 2026-08-27 —
LMArena text/longer_query 1’399 ±7.25 1’399 ±7 3.5% 2026-10-02 —
LMArena text/multi_turn 1’407 ±8.01 1’405 ±7 3.4% 2026-10-02 —
Epoch AI gpqa_diamond Alterung ×0.26 0.80 ±0.03 1’412 ±12 1.2% 2025-12-11 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Code 1’381 [1’369–1’392] Perzentil 57 · #119 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/coding 1’424 ±7.51 1’403 ±7 88.9% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Mathematik 1’370 [1’351–1’390] Perzentil 53 · #120 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/math 1’412 ±13 1’405 ±12 82.9% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Schreiben 1’392 [1’380–1’404] Perzentil 61 · #104 · Komponenten: 2 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/creative_writing 1’384 ±9.10 1’412 ±9 58.7% 2026-10-02 —
LMArena text/longer_query 1’399 ±7.25 1’399 ±7 33.7% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 繁體中文 1’419 [1’400–1’438] Perzentil 72 · #64 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/chinese 1’482 ±13 1’439 ±11 91.4% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: English 1’405 [1’396–1’414] Perzentil 65 · #96 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/english 1’429 ±4.82 1’419 ±5 93.5% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: 日本語 1’398 [1’378–1’418] Perzentil 51 · #63 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/japanese 1’387 ±15 1’417 ±11 91.1% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

C Sprache: Polski 1’383 [1’367–1’399] Perzentil 33 · #88 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/polish 1’390 ±11 1’398 ±9 92.2% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

B Sprache: Русский 1’389 [1’370–1’409] Perzentil 56 · #104 · Komponenten: 1 vorläufig
Quelle Komponente Wert Elo-eq Gewicht Gemessen Variante
LMArena text/russian 1’400 ±12 1’407 ±11 91.3% 2026-10-02 —

Das Gewicht ist der Anteil der Komponente am Wert (der Rest ist der Prior, der Modelle mit wenig Daten zum Median der Population zieht). Methodik

Verlauf

fedi-index nach Monat
Dasselbe als Tabelle
Modell 2026-10
Qwen3 235B A22B Thinking 2507 1’389 B

Badge

Zeige den fedi-index des Modells auf deiner Website oder in einer README. Das Badge aktualisiert sich selbst und verlinkt auf diese Seite.

fedi-index: Qwen3 235B A22B Thinking 2507

Daten CC BY 4.0: Link zu fedi.software beibehalten.