Aller au contenu
fedi.software

Trinity Large Thinking dans le fedi-index

Le score dans chaque catégorie, sa composition, le rapport qualité-prix, l'exécution locale et l'historique.

fedi-index · Général

C 1 325 ±2

Percentile 40 · #176 · provisoire

Préféré par les humains / Résout des tâches

1 333 / —

Votes humains et benchmarks, Elo-eq

Rapport qualité-prix

-30

0,3875 $US par million de tokens, médiane de 5 fournisseurs · éditeur 0,3875 $US

Sur votre matériel

  • 128 Go de mémoire unifiée #41 · IQ2_XXS · compression forte · ≈31 tok/s

Décomposition du score

C Général 1 325 [1 323–1 328] Percentile 40 · #176 · composantes : 6 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/overall 1 340 ±2,37 1 340 ±2 25,8% 2026-10-02 —
LMArena text/hard_prompts 1 341 ±2,85 1 342 ±3 25,7% 2026-10-02 —
LMArena text/instruction_following 1 324 ±3,49 1 341 ±3 12,6% 2026-10-02 —
LMArena text/expert 1 358 ±5,97 1 360 ±5 12,0% 2026-10-02 —
LMArena text/longer_query 1 318 ±3,41 1 324 ±3 6,3% 2026-10-02 —
LMArena text/multi_turn 1 320 ±4,55 1 326 ±4 6,1% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Code 1 344 [1 340–1 348] Percentile 41 · #164 · composantes : 2 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena webdev/overall 1 238 ±10 1 375 ±3 45,4% 2026-10-01 —
LMArena text/coding 1 357 ±3,80 1 343 ±3 44,8% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Maths 1 340 [1 328–1 352] Percentile 43 · #145 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/math 1 366 ±7,58 1 361 ±7 86,6% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Écriture 1 322 [1 316–1 328] Percentile 43 · #154 · composantes : 2 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/creative_writing 1 307 ±4,79 1 333 ±5 61,2% 2026-10-02 —
LMArena text/longer_query 1 318 ±3,41 1 324 ±3 32,4% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Langue : 繁體中文 1 342 [1 332–1 353] Percentile 36 · #143 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/chinese 1 373 ±7,22 1 352 ±6 93,3% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Langue : Deutsch 1 349 [1 326–1 371] Percentile 34 · #96 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/german 1 356 ±15 1 364 ±13 90,3% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Langue : English 1 333 [1 327–1 339] Percentile 40 · #163 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/english 1 356 ±3,10 1 341 ±3 93,9% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Langue : Español 1 321 [1 304–1 339] Percentile 14 · #129 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/spanish 1 328 ±11 1 332 ±10 91,8% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Langue : Français 1 342 [1 325–1 360] Percentile 19 · #109 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/french 1 365 ±10 1 354 ±10 91,9% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Langue : 한국어 1 350 [1 332–1 368] Percentile 27 · #100 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/korean 1 306 ±13 1 364 ±10 91,6% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

D Langue : Polski 1 321 [1 301–1 341] Percentile 9 · #119 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/polish 1 312 ±13 1 332 ±11 91,0% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

C Langue : Русский 1 341 [1 332–1 351] Percentile 40 · #142 · composantes : 1 provisoire
Source Composante Valeur Elo-eq Poids Mesuré le Variante
LMArena text/russian 1 338 ±5,60 1 351 ±5 93,5% 2026-10-02 —

Le poids est la part de la composante dans le score (le reste est le prior, qui ramène les modèles peu mesurés vers la médiane de la population). Méthodologie

Historique

fedi-index par mois
La même chose en tableau
Modèle 2026-10
Trinity Large Thinking 1 325 C

Badge

Affichez le fedi-index du modèle sur votre site ou dans un README. Le badge se met à jour tout seul et renvoie vers cette page.

fedi-index: Trinity Large Thinking

Données CC BY 4.0 : conservez le lien vers fedi.software.