Przejdź do treści
fedi.software

Porównaj modele AI

Zestaw obok siebie do czterech modeli: tier i Elo w każdym rankingu, ceny, okno kontekstu i data premiery.

Zaktualizowano · Źródła: models.dev

Wskaźnik Muse Spark 1.2 Meta
Tekst S 1 483 1 474–1 492
Programowanie S 1 494 1 477–1 511
Web dev A 1 532 1 518–1 545
Agenci C -0,033 -0,040–-0,026
Wejście / wyjście, za 1M 0,10 USD / 0,20 USD
Okno kontekstu 1M
Maks. wyjście 131K
Premiera 5 sierpnia 2026
Granica wiedzy —
Licencja —
Wejście tekst, obraz, wideo, plik, audio
Aplikacja —

Do czego służy porównanie

Strona porównania stawia obok siebie do 4 modeli AI w kolumnach. Dla każdego widzisz tier i ocenę w każdym rankingu, w którym model występuje, ceny za jednostkę, okno kontekstu, maksymalną długość odpowiedzi, modalności (tekst, obraz, dźwięk), oznaczenie otwartych wag i datę premiery. To szybki sposób, żeby sprawdzić, czy model z czołówki rankingu tekstowego równie dobrze wypada w programowaniu i ile trzeba za niego zapłacić.

Jak dodać modele

  1. Zacznij wpisywać nazwę modelu w polu wyboru i wskaż go z listy.
  2. Albo zaznacz pole „Porównaj” w dowolnej tabeli rankingu – model trafi do zestawienia.
  3. Dodaj co najmniej dwa modele, maksymalnie cztery.
  4. Przycisk „Wyczyść” usuwa wybór i pozwala zacząć od nowa.

Jak czytać zestawienie

  • Porównuj oceny w obrębie jednego rankingu. Elo z rankingu tekstowego i „Wynik” z rankingu agentów to różne skale – nie da się ich zestawić bezpośrednio.
  • Pusta komórka to brak danych w źródle dla tego modelu, a nie zero.
  • Cena i kontekst idą w parze: tańszy model z krótszym kontekstem może wyjść drożej, jeśli musisz dzielić zadania na wiele zapytań.

Skąd są dane

Oceny pochodzą z LMArena. Ceny, kontekst i modalności – z models.dev i LiteLLM. Dane odświeżamy codziennie, a przy tabelach rankingów widać datę aktualizacji.

Udostępnianie

Link do porównania z wybranymi modelami możesz wysłać komuś z zespołu. Wyszukiwarki indeksują tylko samą, pustą stronę porównania – zestawienia z wybranymi modelami służą do dzielenia się wynikiem.

Przykład użycia

Wybierasz model do czatu w sklepie internetowym? Dodaj dwa modele z górnego tieru rankingu tekstowego i jeden tańszy z tieru B. Sprawdź, jak duża jest różnica w cenie za 1M tokenów i czy tańszy model ma wystarczające okno kontekstu na opisy produktów. Często okazuje się, że do prostych pytań klientów droższy model nie jest potrzebny.