Przejdź do treści
fedi.software

Porównaj modele AI

Zestaw obok siebie do czterech modeli: tier i Elo w każdym rankingu, ceny, okno kontekstu i data premiery.

Zaktualizowano · Źródła: models.dev

Wskaźnik GPT-5.6 Sol OpenAI
Tekst S 1 456 1 452–1 461
Programowanie S 1 496 1 489–1 503
Web dev A 1 620 1 614–1 626
Agenci A 0,064 0,052–0,077
Wejście / wyjście, za 1M 2 USD / 10 USD
Okno kontekstu 1M
Maks. wyjście 128K
Premiera 9 lipca 2026
Granica wiedzy 2026-02
Licencja —
Wejście tekst, obraz, plik
Aplikacja —

Do czego służy porównanie

Strona porównania stawia obok siebie do 4 modeli AI w kolumnach. Dla każdego widzisz tier i ocenę w każdym rankingu, w którym model występuje, ceny za jednostkę, okno kontekstu, maksymalną długość odpowiedzi, modalności (tekst, obraz, dźwięk), oznaczenie otwartych wag i datę premiery. To szybki sposób, żeby sprawdzić, czy model z czołówki rankingu tekstowego równie dobrze wypada w programowaniu i ile trzeba za niego zapłacić.

Jak dodać modele

  1. Zacznij wpisywać nazwę modelu w polu wyboru i wskaż go z listy.
  2. Albo zaznacz pole „Porównaj” w dowolnej tabeli rankingu – model trafi do zestawienia.
  3. Dodaj co najmniej dwa modele, maksymalnie cztery.
  4. Przycisk „Wyczyść” usuwa wybór i pozwala zacząć od nowa.

Jak czytać zestawienie

  • Porównuj oceny w obrębie jednego rankingu. Elo z rankingu tekstowego i „Wynik” z rankingu agentów to różne skale – nie da się ich zestawić bezpośrednio.
  • Pusta komórka to brak danych w źródle dla tego modelu, a nie zero.
  • Cena i kontekst idą w parze: tańszy model z krótszym kontekstem może wyjść drożej, jeśli musisz dzielić zadania na wiele zapytań.

Skąd są dane

Oceny pochodzą z LMArena. Ceny, kontekst i modalności – z models.dev i LiteLLM. Dane odświeżamy codziennie, a przy tabelach rankingów widać datę aktualizacji.

Udostępnianie

Link do porównania z wybranymi modelami możesz wysłać komuś z zespołu. Wyszukiwarki indeksują tylko samą, pustą stronę porównania – zestawienia z wybranymi modelami służą do dzielenia się wynikiem.

Przykład użycia

Wybierasz model do czatu w sklepie internetowym? Dodaj dwa modele z górnego tieru rankingu tekstowego i jeden tańszy z tieru B. Sprawdź, jak duża jest różnica w cenie za 1M tokenów i czy tańszy model ma wystarczające okno kontekstu na opisy produktów. Często okazuje się, że do prostych pytań klientów droższy model nie jest potrzebny.