Przejdź do treści
fedi.software

Modele AI z roku 2023: kto co wydał

Każde istotne wydanie modelu miesiąc po miesiącu: dostawca i jego kraj, otwarte lub zamknięte wagi, typ, okno kontekstu, rozmiar modeli otwartych — oraz w jakich zadaniach modele z danego roku prowadzą dziś.

2023 9 wydań · 5 z otwartymi wagami

Modele z 2023 prowadzące dziś w poszczególnych zadaniach

Grudzień

  1. Mistral 7B Instruct v0.2 HFMistral AIFrancjaOtwarte wagiLLM7.2B
  2. C mixtral-8x7b-instruct-v0.1Mistral AIFrancjaOtwarte wagiLLM32K

Listopad

  1. Qwen 72B HFAlibabaChinyOtwarte wagiLLM72.3B
  2. D dall-e-3OpenAIStany ZjednoczoneZamkniętyObraz
  3. C GPT 4OpenAIStany ZjednoczoneZamkniętyLLM8K
  4. C GPT-4 TurboOpenAIStany ZjednoczoneZamkniętyWizja (VLM)128K

Lipiec

  1. Llama 2 7b hf HFMetaStany ZjednoczoneOtwarte wagiLLM6.7B

Marzec

  1. C GPT-3.5 TurboOpenAIStany ZjednoczoneZamkniętyLLM16K

Luty

  1. pythia-6.9b HFEleutherAIStany ZjednoczoneOtwarte wagiLLM7B

Daty wydania pochodzą z katalogów modeli (models.dev, LiteLLM, Hugging Face); modele znane tylko z roku wydania nie są pokazywane. Liderami roku są jego modele, które zajmują dziś najwyższe miejsca w naszych rankingach.

Zaktualizowano · Źródła: models.dev (MIT), LiteLLM (MIT), LMArena (CC BY 4.0), Hugging Face

Arena (LMArena) scores: Arena Leaderboard Dataset by LMArena, CC BY 4.0. Modified by fedi.software (filtered, re-ranked, aggregated). Not endorsed by LMArena.

Kalendarz premier modeli AI

Ten wykres układa wydania modeli na jednej osi czasu. Lata biegną od góry, od nowszych do starszych, a w obrębie roku premiery są pogrupowane według miesięcy. Każdy wiersz to jeden model: dostawca, kraj, w którym firma ma siedzibę, otwarte lub zamknięte wagi, typ i okno kontekstu. Przy modelach otwartych widać też liczbę parametrów, a w przypadku modelu z mieszanką ekspertów (MoE) druga liczba oznacza część aktywną, czyli parametry, które faktycznie pracują przy każdym tokenie.

Na osi trafiają modele laboratoriów AI, które mają ocenę w naszych rankingach albo opublikowały wagi na Hugging Face. Pośredników, routery i amatorskie dostrojenia pomijamy, żeby lista pokazywała, kto naprawdę zbudował dany model.

Jak czytać oznaczenia

  • „Otwarte wagi” (open weights) – pliki modelu można pobrać i uruchomić na własnym komputerze; który otwarty model pasuje do twojego sprzętu pokazuje, czego to wymaga.
  • „Zamknięty” – z modelu można korzystać tylko przez aplikację lub API dostawcy.
  • LLM to model językowy do tekstu, „Wizja (VLM)” czyta także obrazy, a „Rozumowanie” oznacza model, który przed odpowiedzią rozkłada problem na kroki. Odpowiedź przychodzi wolniej i kosztuje więcej, ale w matematyce, kodzie i planowaniu wypada mocniej. Generatory obrazu, wideo i dźwięku mają własne oznaczenia.

Dostawcy modeli zamkniętych nie podają liczby parametrów, dlatego to pole zostaje u nich puste, zamiast wypełniać je zgadywaniem.

Kto prowadzi w danym roku – patrząc z dzisiaj

Nad każdym rokiem znajduje się pasek z modelami z tego roku, które dziś prowadzą w tekście, programowaniu, tworzeniu stron, agentach, obrazie i wideo. To spojrzenie z dzisiejszego punktu widzenia, a nie odtworzenie ówczesnych rankingów: model wydany wiosną mógł zostać wyprzedzony już jesienią, a pasek pokazuje, jak jego pokolenie radzi sobie teraz w rankingach według ocen LMArena.

Filtry i edycje roczne

Widok można zawęzić do dostawcy, kraju, otwartych wag i typu albo wyszukać model po nazwie. Każdy rok ma też własną stronę – edycję roczną, do której da się linkować bezpośrednio.

Źródła i zastrzeżenia

Daty wydania i kontekst pochodzą z katalogów modeli models.dev i LiteLLM, parametry i licencje – z Hugging Face, a kraje dostawców prowadzimy sami. Data to dzień, w którym model pojawił się w katalogach, i może się o kilka dni różnić od zapowiedzi. Modeli, dla których źródła podają tylko rok, nie pokazujemy. Kraj oznacza siedzibę firmy, a nie lokalizację centrów danych czy użytkowników.