Gå til indhold
fedi.software

AI-modeller fra 2023: hvem udgav hvad

Alle vigtige modeludgivelser måned for måned: leverandør og land, åbne eller lukkede vægte, type, kontekstvindue, størrelse på åbne modeller — og hvilke opgaver modellerne fra hvert år fører i dag.

2023 9 udgivelser · 5 med open weights

Modeller fra 2023, der i dag fører hver opgave

December

  1. Mistral 7B Instruct v0.2 HFMistral AIFrankrigOpen weightsLLM7.2B
  2. C mixtral-8x7b-instruct-v0.1Mistral AIFrankrigOpen weightsLLM32K

November

  1. Qwen 72B HFAlibabaKinaOpen weightsLLM72.3B
  2. D dall-e-3OpenAIUSALukketBillede
  3. C GPT 4OpenAIUSALukketLLM8K
  4. C GPT-4 TurboOpenAIUSALukketVision (VLM)128K

Juli

  1. Llama 2 7b hf HFMetaUSAOpen weightsLLM6.7B

Marts

  1. C GPT-3.5 TurboOpenAIUSALukketLLM16K

Februar

  1. pythia-6.9b HFEleutherAIUSAOpen weightsLLM7B

Udgivelsesdatoerne stammer fra modelkatalogerne (models.dev, LiteLLM, Hugging Face); modeller, der kun kendes på udgivelsesåret, vises ikke. Årets førende er de modeller fra det år, der i dag rangerer højest på vores ranglister.

Opdateret · Kilder: models.dev (MIT), LiteLLM (MIT), LMArena (CC BY 4.0), Hugging Face

Arena (LMArena) scores: Arena Leaderboard Dataset by LMArena, CC BY 4.0. Modified by fedi.software (filtered, re-ranked, aggregated). Not endorsed by LMArena.

Hvad viser tidslinjen?

Grafikken lægger modeludgivelser ud på én tidsakse. Det nyeste år står øverst, og inden for hvert år er udgivelserne grupperet efter måned. Hver linje er én model med leverandøren, det land hvor firmaet har hovedsæde, åbne eller lukkede vægte, typen og kontekstvinduet. For åbne modeller står også antallet af parametre, og ved en mixture-of-experts-model (MoE) er det andet tal den aktive del, altså de parametre der faktisk regner med på hvert token.

Hvilke modeller er med?

Tidslinjen viser modeller fra AI-laboratorier, der enten har en bedømmelse på vores ranglister eller har lagt vægtene ud på Hugging Face. Forhandlere, routere og fællesskabets finjusteringer er udeladt, så listen forbliver en oversigt over, hvem der reelt har bygget hvad.

Hvad betyder mærkerne?

  • »Open weights« – modelfilerne kan hentes og køres på din egen maskine; hvilken åben model passer til din hardware viser, hvad det kræver.
  • »Lukket« – modellen kan kun bruges gennem leverandørens app eller API.
  • LLM er en sprogmodel til tekst, »Vision (VLM)« læser også billeder, og en model med mærket »Ræsonnement« tænker et problem igennem trin for trin, før den svarer. Det gør hvert svar langsommere og dyrere, men stærkere i matematik, kode og planlægning. Billed-, video- og lydgeneratorer har deres egne mærker.

Leverandører af lukkede modeller oplyser ikke antallet af parametre. Derfor står feltet tomt hos dem i stedet for et gæt.

Hvem leder hvert år?

Over hvert år ligger en stribe med de modeller fra netop det år, der i dag fører inden for tekst, programmering, webudvikling, agenter, billede og video. Det er et billede af nu og ikke en rekonstruktion af dengang: en model fra foråret kan være overhalet til efteråret, og striben viser, hvordan dens generation klarer sig i dag på ranglisterne med bedømmelser fra LMArena.

Kan jeg filtrere og linke til et år?

Ja. Du kan afgrænse visningen efter leverandør, land, open weights og type eller søge efter et navn. Hvert år har desuden sin egen side, en årsudgave du kan linke direkte til.

Hvor præcise er datoerne?

Udgivelsesdatoer og kontekst kommer fra modelkatalogerne models.dev og LiteLLM, parametre og licenser fra Hugging Face, mens leverandørernes lande er vores egne data. Datoen er den dag, modellen dukkede op i katalogerne, og den kan ligge et par dage fra selve annonceringen. Modeller, hvor kilderne kun angiver året, vises ikke. Landet er hovedsædets, ikke datacentrenes eller brugernes.