AI-modeller från 2023: vem släppte vad
Alla viktiga modellsläpp månad för månad: leverantör och land, öppna eller stängda vikter, typ, kontextfönster, storlek på öppna modeller — och vilka uppgifter modellerna från varje år leder i dag.
2023 9 släpp · 5 med öppna vikter
- Text C GPT-4 TurboOpenAI
- Programmering C GPT-4 TurboOpenAI
- Bild D dall-e-3OpenAI
December
- Mistral 7B Instruct v0.2 HFMistral AIFrankrikeÖppna vikterLLM7.2B
- C mixtral-8x7b-instruct-v0.1Mistral AIFrankrikeÖppna vikterLLM32K
November
- Qwen 72B HFAlibabaKinaÖppna vikterLLM72.3B
- D dall-e-3OpenAIUSAStängdBild
- C GPT 4OpenAIUSAStängdLLM8K
- C GPT-4 TurboOpenAIUSAStängdVision (VLM)128K
Juli
- Llama 2 7b hf HFMetaUSAÖppna vikterLLM6.7B
Mars
- C GPT-3.5 TurboOpenAIUSAStängdLLM16K
Februari
- pythia-6.9b HFEleutherAIUSAÖppna vikterLLM7B
Releasedatumen kommer från modellkatalogerna (models.dev, LiteLLM, Hugging Face); modeller där bara släppåret är känt visas inte. Årets ledare är de modeller från det året som rankas högst på våra topplistor i dag.
Uppdaterad · Källor: models.dev (MIT), LiteLLM (MIT), LMArena (CC BY 4.0), Hugging Face
Arena (LMArena) scores: Arena Leaderboard Dataset by LMArena, CC BY 4.0. Modified by fedi.software (filtered, re-ranked, aggregated). Not endorsed by LMArena.
Vad visar tidslinjen?
Grafiken lägger släppen av AI-modeller längs en enda tidsaxel. Det senaste året står överst, och inom varje år är släppen grupperade per månad. Varje rad är en modell med leverantör, landet där företaget har sitt huvudkontor, öppna eller stängda vikter, typ och kontextfönster. För öppna modeller visas även antalet parametrar, och för en mixture-of-experts-modell (MoE) anger den andra siffran den aktiva delen – de parametrar som faktiskt räknas för varje token.
Vilka modeller kommer med?
Tidslinjen tar med modeller från AI-labb som antingen har ett betyg på våra topplistor eller har publicerat vikterna på Hugging Face. Återförsäljare, routrar och finjusteringar från communityn lämnas utanför, så att listan visar vem som faktiskt har byggt vad.
Hur läser jag märkena?
- ”Öppna vikter” (open weights) – modellfilerna kan laddas ner och köras på din egen dator; vilken öppen modell passar din hårdvara visar vad som krävs.
- ”Stängd” – modellen nås bara via leverantörens app eller API.
- LLM är en språkmodell för text, ”Vision (VLM)” läser även bilder, och märket ”Resonemang” betyder att modellen tänker igenom problemet steg för steg innan den svarar. Det gör varje svar långsammare och dyrare, men starkare i matematik, kod och planering. Generatorer för bild, video och ljud har egna märken.
Leverantörer av stängda modeller redovisar inte antalet parametrar. Därför är rutan tom hos dem i stället för att visa en gissning.
Vilka leder respektive år?
Ovanför varje år ligger en remsa med de modeller från just det året som i dag leder inom text, programmering, webbutveckling, agenter, bild och video. Det är en bild av läget nu, inte en rekonstruktion av hur det såg ut då. En modell som kom på våren kan vara omsprungen till hösten, och remsan visar hur dess generation klarar sig på topplistorna i dag, mätt med betygen från LMArena.
Kan jag filtrera och länka till ett år?
Ja. Du kan smalna av vyn efter leverantör, land, öppna vikter och typ, eller söka på ett namn. Varje år har dessutom en egen sida, en årsutgåva som du kan länka direkt till.
Hur exakta är datumen?
Släppdatum och kontext kommer från modellkatalogerna models.dev och LiteLLM, parametrar och licenser från Hugging Face, medan leverantörernas länder är våra egna uppgifter. Datumet är dagen då modellen dök upp i katalogerna och kan skilja sig några dagar från tillkännagivandet. Modeller där källorna bara anger året visas inte. Landet är huvudkontorets, inte datacentrens eller användarnas.