跳到主要內容
fedi.software

2024 年的 AI 模型:誰發布了什麼

按月列出每一款重要模型的發布:廠商及其所在國家、開放或封閉權重、類型、上下文視窗、開放模型的規模,以及各年份模型目前在哪些任務上領先。

2024 59 款發布 · 37 款為開放權重

目前在各任務領先的 2024 年模型

十二月

  1. B DeepSeek V3 HFDeepSeek中國開放權重LLM164K685B / 37B
  2. B gemini-2.0-flash-001Google美國封閉視覺 (VLM)990K
  3. C Llama 3.3 70B Instruct HFMeta美國開放權重LLM24K70.6B
  4. B OpenAI o1OpenAI美國封閉視覺 (VLM)200K
  5. C veo-2Google美國封閉影片
  6. EXAONE 3.5 7.8B Instruct AWQ HFLG AI Research南韓開放權重LLM7.8B

十一月

  1. B Qwen2.5 Coder 32B Instruct HFAlibaba中國開放權重LLM33K32.8B
  2. Qwen2.5 Coder 14B Instruct HFAlibaba中國開放權重LLM14.8B
  3. C Mistral LargeMistral AI法國開放權重LLM131K

十月

  1. C Aya Expanse 32BCohere加拿大開放權重LLM128K
  2. B claude-3-5-haiku-20241022Anthropic美國封閉視覺 (VLM)200K
  3. B claude-3-5-sonnet-20241022Anthropic美國封閉視覺 (VLM)200K

九月

  1. D Llama 3.2 1B Instruct HFMeta美國開放權重LLM60K1.2B
  2. C Llama 3.2 3B Instruct HFMeta美國開放權重LLM80K3.2B
  3. Llama 3.2 1B HFMeta美國開放權重LLM1.2B
  4. Llama 3.2 3B HFMeta美國開放權重LLM3.2B
  5. Qwen2.5 Coder 1.5B HFAlibaba中國開放權重LLM1.5B
  6. Qwen2.5 1.5B Instruct HFAlibaba中國開放權重LLM1.5B
  7. Qwen2.5 32B Instruct HFAlibaba中國開放權重LLM32.8B
  8. Qwen2.5 3B Instruct HFAlibaba中國開放權重LLM3.1B
  9. Qwen2.5 Coder 7B Instruct HFAlibaba中國開放權重LLM7.6B
  10. Qwen2.5 14B Instruct HFAlibaba中國開放權重LLM14.8B
  11. Qwen2.5 7B HFAlibaba中國開放權重LLM7.6B
  12. B o1-miniOpenAI美國封閉LLM128K
  13. B Qwen2.5 72B Instruct HFAlibaba中國開放權重LLM131K72.7B
  14. Qwen2.5 7B Instruct HFAlibaba中國開放權重LLM131K7.6B
  15. Qwen2.5 VL 72B Instruct HFAlibaba中國開放權重視覺 (VLM)131K73.4B

八月

  1. C Command R (08-2024)Cohere加拿大開放權重LLM128K
  2. C Command R+ (08-2024)Cohere加拿大開放權重LLM128K
  3. Hermes 3 70B Instruct HFNous Research美國開放權重LLM66K70.6B
  4. Hermes 3 405B Instruct HFNous Research美國封閉LLM131K
  5. B grok-2-2024-08-13xAI美國封閉LLM131K
  6. B grok-2-mini-2024-08-13xAI美國封閉LLM
  7. B GPT-4o (2024-08-06)OpenAI美國封閉視覺 (VLM)128K
  8. D flux-1-dev-fp8Black Forest Labs德國封閉圖像

七月

  1. C Llama 3.1 70B Instruct HFMeta美國開放權重LLM131K70.6B
  2. C Llama 3.1 8B Instruct HFMeta美國開放權重LLM32K8B
  3. B GPT-4o-mini (2024-07-18)OpenAI美國封閉視覺 (VLM)128K
  4. Llama 3.1 8B Instruct HFMeta美國開放權重LLM8B
  5. C gemma-2-2b-it HFGoogle美國開放權重LLM128K2.6B
  6. Llama 3.1 8B HFMeta美國開放權重LLM8B
  7. C Gemma 2 27B HFGoogle美國封閉LLM8K
  8. C Mistral Large 2407Mistral AI法國封閉LLM131K
  9. Mistral Nemo HFMistral AI法國開放權重LLM128K12.2B

六月

  1. C gemma-2-9b-it HFGoogle美國封閉LLM8K
  2. Llama 3 Groq 8B Tool Use HFGroq美國開放權重LLM8B
  3. DeepSeek Coder V2 Lite Instruct HFDeepSeek中國開放權重LLM15.7B / 2.7B

五月

  1. B GPT-4o (2024-05-13)OpenAI美國封閉視覺 (VLM)128K

四月

  1. C llama-3-8b-instructMeta美國開放權重LLM8K
  2. C llama-3-70b-instructMeta美國開放權重LLM8K
  3. Meta Llama 3 8B HFMeta美國開放權重LLM8B
  4. Meta Llama 3 8B Instruct HFMeta美國開放權重LLM8B
  5. Mixtral 8x22B Instruct HFMistral AI法國封閉LLM66K
  6. OpenELM 1 1B Instruct HFApple美國開放權重LLM1.1B
  7. B Qwen MaxAlibaba中國封閉LLM33K

三月

  1. C claude-3-haiku-20240307Anthropic美國封閉視覺 (VLM)200K

二月

  1. C claude-3-opus-20240229Anthropic美國封閉LLM200K
  2. C claude-3-sonnet-20240229Anthropic美國封閉LLM200K

一月

  1. B Qwen PlusAlibaba中國封閉LLM1M

發布日期來自模型目錄(models.dev、LiteLLM、Hugging Face);只知道發布年份的模型不會顯示。某一年的領先者,是指該年模型中目前在我們排行榜上名次最高的模型。

更新日期 · 來源: models.dev (MIT), LiteLLM (MIT), LMArena (CC BY 4.0), Hugging Face

Arena (LMArena) scores: Arena Leaderboard Dataset by LMArena, CC BY 4.0. Modified by fedi.software (filtered, re-ranked, aggregated). Not endorsed by LMArena.

這條時間軸在呈現什麼?

它把各家 AI 實驗室的模型發布依時間排開:較新的年份在上方,每年再按月份分組。每一行是一個模型,列出開發商、總部所在國家、權重是否公開、模型類型與上下文長度。開放模型另外標出參數量;混合專家(MoE)模型的第二個數字,是每個 token 實際啟用的參數。

收錄條件是在我們的排行榜上有評分,或在 Hugging Face 公開了權重。轉售商、路由服務與社群微調版本不列入。

標籤怎麼看?

  • 「開放權重」(open weights):模型檔案可以下載,在自己的電腦上執行;需要多少記憶體,可到哪個開放模型適合您的硬體查詢。
  • 「封閉」:只能透過開發商的 App 或 API 使用。
  • LLM 是文字模型,「視覺 (VLM)」也能讀圖片;「推理」模型會先一步步思考再回答,單次回答較慢也較貴,但在數學、程式與規劃上更強。

封閉模型的開發商不公布參數量,所以那一欄留白,而不是用猜的。

每年上方那一排是什麼?

那是該年發布、如今在文字、程式設計、網頁開發、代理、圖片與影片排行榜上名列前茅的模型。這是用今天的眼光看那一年,而不是當時的排名:春天的模型到秋天可能已被超越。

還有哪些功能與限制?

可依開發商、國家、開放權重與類型篩選,也能搜尋名稱;每一年都有自己的頁面(年度版本)。發布日期取自 models.dev、LiteLLM 與 Hugging Face 等模型目錄,是模型出現在目錄上的日子,可能與官方宣布差幾天。只知道發布年份的模型不會顯示。國家指公司總部,不是資料中心或使用者所在地。