2024 年的 AI 模型:誰發布了什麼
按月列出每一款重要模型的發布:廠商及其所在國家、開放或封閉權重、類型、上下文視窗、開放模型的規模,以及各年份模型目前在哪些任務上領先。
2024 59 款發布 · 37 款為開放權重
- 文字 B DeepSeek V3DeepSeek
- 程式設計 B DeepSeek V3DeepSeek
- 圖片 D flux-1-dev-fp8Black Forest Labs
- 影片 C veo-2Google
十二月
- B DeepSeek V3 HFDeepSeek中國開放權重LLM164K685B / 37B
- B gemini-2.0-flash-001Google美國封閉視覺 (VLM)990K
- C Llama 3.3 70B Instruct HFMeta美國開放權重LLM24K70.6B
- B OpenAI o1OpenAI美國封閉視覺 (VLM)200K
- C veo-2Google美國封閉影片
- EXAONE 3.5 7.8B Instruct AWQ HFLG AI Research南韓開放權重LLM7.8B
十一月
- B Qwen2.5 Coder 32B Instruct HFAlibaba中國開放權重LLM33K32.8B
- Qwen2.5 Coder 14B Instruct HFAlibaba中國開放權重LLM14.8B
- C Mistral LargeMistral AI法國開放權重LLM131K
十月
- C Aya Expanse 32BCohere加拿大開放權重LLM128K
- B claude-3-5-haiku-20241022Anthropic美國封閉視覺 (VLM)200K
- B claude-3-5-sonnet-20241022Anthropic美國封閉視覺 (VLM)200K
九月
- D Llama 3.2 1B Instruct HFMeta美國開放權重LLM60K1.2B
- C Llama 3.2 3B Instruct HFMeta美國開放權重LLM80K3.2B
- Llama 3.2 1B HFMeta美國開放權重LLM1.2B
- Llama 3.2 3B HFMeta美國開放權重LLM3.2B
- Qwen2.5 Coder 1.5B HFAlibaba中國開放權重LLM1.5B
- Qwen2.5 1.5B Instruct HFAlibaba中國開放權重LLM1.5B
- Qwen2.5 32B Instruct HFAlibaba中國開放權重LLM32.8B
- Qwen2.5 3B Instruct HFAlibaba中國開放權重LLM3.1B
- Qwen2.5 Coder 7B Instruct HFAlibaba中國開放權重LLM7.6B
- Qwen2.5 14B Instruct HFAlibaba中國開放權重LLM14.8B
- Qwen2.5 7B HFAlibaba中國開放權重LLM7.6B
- B o1-miniOpenAI美國封閉LLM128K
- B Qwen2.5 72B Instruct HFAlibaba中國開放權重LLM131K72.7B
- Qwen2.5 7B Instruct HFAlibaba中國開放權重LLM131K7.6B
- Qwen2.5 VL 72B Instruct HFAlibaba中國開放權重視覺 (VLM)131K73.4B
八月
- C Command R (08-2024)Cohere加拿大開放權重LLM128K
- C Command R+ (08-2024)Cohere加拿大開放權重LLM128K
- Hermes 3 70B Instruct HFNous Research美國開放權重LLM66K70.6B
- Hermes 3 405B Instruct HFNous Research美國封閉LLM131K
- B grok-2-2024-08-13xAI美國封閉LLM131K
- B grok-2-mini-2024-08-13xAI美國封閉LLM
- B GPT-4o (2024-08-06)OpenAI美國封閉視覺 (VLM)128K
- D flux-1-dev-fp8Black Forest Labs德國封閉圖像
七月
- C Llama 3.1 70B Instruct HFMeta美國開放權重LLM131K70.6B
- C Llama 3.1 8B Instruct HFMeta美國開放權重LLM32K8B
- B GPT-4o-mini (2024-07-18)OpenAI美國封閉視覺 (VLM)128K
- Llama 3.1 8B Instruct HFMeta美國開放權重LLM8B
- C gemma-2-2b-it HFGoogle美國開放權重LLM128K2.6B
- Llama 3.1 8B HFMeta美國開放權重LLM8B
- C Gemma 2 27B HFGoogle美國封閉LLM8K
- C Mistral Large 2407Mistral AI法國封閉LLM131K
- Mistral Nemo HFMistral AI法國開放權重LLM128K12.2B
六月
- C gemma-2-9b-it HFGoogle美國封閉LLM8K
- Llama 3 Groq 8B Tool Use HFGroq美國開放權重LLM8B
- DeepSeek Coder V2 Lite Instruct HFDeepSeek中國開放權重LLM15.7B / 2.7B
五月
- B GPT-4o (2024-05-13)OpenAI美國封閉視覺 (VLM)128K
四月
- C llama-3-8b-instructMeta美國開放權重LLM8K
- C llama-3-70b-instructMeta美國開放權重LLM8K
- Meta Llama 3 8B HFMeta美國開放權重LLM8B
- Meta Llama 3 8B Instruct HFMeta美國開放權重LLM8B
- Mixtral 8x22B Instruct HFMistral AI法國封閉LLM66K
- OpenELM 1 1B Instruct HFApple美國開放權重LLM1.1B
- B Qwen MaxAlibaba中國封閉LLM33K
三月
- C claude-3-haiku-20240307Anthropic美國封閉視覺 (VLM)200K
二月
- C claude-3-opus-20240229Anthropic美國封閉LLM200K
- C claude-3-sonnet-20240229Anthropic美國封閉LLM200K
一月
- B Qwen PlusAlibaba中國封閉LLM1M
發布日期來自模型目錄(models.dev、LiteLLM、Hugging Face);只知道發布年份的模型不會顯示。某一年的領先者,是指該年模型中目前在我們排行榜上名次最高的模型。
更新日期 · 來源: models.dev (MIT), LiteLLM (MIT), LMArena (CC BY 4.0), Hugging Face
Arena (LMArena) scores: Arena Leaderboard Dataset by LMArena, CC BY 4.0. Modified by fedi.software (filtered, re-ranked, aggregated). Not endorsed by LMArena.
這條時間軸在呈現什麼?
它把各家 AI 實驗室的模型發布依時間排開:較新的年份在上方,每年再按月份分組。每一行是一個模型,列出開發商、總部所在國家、權重是否公開、模型類型與上下文長度。開放模型另外標出參數量;混合專家(MoE)模型的第二個數字,是每個 token 實際啟用的參數。
收錄條件是在我們的排行榜上有評分,或在 Hugging Face 公開了權重。轉售商、路由服務與社群微調版本不列入。
標籤怎麼看?
- 「開放權重」(open weights):模型檔案可以下載,在自己的電腦上執行;需要多少記憶體,可到哪個開放模型適合您的硬體查詢。
- 「封閉」:只能透過開發商的 App 或 API 使用。
- LLM 是文字模型,「視覺 (VLM)」也能讀圖片;「推理」模型會先一步步思考再回答,單次回答較慢也較貴,但在數學、程式與規劃上更強。
封閉模型的開發商不公布參數量,所以那一欄留白,而不是用猜的。
每年上方那一排是什麼?
那是該年發布、如今在文字、程式設計、網頁開發、代理、圖片與影片排行榜上名列前茅的模型。這是用今天的眼光看那一年,而不是當時的排名:春天的模型到秋天可能已被超越。
還有哪些功能與限制?
可依開發商、國家、開放權重與類型篩選,也能搜尋名稱;每一年都有自己的頁面(年度版本)。發布日期取自 models.dev、LiteLLM 與 Hugging Face 等模型目錄,是模型出現在目錄上的日子,可能與官方宣布差幾天。只知道發布年份的模型不會顯示。國家指公司總部,不是資料中心或使用者所在地。