比較 AI 模型
最多並列比較四個模型:各排行榜的等級與 Elo、價格、上下文視窗與發布日期。
更新日期 · 來源: LiteLLM
| 指標 | Qwen2.5 72B Instruct Alibaba |
|---|---|
| 文字 | C 1,269 1,265–1,273 |
| 程式設計 | B 1,292 1,285–1,300 |
| 輸入/輸出,每百萬 | US$0.12 / US$0.30 |
| 上下文視窗 | 131K |
| 最大輸出 | 8K |
| 發布日期 | 2024年9月1日 |
| 知識截止日期 | 2024-04 |
| 授權 | 開放權重 |
| 輸入 | 文字 |
| 應用程式 | — |
比較頁面把最多 4 個模型排成並列的欄位,讓您在同一個畫面看出它們在評分、價格與技術規格上的差異,不必在各排行榜之間來回切換。
如何加入模型
- 在輸入框中開始輸入模型名稱,從清單中選取。
- 也可以在任何排行榜表格中,勾選想比較的模型旁的「比較」方塊。
- 選好後按「比較」;按「清除」可以重新開始。
比較表會顯示什麼
- 模型在每一個有排名的排行榜上的等級與評分;
- 各單位價格、上下文長度與最大輸出;
- 模態,例如文字、圖片、音訊或影片;
- 是否為開放權重,以及發佈日期。
怎麼解讀結果
評分請在同一個排行榜內比較。文字排行榜的 Elo 和代理排行榜的分數是不同尺度,即使出現在同一列,也不能直接比大小。空白欄位代表來源沒有這個模型的資料,而不是數值為零;某個排行榜沒有評分,表示模型沒有在那裡接受評比。
分享比較結果
含有已選模型的連結可以分享給同事。搜尋引擎只收錄沒有選擇模型的基本頁面,您的比較只會被收到連結的人看到。
什麼時候用得上
在 文字排行榜 或 程式設計排行榜 挑出幾個高等級候選模型後,常需要在較貴與較便宜的選項之間做決定。比較表能快速看出較高的評分是否值得較高的價格,以及便宜的模型上下文是否足夠。最後別忘了用自己的工作內容實測兩三個模型,親自比較回答。
來源:評分 LMArena;價格與技術資料 models.dev 與 LiteLLM。