İçeriğe geç
fedi.software

Kodlama

Programlama istemlerinde sıralanan modeller: seviye, güven aralığıyla Elo, milyon token başına fiyat ve bağlam penceresi.

Güncellendi · Kaynaklar: LMArena, LiteLLM, models.dev

Aylık maliyet
Seviye Model Elo Girdi / çıktı, 1 milyon başına Aylık Bağlam Uygulama Karşılaştır
S1.547— —
S1.510$1 / $4Ücretsiz 1M
S1.509$0,75 / $3,75 1M
S1.498$0,75 / $3,75 1M
S1.492$0,1857 / $1,11 1M
S1.492$0,375 / $1,88 1M
S1.489$0,275 / $1,10Ücretsiz 262K
S1.484$1 / $6 1M
S1.483$0,30 / $1,90 262K
S1.482$0,57 / $3,43 1M
A1.472$0,50 / $3 131K
A1.460$0,07 / $0,43 1M
A1.459$0,10 / $0,25Ücretsiz 262K
A1.453$1,15 / $8 262K
A1.452$0,15 / $1,25 1M
A1.452$0,87 / $7 1M
A1.446$0,042 / $0,22Ücretsiz 262K
A1.424$0,09 / $0,71 1M
B1.400$0,30 / $2,50 1M
B1.400$0,125 / $0,75 1M
B1.399$0,40 / $1,80 256K
B1.373$0,10 / $0,10 1M
B1.372$0,09 / $0,36 1M
B1.351$0,10 / $0,42 990K
B1.322$0,08 / $0,16Ücretsiz 131K
B1.322$0,052 / $0,21 990K
B1.294— —
B1.281$0,05 / $0,10Ücretsiz 131K
C1.269Ücretsiz 128K
C1.262— —
C1.255— —
C1.230$0,04 / $0,08Ücretsiz 131K
C1.218— —
C1.211$0,65 / $0,65 8K
C1.191— —
C1.174$0,20 / $0,20 8K
C1.112Ücretsiz 128K
C1.108$2 / $12 1M
C1.104— —
D1.084— —
D1.048$0,15 / $0,15 8K
D1.034— —
D1.010— —
D994— —

Seviyeler bizim hesabımızdır: bir modelin sıralamadaki yeri, yalnızca güven aralığının tamamı onun üzerinde olan modeller sayılarak belirlenir. S — ilk %10, A — %30'a kadar, B — %60'a kadar, C — %85'e kadar, D — geri kalanlar.

Kalite ve fiyat dikeyde puan, yatayda karma fiyat (3 birim girdi : 1 birim çıktı), 1 milyon token başına USD
1.000 1.200 1.400 1.600 $0,01 $0,10 $1 $10 $100 MiMo-V2.6-Pro Claude Opus 5.5 Claude Opus 4.6

Burada tam olarak ne sıralanıyor?

LMArena metin arenasının kodlama kategorisi. Yöntem genel sıralamayla aynıdır: insanlar adı gizli iki yanıt arasında kör oy verir, ancak burada yalnızca kodla ilgili istemler sayılır. «Bu SQL sorgusu neden hata veriyor?» ya da «bu fonksiyonu Python'da yeniden yaz» gibi sorular bu tabloya düşer. Sonuç, %95 güven aralığıyla birlikte bir Elo puanıdır.

Web geliştirme ve ajan tablolarından farkı ne?

Bu tablo, kod üzerine bir sohbetteki yanıtları değerlendirir. Tek bir istemden eksiksiz bir web uygulaması kurmak web geliştirme sıralamasında, araç kullanan çok adımlı işler ise ajanlar sıralamasında ölçülür. Bir model birinde iyi, diğerinde daha zayıf olabilir; çalışma biçiminize yakın olan tabloya bakın.

Hangi sütunlar var?

  • Seviye ve aralık çubuğuyla Elo.
  • 1M token başına girdi ve çıktı fiyatı ile 30 günlük değişimi.
  • Bağlam penceresi.
  • «Aylık maliyet» hesaplayıcısı, «Kalite ve fiyat» grafiği ve karşılaştırma kutucuğu.

Fiyatlar models.dev ve LiteLLM'den gelir. «Düşük fiyat» etiketi, 1M token başına karma fiyatı 1 USD'nin altında kalan modellerde görünür.

Bağlam penceresine neden bakmalı?

Modelin tüm bir depo üzerinde çalışmasını istiyorsanız, bağlam penceresi tek istekte ne kadar kodun sığacağını belirler. Pahalı ama geniş pencereli bir model, daha ucuz bir modelle yapılan iki istekten pahalıya gelebilir; tersi de olabilir. Bu yüzden bağlamı fiyatın hemen yanında okuyun ve hesaplayıcıda kendi hacminizle deneyin.

Seviyeler nasıl verilir?

Metin tablosundakiyle aynı biçimde: yalnızca en az 300 oy alan modeller girer, diğerlerinde «Henüz seviye yok» yazar. Sıra, aralığı tamamen üstte kalan modellerin sayısına göre belirlenir; harfler %10, %30, %60 ve %85 eşikleriyle dağıtılır.

Seçim için bu tablo yeterli mi?

Tam olarak değil. Kod üzerine sohbette iyi yanıt vermek, gerçek bir projenin testlerini geçmekle aynı şey değildir. Tabloyu kısa bir liste çıkarmak için kullanın, ardından adayları kendi kodunuzla deneyin ya da yan yana karşılaştırın.