GPT-6.1 Sol'un Gerçek Maliyeti: $2 / $10 Fiyat Etiketinin Ötesinde

AIHubMix6 dk okuma
GPT-6.1 Sol'un Gerçek Maliyeti: $2 / $10 Fiyat Etiketinin Ötesinde

GPT-6.1 Sol liste fiyatı olarak GPT-6 Sol ile aynıdır: $2 milyon başına giriş tokeni ve $10 milyon başına çıkış tokeni. Gerçek faturanızı etkileyen dört başka şey vardır: önbelleğe ne sıklıkla eriştiğiniz, 272K giriş tokenini aşıp aşmadığınız, hangi hizmet katmanını kullandığınız ve modelin ne kadar akıl yürütme tokeni harcadığı. Bu yazı her birini ele alıyor.


Tam fiyat listesi

Standart tarifeler (1M token başına)

GPT-6.1 SolGPT-6 SolGPT-6 AstraGPT-6 Luna
Giriş$2.00$2.00$10.00$0.10
Önbellekli giriş$0.10$0.20$1.00—
Önbellek yazmaları$2.50$2.50——
Çıkış (akıl yürütme dahil)$10.00$10.00$50.00$0.50
Astra'nın önbellekli oranı üçüncü taraf raporlamasından gelmektedir. Önbellek yazma oranı, OpenAI'nin 1.25× kuralı altında $12.50 olmalıdır. Luna'nın önbellek fiyatlandırması için OpenAI'nin fiyatlandırma sayfasına bakın.

Çarpanlar

Bu kurallar GPT-6.1 Sol model sayfasından gelmektedir:

KoşulNe olur
272K giriş tokeninden fazlaTüm istek 2× giriş ve önbellek, 1.5× çıkış olarak faturalandırılır ($4 / $15, önbellek okumaları $0.20, önbellek yazmaları $5)
Toplu / EsnekStandart tarifelerin yarısı
Hızlı modStandart tarifelerin iki katı (AB veri ikametinde mevcut değil)
Bölgesel işleme+%10
Araç çağrıları (arama, bilgisayar kullanımı vb.)Her çağrı için ücretlendirilir. AIHubMix, web aramasını $0.01 başına listelemektedir
Ultra hızlı (Codex'e geliyor)Henüz resmi bir fiyatlandırması yok. Bir rapor 6× standart diyor, doğrulanmamış

AIHubMix'te, OpenAI ve Azure yolları OpenAI doğrudan ile aynı fiyata sahiptir ve 272K üzeri katman zaten listelenmiştir.


Gerçek değişim: önbellek okumaları girişin %5'inde

Liste fiyatı değişmedi. Önbellek okumaları, giriş oranının %10'undan ($0.20) %5'e ($0.10) düştü. OpenAI'nin istek önbellekleme belgeleri bunu açıkça belirtiyor: önbellek okumaları çoğu modelde 0.1× giriş ve "GPT-6.1 Sol'da 0.05×" olarak belirlenmiştir.

Bu önemlidir çünkü ajanlar her adımda aynı materyali yeniden gönderir: sistem istemi, araç tanımları, depo bağlamı ve konuşma geçmişi. Girişlerinin çoğu tekrarlanan içeriktir. Bu iş yükleri için, önbellekli oran, gerçekteki giriş fiyatınızdır.

Örnek uygulama: bir kodlama ajanı görevi

Varsayımlar:

  • 200K tokenlik sabit bir ön ek (sistem istemi, araçlar, depo bağlamı)
  • Her biri 2K yeni giriş tokeni ekleyen ve 3K çıkış tokeni üreten 50 adım (akıl yürütme dahil)
  • Basit tutmak için, ön ek aynı boyutta kalır, adım 1'de önbelleğe yazılır ve kalan 49 adımda erişilir
6.1 Sol, önbelleksiz6 Sol + önbellek6.1 Sol + önbellekAstra + önbellek
Başlangıç 200K önbellek yazma—$0.50$0.50$2.50
49 önbellek okuma—$1.96$0.98$9.80
Ön ek normal giriş olarak faturalandırılır$20.00———
100K yeni giriş (yazma oranında)$0.20$0.25$0.25$1.25
150K çıkış$1.50$1.50$1.50$7.50
Toplam$21.70$4.21$3.23$21.05

Üç önemli nokta:

  1. Önbellekleme en büyük etkendir. Aynı model, aynı iş ve önbelleksiz çalışmanın maliyeti neredeyse 7 kat daha fazladır.
  2. 6.1 Sol, 6 Sol'dan burada yaklaşık %23 daha ucuzdur ve aynı zamanda daha yüksek puan alır.
  3. Önbellek ağırlıklı işler için, Astra'nın fiyatı 5 kat liste fiyatı farkından daha fazladır. Bu örnekte 6.5 kat, çünkü Astra önbellekli girişi %90 indirimli ve 6.1 Sol %95 indirimli sunar.

Bu, OpenAI'nin rapor edilen görev başına maliyetleriyle (toplanan Vellum ve The Next Web): yaklaşık $1.50 vs $7.70 DeepSWE'de, $1.30 vs $9.30 OSWorld'de ve $5.47 vs $23.80 Terminal-Bench Science'da.

Bir uyarı: OpenAI, Astra'nın genellikle aynı görevi tamamlamak için daha az çıkış tokenine ihtiyaç duyduğunu söylüyor. Modelleri görev başına maliyetle karşılaştırın, token başına maliyetle değil.

Önbellek yazmaları ücretsiz değildir

6.1 Sol'da önbellek yazmaları giriş oranının 1.25 katına mal olmaktadır. Eğer bir ön ek yalnızca bir kez kullanılıyorsa, önbellekleme maliyeti %25 artırır. OpenAI'nin belgelerinden alınan formül:

  • Bir yazma ve bir okuma: normal giriş maliyetinin 1.35 katı (6.1 Sol'da 1.3 kat), önbellekleme olmadan 2 kat
  • Bir yazma ve dokuz okuma: yaklaşık 2.15 kat (6.1 Sol'da yaklaşık 1.7 kat), önbellekleme olmadan 10 kat

Minimum önbelleğe alınabilir ön ek 1,024 token'dır. OpenAI'nin başa baş hesaplaması, 102 token veya daha az bir ön ekin asla karşılığını vermediğini belirtmektedir. Eğer 10 veya daha fazla yeniden kullanım bekliyorsanız, 221 token üzerindeki her şeyi 1,024'e kadar doldurmak daha ucuzdur.

Tek seferlik çağrılar için, örneğin tek aşamalı sınıflandırma veya toplu çıkarım için, açık mod (prompt_cache_options.mode: "explicit") kullanarak yazmaları tamamen atlayabilirsiniz. Hiçbir yazma ücreti alınmayacaktır.


272K uçurumu

6.1 Sol, 1.05M token bağlamını kabul eder, ancak giriş 272K'yi geçtiğinde, tüm istek daha yüksek orana geçer, yalnızca sınırın üzerindeki tokenler değil.

İstekGirişÇıkışMaliyet
A270K10K0.27 × $2 + 0.01 × $10 = $0.64
B280K10K0.28 × $4 + 0.01 × $15 = $1.27

On bin daha fazla giriş tokeni, faturayı neredeyse iki katına çıkarıyor.

Bunun altında kalmak için:

  • Tokenleri istemci tarafında sayın ve 272K'ye ulaşmadan önce sıkıştırın veya kesin
  • Uzun belgelerin ilgili kısımlarını alın, tümünü göndermeyin
  • Gerçekten uzun bir bağlama ihtiyaç duyduğunuzda, sabit kısmı önbelleğe alınmış bir ön ek olarak koyun

Akıl yürütme çabası faturada nasıl görünür

Akıl yürütme tokenleri çıkış oranında, milyon başına $10 olarak faturalandırılır. Aynı görevi düşükten maksimuma taşımak, akıl yürütme tokenlerini on kat veya daha fazla artırabilir.

OpenAI'nin rapor edilen görev başına maliyetleri, ölçeği anlamak için bir fikir verir (bunlar farklı kıyaslamalardır, bu yüzden yalnızca büyüklükleri karşılaştırın):

  • AutomationBench (orta): ~$0.30
  • GDP.pdf: ~$0.38
  • DeepSWE (yüksek): ~$1.50
  • Terminal-Bench Science (maks): ~$5.47

2. bölüm, bir seviye seçmenin nasıl yapılacağını kapsar. Burada bir hatırlatma: konuşma sırasında reasoning.effort değiştirmek önbelleği geçersiz kılar. Bunun yerine configuration_update kullanın.


Bu fiyat noktasında nasıl karşılaştırılır

ModelGiriş / çıkışÖnbellekli giriş
GPT-6.1 Sol$2 / $10$0.10
Claude Sonnet 5.5$2 / $10$0.20
GPT-6 Astra$10 / $50$1.00

6.1 Sol ve Claude Sonnet 5.5 aynı liste fiyatına sahiptir ve 6.1 Sol'un önbellekli oranı Sonnet'in yarısıdır. Ancak farklı şeylerde güçlüler. Örneğin, AutomationBench'te Sonnet 5.5 çok daha iyi bir performans sergiliyor. İki modelin token başına maliyeti aynı olduğunda, iş yükünüzde görev başına maliyeti daha düşük olan daha ucuz olandır.

AIHubMix model listesi mevcut fiyatları göstermektedir ve tek bir API anahtarı hepsi için geçerlidir, bu nedenle yan yana testler yapmak kolaydır.

Rakip fiyatları üçüncü taraf kaynaklardan gelmektedir ve değişebilir. Güvenmeden önce resmi fiyatlandırma sayfalarını kontrol edin.

Maliyet kontrol listesi

  1. Öngörülebilir içeriği önce koyun. Sistem istemi, araç tanımları ve referans materyali en üstte yer alır. Zaman damgaları ve kullanıcı başına veriler en altta yer alır.
  2. Ekleyin, yeniden yazmayın. Özetleme, kısaltma ve sıkıştırma işlemleri önbelleği yeniden başlatır.
  3. Araç listesini sabit tutun. Her istekte araç eklemeyin veya çıkarmayın. Bunun yerine tool_choice veya allowed_tools kullanın.
  4. Çabayı configuration_update ile değiştirin, istek parametresiyle değil.
  5. 272K girişin altında kalın.
  6. Acelesi olmayan işleri yarı fiyatına Toplu veya Esnek olarak gönderin.
  7. Göreve göre yönlendirin. Basit yüksek hacimli işler için Luna, çoğu şey için 6.1 Sol, en zor problemler için Astra kullanın.
  8. Üç sayıya dikkat edin: cached_tokens, cache_write_tokens ve reasoning_tokens.

Sonuç olarak: liste fiyatı değişmedi, ancak önbellek okumaları %50 daha ucuz hale geldi. Ajan iş yükleri için, bu 6.1 Sol'u GPT-6 ailesindeki en iyi değerli model yapar, yeter ki önbelleği iyi kullanın ve 272K'nın altında kalın.

Sonraki: geçiş yaptığınızda karşılaşabileceğiniz sorunlar.


SSS

GPT-6.1 Sol'un maliyeti nedir? Milyon başına $2 giriş tokeni, $10 çıkış tokeni, $0.10 önbellekli giriş ve $2.50 önbellek yazmaları. 272K giriş tokenini aşan istekler, tüm istek için $4 giriş ve $15 çıkış olarak faturalandırılır.

AIHubMix üzerinden mi yoksa doğrudan OpenAI üzerinden mi daha ucuz? Aynı fiyat. AIHubMix'in OpenAI ve Azure yolları, OpenAI'nin resmi oranlarıyla eşleşmektedir.

Faturam neden tahmin ettiğimden daha yüksek? Dört yaygın neden: akıl yürütme tokenleri çıkış oranında faturalandırılır; 272K girişi aştınız; önbelleği kaçırdınız veya tek seferlik ön eklerde yazma ücretleri ödediniz; veya Hızlı mod veya bölgesel işleme açıktır.

Önbellek yazmaları ekstra maliyetli mi? Yazılan tokenler giriş oranının 1.25 katı olarak faturalandırılır. Bu, normal giriş ücretini değiştirmek yerine onun yerine geçer. Bir ön ek iki kullanımda kendini amorti eder. Tek seferlik ön ekler için, açık mod yazmaları tamamen atlamanıza izin verir.

6.1 Sol, Astra'dan ne kadar daha ucuz? Liste fiyatında beş kat daha ucuz. Önbellek ağırlıklı ajan işlerinde, fark 6 ila 7 katı bulabilir çünkü 6.1 Sol önbellekli girişi daha fazla indirimli sunar. Ancak Astra genellikle her görev için daha az çıkış tokeni kullanır, bu nedenle görev başına maliyeti karşılaştırın.

Toplu, önbellekle birleştirilebilir mi? Toplu ve Esnek her ikisi de yarı fiyatına. Ön bellek ile nasıl birleştiklerini görmek için OpenAI'nin fiyatlandırma sayfasına bakın.


Devam edin: GPT-6.1 Sol serisini okuyun


Kaynaklar