GPT-6.1 Sol liste fiyatı olarak GPT-6 Sol ile aynıdır: $2 milyon başına giriş tokeni ve $10 milyon başına çıkış tokeni. Gerçek faturanızı etkileyen dört başka şey vardır: önbelleğe ne sıklıkla eriştiğiniz, 272K giriş tokenini aşıp aşmadığınız, hangi hizmet katmanını kullandığınız ve modelin ne kadar akıl yürütme tokeni harcadığı. Bu yazı her birini ele alıyor.
Tam fiyat listesi
Standart tarifeler (1M token başına)
| GPT-6.1 Sol | GPT-6 Sol | GPT-6 Astra | GPT-6 Luna | |
|---|---|---|---|---|
| Giriş | $2.00 | $2.00 | $10.00 | $0.10 |
| Önbellekli giriş | $0.10 | $0.20 | $1.00 | — |
| Önbellek yazmaları | $2.50 | $2.50 | — | — |
| Çıkış (akıl yürütme dahil) | $10.00 | $10.00 | $50.00 | $0.50 |
Astra'nın önbellekli oranı üçüncü taraf raporlamasından gelmektedir. Önbellek yazma oranı, OpenAI'nin 1.25× kuralı altında $12.50 olmalıdır. Luna'nın önbellek fiyatlandırması için OpenAI'nin fiyatlandırma sayfasına bakın.
Çarpanlar
Bu kurallar GPT-6.1 Sol model sayfasından gelmektedir:
| Koşul | Ne olur |
|---|---|
| 272K giriş tokeninden fazla | Tüm istek 2× giriş ve önbellek, 1.5× çıkış olarak faturalandırılır ($4 / $15, önbellek okumaları $0.20, önbellek yazmaları $5) |
| Toplu / Esnek | Standart tarifelerin yarısı |
| Hızlı mod | Standart tarifelerin iki katı (AB veri ikametinde mevcut değil) |
| Bölgesel işleme | +%10 |
| Araç çağrıları (arama, bilgisayar kullanımı vb.) | Her çağrı için ücretlendirilir. AIHubMix, web aramasını $0.01 başına listelemektedir |
| Ultra hızlı (Codex'e geliyor) | Henüz resmi bir fiyatlandırması yok. Bir rapor 6× standart diyor, doğrulanmamış |
AIHubMix'te, OpenAI ve Azure yolları OpenAI doğrudan ile aynı fiyata sahiptir ve 272K üzeri katman zaten listelenmiştir.
Gerçek değişim: önbellek okumaları girişin %5'inde
Liste fiyatı değişmedi. Önbellek okumaları, giriş oranının %10'undan ($0.20) %5'e ($0.10) düştü. OpenAI'nin istek önbellekleme belgeleri bunu açıkça belirtiyor: önbellek okumaları çoğu modelde 0.1× giriş ve "GPT-6.1 Sol'da 0.05×" olarak belirlenmiştir.
Bu önemlidir çünkü ajanlar her adımda aynı materyali yeniden gönderir: sistem istemi, araç tanımları, depo bağlamı ve konuşma geçmişi. Girişlerinin çoğu tekrarlanan içeriktir. Bu iş yükleri için, önbellekli oran, gerçekteki giriş fiyatınızdır.
Örnek uygulama: bir kodlama ajanı görevi
Varsayımlar:
- 200K tokenlik sabit bir ön ek (sistem istemi, araçlar, depo bağlamı)
- Her biri 2K yeni giriş tokeni ekleyen ve 3K çıkış tokeni üreten 50 adım (akıl yürütme dahil)
- Basit tutmak için, ön ek aynı boyutta kalır, adım 1'de önbelleğe yazılır ve kalan 49 adımda erişilir
| 6.1 Sol, önbelleksiz | 6 Sol + önbellek | 6.1 Sol + önbellek | Astra + önbellek | |
|---|---|---|---|---|
| Başlangıç 200K önbellek yazma | — | $0.50 | $0.50 | $2.50 |
| 49 önbellek okuma | — | $1.96 | $0.98 | $9.80 |
| Ön ek normal giriş olarak faturalandırılır | $20.00 | — | — | — |
| 100K yeni giriş (yazma oranında) | $0.20 | $0.25 | $0.25 | $1.25 |
| 150K çıkış | $1.50 | $1.50 | $1.50 | $7.50 |
| Toplam | $21.70 | $4.21 | $3.23 | $21.05 |
Üç önemli nokta:
- Önbellekleme en büyük etkendir. Aynı model, aynı iş ve önbelleksiz çalışmanın maliyeti neredeyse 7 kat daha fazladır.
- 6.1 Sol, 6 Sol'dan burada yaklaşık %23 daha ucuzdur ve aynı zamanda daha yüksek puan alır.
- Önbellek ağırlıklı işler için, Astra'nın fiyatı 5 kat liste fiyatı farkından daha fazladır. Bu örnekte 6.5 kat, çünkü Astra önbellekli girişi %90 indirimli ve 6.1 Sol %95 indirimli sunar.
Bu, OpenAI'nin rapor edilen görev başına maliyetleriyle (toplanan Vellum ve The Next Web): yaklaşık $1.50 vs $7.70 DeepSWE'de, $1.30 vs $9.30 OSWorld'de ve $5.47 vs $23.80 Terminal-Bench Science'da.
Bir uyarı: OpenAI, Astra'nın genellikle aynı görevi tamamlamak için daha az çıkış tokenine ihtiyaç duyduğunu söylüyor. Modelleri görev başına maliyetle karşılaştırın, token başına maliyetle değil.
Önbellek yazmaları ücretsiz değildir
6.1 Sol'da önbellek yazmaları giriş oranının 1.25 katına mal olmaktadır. Eğer bir ön ek yalnızca bir kez kullanılıyorsa, önbellekleme maliyeti %25 artırır. OpenAI'nin belgelerinden alınan formül:
- Bir yazma ve bir okuma: normal giriş maliyetinin 1.35 katı (6.1 Sol'da 1.3 kat), önbellekleme olmadan 2 kat
- Bir yazma ve dokuz okuma: yaklaşık 2.15 kat (6.1 Sol'da yaklaşık 1.7 kat), önbellekleme olmadan 10 kat
Minimum önbelleğe alınabilir ön ek 1,024 token'dır. OpenAI'nin başa baş hesaplaması, 102 token veya daha az bir ön ekin asla karşılığını vermediğini belirtmektedir. Eğer 10 veya daha fazla yeniden kullanım bekliyorsanız, 221 token üzerindeki her şeyi 1,024'e kadar doldurmak daha ucuzdur.
Tek seferlik çağrılar için, örneğin tek aşamalı sınıflandırma veya toplu çıkarım için, açık mod (prompt_cache_options.mode: "explicit") kullanarak yazmaları tamamen atlayabilirsiniz. Hiçbir yazma ücreti alınmayacaktır.
272K uçurumu
6.1 Sol, 1.05M token bağlamını kabul eder, ancak giriş 272K'yi geçtiğinde, tüm istek daha yüksek orana geçer, yalnızca sınırın üzerindeki tokenler değil.
| İstek | Giriş | Çıkış | Maliyet |
|---|---|---|---|
| A | 270K | 10K | 0.27 × $2 + 0.01 × $10 = $0.64 |
| B | 280K | 10K | 0.28 × $4 + 0.01 × $15 = $1.27 |
On bin daha fazla giriş tokeni, faturayı neredeyse iki katına çıkarıyor.
Bunun altında kalmak için:
- Tokenleri istemci tarafında sayın ve 272K'ye ulaşmadan önce sıkıştırın veya kesin
- Uzun belgelerin ilgili kısımlarını alın, tümünü göndermeyin
- Gerçekten uzun bir bağlama ihtiyaç duyduğunuzda, sabit kısmı önbelleğe alınmış bir ön ek olarak koyun
Akıl yürütme çabası faturada nasıl görünür
Akıl yürütme tokenleri çıkış oranında, milyon başına $10 olarak faturalandırılır. Aynı görevi düşükten maksimuma taşımak, akıl yürütme tokenlerini on kat veya daha fazla artırabilir.
OpenAI'nin rapor edilen görev başına maliyetleri, ölçeği anlamak için bir fikir verir (bunlar farklı kıyaslamalardır, bu yüzden yalnızca büyüklükleri karşılaştırın):
- AutomationBench (orta): ~$0.30
- GDP.pdf: ~$0.38
- DeepSWE (yüksek): ~$1.50
- Terminal-Bench Science (maks): ~$5.47
2. bölüm, bir seviye seçmenin nasıl yapılacağını kapsar. Burada bir hatırlatma: konuşma sırasında reasoning.effort değiştirmek önbelleği geçersiz kılar. Bunun yerine configuration_update kullanın.
Bu fiyat noktasında nasıl karşılaştırılır
| Model | Giriş / çıkış | Önbellekli giriş |
|---|---|---|
| GPT-6.1 Sol | $2 / $10 | $0.10 |
| Claude Sonnet 5.5 | $2 / $10 | $0.20 |
| GPT-6 Astra | $10 / $50 | $1.00 |
6.1 Sol ve Claude Sonnet 5.5 aynı liste fiyatına sahiptir ve 6.1 Sol'un önbellekli oranı Sonnet'in yarısıdır. Ancak farklı şeylerde güçlüler. Örneğin, AutomationBench'te Sonnet 5.5 çok daha iyi bir performans sergiliyor. İki modelin token başına maliyeti aynı olduğunda, iş yükünüzde görev başına maliyeti daha düşük olan daha ucuz olandır.
AIHubMix model listesi mevcut fiyatları göstermektedir ve tek bir API anahtarı hepsi için geçerlidir, bu nedenle yan yana testler yapmak kolaydır.
Rakip fiyatları üçüncü taraf kaynaklardan gelmektedir ve değişebilir. Güvenmeden önce resmi fiyatlandırma sayfalarını kontrol edin.
Maliyet kontrol listesi
- Öngörülebilir içeriği önce koyun. Sistem istemi, araç tanımları ve referans materyali en üstte yer alır. Zaman damgaları ve kullanıcı başına veriler en altta yer alır.
- Ekleyin, yeniden yazmayın. Özetleme, kısaltma ve sıkıştırma işlemleri önbelleği yeniden başlatır.
- Araç listesini sabit tutun. Her istekte araç eklemeyin veya çıkarmayın. Bunun yerine
tool_choiceveyaallowed_toolskullanın. - Çabayı
configuration_updateile değiştirin, istek parametresiyle değil. - 272K girişin altında kalın.
- Acelesi olmayan işleri yarı fiyatına Toplu veya Esnek olarak gönderin.
- Göreve göre yönlendirin. Basit yüksek hacimli işler için Luna, çoğu şey için 6.1 Sol, en zor problemler için Astra kullanın.
- Üç sayıya dikkat edin:
cached_tokens,cache_write_tokensvereasoning_tokens.
Sonuç olarak: liste fiyatı değişmedi, ancak önbellek okumaları %50 daha ucuz hale geldi. Ajan iş yükleri için, bu 6.1 Sol'u GPT-6 ailesindeki en iyi değerli model yapar, yeter ki önbelleği iyi kullanın ve 272K'nın altında kalın.
Sonraki: geçiş yaptığınızda karşılaşabileceğiniz sorunlar.
SSS
GPT-6.1 Sol'un maliyeti nedir? Milyon başına $2 giriş tokeni, $10 çıkış tokeni, $0.10 önbellekli giriş ve $2.50 önbellek yazmaları. 272K giriş tokenini aşan istekler, tüm istek için $4 giriş ve $15 çıkış olarak faturalandırılır.
AIHubMix üzerinden mi yoksa doğrudan OpenAI üzerinden mi daha ucuz? Aynı fiyat. AIHubMix'in OpenAI ve Azure yolları, OpenAI'nin resmi oranlarıyla eşleşmektedir.
Faturam neden tahmin ettiğimden daha yüksek? Dört yaygın neden: akıl yürütme tokenleri çıkış oranında faturalandırılır; 272K girişi aştınız; önbelleği kaçırdınız veya tek seferlik ön eklerde yazma ücretleri ödediniz; veya Hızlı mod veya bölgesel işleme açıktır.
Önbellek yazmaları ekstra maliyetli mi? Yazılan tokenler giriş oranının 1.25 katı olarak faturalandırılır. Bu, normal giriş ücretini değiştirmek yerine onun yerine geçer. Bir ön ek iki kullanımda kendini amorti eder. Tek seferlik ön ekler için, açık mod yazmaları tamamen atlamanıza izin verir.
6.1 Sol, Astra'dan ne kadar daha ucuz? Liste fiyatında beş kat daha ucuz. Önbellek ağırlıklı ajan işlerinde, fark 6 ila 7 katı bulabilir çünkü 6.1 Sol önbellekli girişi daha fazla indirimli sunar. Ancak Astra genellikle her görev için daha az çıkış tokeni kullanır, bu nedenle görev başına maliyeti karşılaştırın.
Toplu, önbellekle birleştirilebilir mi? Toplu ve Esnek her ikisi de yarı fiyatına. Ön bellek ile nasıl birleştiklerini görmek için OpenAI'nin fiyatlandırma sayfasına bakın.
Devam edin: GPT-6.1 Sol serisini okuyun
- Akıl yürütme tokenleri takip edilmesi en kolay maliyetlerdir. Hangi görevlerin düşükte iyi olduğunu ve ne zaman maksimumun karşılığını verdiğini: GPT-6.1 Sol için Akıl Yürütme Çabası Seçimi: düşükten maksimuma.
- Yeni önbellek kuralları, geçiş yaptıktan sonra faturayı artırabilir. Kesme noktaları, yazma faturalandırması, TTL ve sekiz diğer tuzaklar: GPT-6.1 Sol'a Geçiş: Yanlış Gidilebilecek 9 Şey.
- Daha ucuz, ama yeterince iyi mi? 6.1 Sol'un kodlama ve bilgisayar kullanımı konusunda Astra'ya ne kadar yaklaştığı: GPT-6.1 Sol vs GPT-6 Sol: Neredeyse Astra'yı Yakalayan Bir Haftalık Yükseltme.



