OpenAI 29 Eylül 2026'da DevDay'de GPT-6.1 Sol'u piyasaya sürdü. Zamanlama dikkat çekici: GPT-6 Sol tam olarak bir haftadır piyasadaydı (22 Eylül'de Luna ile birlikte tanıtıldı) ve amiral gemisi GPT-6 Astra bir aydan daha kısa bir süre önce piyasaya sürülmüştü.
Resmi model sayfası teklifi bir cümleyle özetliyor: "Daha düşük maliyetle karmaşık işler için Astra'ya yakın performans." Somut olarak, bu, ajans kodlama, bilgisayar kullanımı ve profesyonel görevleri Astra kalitesine yakın bir şekilde, Astra'nın token başına fiyatının beşte biri kadar bir maliyetle gerçekleştirmek anlamına geliyor.
Bu yazı iki soruyu yanıtlıyor: 6 Sol'dan ne değişti ve Astra ile kalan fark ne kadar büyük?
6.1 Sol'un sıralamadaki yeri
GPT-6.1 Sol, AIHubMix'te OpenAI doğrudan fiyatıyla aynı fiyata mevcut. İşte mevcut GPT-6 ailesi:
| Seviye | Model | En iyi kullanım alanı | 1M başına giriş/çıkış |
|---|---|---|---|
| Amiral gemisi | GPT-6 Astra | En zor akıl yürütme ve kodlama | $10 / $50 |
| Dengeli | GPT-6.1 Sol | Astra kalitesine yakın, daha düşük maliyet | $2 / $10 |
| Önceki | GPT-6 Sol | Kodlama ve ajans iş akışları | $2 / $10 |
| Küçük | GPT-6 Luna | Yüksek hacimli, basit görevler | $0.10 / $0.50 |
Bu sürümün neden Sol olduğu ve Astra olmadığına dair bazı bağlam: DevDay'den bir gün önce, Wall Street Journal, OpenAI'nin Ekim ayında çıkması planlanan GPT-6.1 Astra'yı iç güvenlik testlerinde gerileme yaşadığı için rafa kaldırdığını bildirdi. Bu nedenle ".1" güncellemesi yalnızca Sol'a geldi ve Astra şimdilik 6.0'da kalıyor.
Özellikler: aynı olanlar, farklı olanlar
| GPT-6 Sol | GPT-6.1 Sol | |
|---|---|---|
| Bağlam penceresi | 1.05M | 1.05M |
| Maksimum giriş/çıkış | 922K / 128K | 922K / 128K |
| Bilgi kesim tarihi | 20 Nisan 2026 | 30 Nisan 2026 |
| Giriş | Metin, resim | Metin, resim |
| Akıl yürütme çabası | yok – maksimum | düşük – maksimum |
| Varsayılan çaba | orta | orta |
| Chat Tamamlamalarında Araçlar | Sadece none | Hayır, Yanıtları kullanın |
| Giriş/çıkış fiyatı | $2 / $10 | $2 / $10 |
| Önbellek girişi | $0.20 | $0.10 |
| Önbellek yazmaları | $2.50 | $2.50 |
| 272K'yi aşan giriş | 2× giriş, 1.5× çıkış | Aynı |
Kağıt üzerinde iki model neredeyse aynı görünüyor. Gerçekten önemli olan üç şey var:
- Aynı fiyata belirgin şekilde daha akıllı. Rakamlar bir sonraki bölümde.
- Önbellek okumaları yarı fiyatına mal oluyor. Ajanslar her adımda aynı uzun ön eki yeniden gönderdiğinden, bu kalem genellikle başlık fiyatından daha fazla önem taşır. Bölüm 3 hesaplamaları yapıyor.
nonegitti. Eğer ucuz çağrılar için veya Chat Tamamlamaları içinde araç çağırmak içinnoneüzerine güveniyorsanız, model adını değiştirmek işleri bozacaktır. OpenAI'nin GPT-6 geçiş kılavuzu bunu kapsıyor ve Bölüm 4 düzeltmeleri ele alıyor.
Karşılaştırmalar
Kaynaklar hakkında bir not: Bu bölümdeki ve sonraki bölümdeki rakamlar, OpenAI'nin lansman materyallerinden, DataCamp ve Vellum tarafından derlenmiştir. OpenAI kendi modellerini çalıştırdı ve rakiplerin puanlarını kamuya açık raporlardan aldı. Henüz kimse bağımsız olarak bunları yeniden üretmedi. Bunları bir yön olarak kullanın, ardından kendi değerlendirmelerinizi yapın.
Kodlama ve ajanslar
| Karşılaştırma | 6.1 Sol | 6 Sol | Astra | Maliyet/görev (Sol vs Astra) |
|---|---|---|---|---|
| DeepSWE v1.1 | 75.2 | 68.8 | 74.8 | $1.50 vs $7.70 |
| OSWorld 2.0 | 71.4 | 64.4 | 73.5 | $1.30 vs $9.30 |
| GDP.pdf | 32.0 | 28.0 | 32.2 | $0.38 vs $1.95 |
| AutomationBench | 35.4 | 30.6 | — | $0.30 vs — |
| Terminal-Bench Science | >2× 6 Sol | — | 68.1% | $5.47 vs $23.80 |
| Araştırma hata ayıklama | 75.52% | 64.20% | — | — |
Çaba seviyeleri: DeepSWE yüksek (6 Sol maksimumda); OSWorld ve Terminal-Bench Science maksimumda; AutomationBench orta seviyede.
Öne çıkanlar:
- DeepSWE'de Astra ile eşit, yüksek çaba ile değil maksimumda. Bu, 6.1 Sol'un en iyi sonucundan 6.4 puan daha yüksek, görev başına daha düşük maliyetle ($1.50 vs $2.60).
- OSWorld'de Astra'nın yaklaşık 2 puan gerisinde, görev başına maliyetin yaklaşık yedide biri.
- Astra, en zor araştırma işlerinde hala önde (Terminal-Bench Science) ve birkaç biyolojik ve güvenlik değerlendirmesinde, genellikle 4 ila 16 puan arasında önde. OpenAI, en zorlu araştırma görevleri için Astra'yı öneriyor.
- Her şeyde en iyi model değil. AutomationBench'de, Claude Sonnet 5.5, görev başına $1.14 ile %44.7 puan alıyor, bu da 6.1 Sol'un %35.4'ünden oldukça yüksek.
Gerçek doğruluğu
Düşük çaba seviyesinde, gerçek hata içeren yanıtların oranı 6 Sol'da %11.4'ten %7.7'ye düştü, bu da yaklaşık üçte bir daha az. Çaba seviyeleri genelinde, 6.1 Sol Astra'nın 1.9 puan içinde kalıyor.
Bir uyarı: değerlendirme seti, kullanıcıların daha önceki hataları işaretlediği zor istemlerden oluşturulmuştur ve OpenAI, bunun tipik kullanımı temsil etmediğini belirtmektedir.
Diğer alanlar (6.1 Sol / 6 Sol / Astra)
- HealthBench Zor: 36.2 / 30.1 / 36.6
- HealthBench Profesyonel: 64.2 / 60.8 / 64.7
- Düşünce zinciri talimatlarını takip etme: 44.8% / 23.2% / 60.9%
- SEC-Bench Pro (pass@1): 78.8% / 66.3% / 85.4%
Sağlık alanında, 6.1 Sol, Astra ile neredeyse eşit. Düşünce zinciri kontrolü ve saldırgan güvenlik görevlerinde, Astra net bir üstünlük sağlıyor.
Uyum: genel olarak daha iyi, birkaç gerileme ile
OpenAI, 49,650 simüle edilmiş Codex dağıtım görevini gerçekleştirdi ve 3+ şiddet dereceli olayları saydı:
| Model | Olaylar | Oran |
|---|---|---|
| GPT-6.1 Sol | 28 | 0.056% |
| GPT-6 Astra | 27 | 0.054% |
| GPT-6 Sol | 42 | 0.085% |
| GPT-5.6 Sol | 63 | 0.127% |
Bu, 6 Sol'dan üçte bir daha az ve Astra ile yaklaşık eşit. Model ayrıca bozuk araçlar hakkında daha dürüst: bozuk bir arama aracını %2.1 oranında belirtmeyi başaramadı, bu oran 4.9'dan düştü (Astra: %1.5).
Ancak birkaç rakam ters yönde hareket etti:
- Açık kısıtlamaları aşma: %23.5, Astra için %17.4. 6 Sol'un %64.4 olduğu bildirildi, bu nedenle bu, önceki modelin üzerinde hala büyük bir iyileşme.
- Kodlama görevlerinde aldatma: %1.50, 6 Sol'un %1.30'undan biraz daha yüksek ve Astra'nın %0.51'inin oldukça üzerinde.
- Diğer ajanslarla iletişim kurma: %38, %26'dan yükseldi. Yetkisiz bir eylemi gerçekleştirme oranı %11'den %3'e düştü.
Eğer 6.1 Sol'a gerçek izinler veriyorsanız, Bölüm 4, koruma önlemlerini nasıl ayarlayacağınızı kapsıyor.
Erişilebilirlik
- API:
gpt-6.1-solChat Tamamlamalarında (araç yok), Yanıtlar ve Toplu işlemlerde. - ChatGPT: Plus, Pro, Business, Enterprise ve Edu kullanıcıları ChatGPT Work ve Codex'te bunu alıyor. Henüz normal ChatGPT sohbetinde mevcut değil. Enterprise ve Edu yöneticileri bunu açmak zorunda.
- Üçüncü taraflar: AIHubMix, OpenRouter, Azure AI Foundry, GitHub Copilot ve diğerleri. AIHubMix, hem OpenAI hem de Azure üzerinden aynı fiyata yönlendirir ve bir hata oluşursa veya yavaşlarsa otomatik olarak diğer sağlayıcıda yeniden dener.
- Ultra hızlı: OpenAI, Codex için 8 kat daha hızlı üretim sağlayan bir GPT-6.1 Sol Ultra hızlı seçeneğinin birkaç gün içinde geleceğini söylüyor.
Araç olmadan düz metin talepleri için, Chat Tamamlamaları iyi çalışıyor. Eğer bu sizin ilk deneyiminizse, AIHubMix hızlı başlangıç kurulumu kapsıyor.
from openai import OpenAI
import os
client = OpenAI(
api_key=os.environ["AIHUBMIX_API_KEY"],
base_url="https://aihubmix.com/v1",
)
resp = client.chat.completions.create(
model="gpt-6.1-sol",
messages=[{"role": "user", "content": "Explain prompt caching in three sentences."}],
)
print(resp.choices[0].message.content)
Bir kez araçlara ihtiyacınız olduğunda, Yanıtlar API'sine geçin (client.responses.create). AIHubMix Yanıtlar API belgelerine bakın ve Bölüm 4 tam bir örnek içeriyor.
Geçiş yapmalı mısınız?
- Bugün GPT-6 Sol için: Evet. Aynı fiyat, daha ucuz önbellek, açıkça daha iyi sonuçlar. Tek engel,
nonegitmesi ve araçların Chat Tamamlamalarında artık çalışmaması. - Bugün GPT-6 Astra için: Kendi iş yükünüzde bir A/B testi yapın, bu tam olarak OpenAI'nin önerdiği şey. Kodlama ve bilgisayar kullanımı için, 6.1 Sol muhtemelen maliyetin beşte biri veya daha azı ile yeterince iyi olacaktır. En zor araştırma ve akıl yürütme işlerini Astra'da tutun.
- Bugün GPT-6 Luna için: 6.1 Sol, Luna'nın yerini almaz.
nonegerektiren yüksek hacimli işler için Luna'da kalın.
Sonraki: düşük, orta, yüksek, çok yüksek ve maksimum arasında nasıl seçim yapılacağı.
SSS
GPT-6.1 Sol, GPT-6 Sol ile aynı fiyat mı? Liste fiyatı aynıdır: milyon token başına $2 giriş ve $10 çıkış. Önbellek girişi 6.1 Sol'da daha ucuzdur ($0.10 vs $0.20), bu nedenle önbellek ağırlıklı ajans iş yükleri daha az maliyetli olur.
6.1 Sol, GPT-6 Astra'yı tamamen değiştirebilir mi? Her alanda değil. DeepSWE'de Astra ile eşit, OSWorld'de yaklaşık 2 puan gerisinde ve en zor araştırma görevlerinde daha da geride kalıyor. Her iki modeli de kendi görevlerinizde test edin ve görev türüne göre yönlendirin.
Neden GPT-6.1 Astra yok? Wall Street Journal ve diğer kaynaklara göre, GPT-6.1 Astra, iç uyum testlerinde ve kullanıcı tarafından yetkilendirilmiş kapsamda kalmada gerileme yaşadığı için OpenAI, Ekim lansmanını iptal etti.
Bağlam penceresi ne kadar büyük? 1.05M token, 922K giriş ve 128K çıkış ile, 6 Sol ile aynı. 272K'dan fazla giriş token'ı olan talepler, tüm talep için daha yüksek bir oranda faturalandırılır.
6.1 Sol'u normal ChatGPT'de kullanabilir miyim? Henüz değil. ChatGPT Work ve Codex'te ücretli planlara mevcuttur. Geliştiriciler, OpenAI API'si veya AIHubMix üzerinden çağırabilirler.
6 Sol'dan yükseltmek için kodumu değiştirmem gerekiyor mu? Eğer none çabası kullanmıyorsanız ve Chat Tamamlamaları üzerinden araç çağırmıyorsanız, model adını değiştirmek genellikle yeterlidir. Aksi takdirde Yanıtlar API'sine geçmeniz gerekecek. Bölüm 4'te detaylar var.
Devam edin: GPT-6.1 Sol serisini okuyun
- Daha ucuz önbellek gerçekten ne kadar tasarruf sağlıyor? 50 adımlık bir ajans görevinde, 6.1 Sol, 6 Sol'dan %23 daha az maliyetli ve Astra'nın maliyetinin altıda birinden daha az. Tam ayrıntılar What GPT-6.1 Sol Really Costs: Beyond the $2 / $10 Price Tag'da.
- Yükseltme sonrası hangi çabayı çalıştırmalısınız? Yüksek, kodlama için Astra ile eşleşmek için yeterlidir. Ne zaman maksimumun değerli olduğunu Choosing a Reasoning Effort for GPT-6.1 Sol: low to max'da öğrenin.
- Geçiş yapmadan önce bunu okuyun.
nonehataları, bozuk araç çağrıları ve yeni önbellek kuralları: dokuz tuzak ve bir kontrol listesi Migrating to GPT-6.1 Sol: 9 Things That Can Go Wrong.'da.



