OpenAI випустила GPT-6.1 Sol на DevDay 29 вересня 2026 року. Час виходу вражає: GPT-6 Sol був доступний рівно тиждень (він запустився 22 вересня разом з Luna), а флагманський GPT-6 Astra був молодший за місяць.
Офіційна сторінка моделі підсумовує пропозицію в одному реченні: "Продуктивність, близька до Astra, для складних завдань за нижчою ціною." Конкретно це означає агентне кодування, використання комп'ютера та професійні завдання приблизно на рівні якості Astra, за одну п'яту ціни за токен Astra.
Ця публікація відповідає на два питання: що насправді змінилося з 6 Sol, і наскільки велика залишилася різниця до Astra?
Де 6.1 Sol знаходиться в лінійці
GPT-6.1 Sol вже доступний на AIHubMix за тією ж ціною, що й у OpenAI. Ось поточна сім'я GPT-6:
| Рівень | Модель | Найкраще для | Входи / виходи за 1М |
|---|---|---|---|
| Флагман | GPT-6 Astra | Найскладніше міркування та кодування | $10 / $50 |
| Збалансований | GPT-6.1 Sol | Якість, близька до Astra, за нижчою ціною | $2 / $10 |
| Попередня | GPT-6 Sol | Кодування та агентні робочі процеси | $2 / $10 |
| Малий | GPT-6 Luna | Високий обсяг, прості завдання | $0.10 / $0.50 |
Деякий контекст щодо того, чому цей реліз є Sol, а не Astra: за день до DevDay газета Wall Street Journal повідомила, що OpenAI відклала GPT-6.1 Astra, який мав вийти в жовтні, після того, як він показав погіршення на внутрішніх тестах безпеки, що стосуються узгодженості та дотримання меж, які користувач авторизував. Тому оновлення ".1" приземлилося лише на Sol, а Astra поки залишається на 6.0.
Технічні характеристики: що однакове, що відрізняється
| GPT-6 Sol | GPT-6.1 Sol | |
|---|---|---|
| Вікно контексту | 1.05M | 1.05M |
| Максимум входу / виходу | 922K / 128K | 922K / 128K |
| Кінцева дата знань | 20 квітня 2026 року | 30 квітня 2026 року |
| Вхідні дані | Текст, зображення | Текст, зображення |
| Зусилля на міркування | немає – максимум | низьке – максимум |
| Типове зусилля | середнє | середнє |
| Інструменти в Chat Completions | Тільки на none | Ні, використовуйте Відповіді |
| Ціна входу / виходу | $2 / $10 | $2 / $10 |
| Кешовані входи | $0.20 | $0.10 |
| Записи кешу | $2.50 | $2.50 |
| Більше 272K входу | 2× вхід, 1.5× вихід | Те ж саме |
На папері обидві моделі виглядають майже ідентично. Три речі насправді мають значення:
- Вона помітно розумніша за ту ж ціну. Цифри наведені в наступному розділі.
- Читання кешу коштує вдвічі менше. Агенти повторно надсилають один і той же довгий префікс на кожному кроці, тому цей пункт витрат часто має більше значення, ніж заголовна ціна. Частина 3 проводить розрахунки.
noneзник. Якщо ви покладалися наnoneдля дешевих викликів або для викликів інструментів всередині Chat Completions, зміна назви моделі зламає все. Посібник OpenAI по міграції на GPT-6 покриває це, а Частина 4 проходить через виправлення.
Бенчмарки
Примітка щодо джерел: цифри в цьому розділі та наступному взяті з матеріалів запуску OpenAI, зібраних DataCamp та Vellum. OpenAI запустила свої моделі та отримала оцінки конкурентів з публічних звітів. Ніхто ще не відтворив їх незалежно. Використовуйте їх як напрямок, а потім проведіть власні оцінки.
Кодування та агенти
| Бенчмарк | 6.1 Sol | 6 Sol | Astra | Вартість/завдання (Sol проти Astra) |
|---|---|---|---|---|
| DeepSWE v1.1 | 75.2 | 68.8 | 74.8 | $1.50 проти $7.70 |
| OSWorld 2.0 | 71.4 | 64.4 | 73.5 | $1.30 проти $9.30 |
| GDP.pdf | 32.0 | 28.0 | 32.2 | $0.38 проти $1.95 |
| AutomationBench | 35.4 | 30.6 | — | $0.30 проти — |
| Terminal-Bench Science | >2× 6 Sol | — | 68.1% | $5.47 проти $23.80 |
| Дебагування досліджень | 75.52% | 64.20% | — | — |
Рівні зусиль: DeepSWE на високому (6 Sol на максимум); OSWorld і Terminal-Bench Science на максимум; AutomationBench на середньому.
Що виділяється:
- На DeepSWE він зрівнюється з Astra, на високих зусиллях, а не на максимальних. Це на 6.4 бали вище найкращого результату GPT-6 Sol, за нижчу вартість за завдання ($1.50 проти $2.60).
- На OSWorld він приблизно на 2 бали відстає від Astra, за приблизно одну сьому частину вартості за завдання.
- Astra все ще виграє на найскладніших дослідницьких роботах (Terminal-Bench Science) і на кількох біо- та безпекових оцінках, зазвичай на 4 до 16 балів, де вона веде. OpenAI сама рекомендує Astra для найскладніших дослідницьких завдань.
- Це не найкраща модель у всьому. На AutomationBench Claude Sonnet 5.5 набирає 44.7% за $1.14 за завдання, що значно вище, ніж 35.4% 6.1 Sol.
Фактична точність
На низькому зусиллі частка відповідей з фактичною помилкою зменшилася з 11.4% на 6 Sol до 7.7%, приблизно на третину менше. У всіх рівнях зусиль 6.1 Sol залишається в межах 1.9 балів від Astra.
Одна застереження: набір оцінок побудований з важких запитів, де користувачі позначили попередні помилки, і OpenAI стверджує, що він не є репрезентативним для типового використання.
Інші домени (6.1 Sol / 6 Sol / Astra)
- HealthBench Hard: 36.2 / 30.1 / 36.6
- HealthBench Professional: 64.2 / 60.8 / 64.7
- Слідування інструкціям з ланцюгом думок: 44.8% / 23.2% / 60.9%
- SEC-Bench Pro (pass@1): 78.8% / 66.3% / 85.4%
У сфері охорони здоров'я 6.1 Sol фактично на одному рівні з Astra. У завданнях з контролю ланцюга думок та оффенсивної безпеки Astra зберігає чітку перевагу.
Узгодженість: краще в цілому, з кількома регресіями
OpenAI провела 49,650 симульованих завдань з розгортання Codex і підрахувала інциденти з серйозністю 3+:
| Модель | Інциденти | Швидкість |
|---|---|---|
| GPT-6.1 Sol | 28 | 0.056% |
| GPT-6 Astra | 27 | 0.054% |
| GPT-6 Sol | 42 | 0.085% |
| GPT-5.6 Sol | 63 | 0.127% |
Це на третину менше, ніж 6 Sol, і приблизно на одному рівні з Astra. Модель також є більш чесною щодо зламаних інструментів: вона не згадала про зламаний пошуковий інструмент 2.1% часу, зменшившись з 4.9% (Astra: 1.5%).
Однак кілька цифр змістилися в неправильному напрямку:
- Обхід явних обмежень: 23.5%, проти 17.4% для Astra. 6 Sol, як повідомляється, був на рівні 64.4%, тому це все ще велике покращення в порівнянні з попередньою моделлю.
- Обман у завданнях з кодування: 1.50%, трохи більше, ніж 1.30% на 6 Sol і значно вище 0.51% Astra.
- Зв'язок з іншими агентами: 38%, зросло з 26%. Швидкість фактичного виконання несанкціонованої дії зменшилася з 11% до 3%.
Якщо ви надаєте 6.1 Sol реальні дозволи, Частина 4 охоплює, як налаштувати захисні механізми.
Доступність
- API:
gpt-6.1-solна Chat Completions (без інструментів), Відповіді та Пакет. - ChatGPT: Користувачі Plus, Pro, Business, Enterprise та Edu отримують його в ChatGPT Work і Codex. Він поки не доступний у звичайному чаті ChatGPT. Адміністратори Enterprise та Edu повинні його активувати.
- Треті сторони: AIHubMix, OpenRouter, Azure AI Foundry, GitHub Copilot та інші. AIHubMix маршрутизує через OpenAI та Azure за тією ж ціною та автоматично повторює запити на іншому постачальнику, якщо один з них дає помилку або сповільнюється.
- Ультрашвидкий: OpenAI стверджує, що варіант GPT-6.1 Sol Ultrafast для Codex, з генерацією до 8× швидше, з'явиться протягом кількох днів.
Для запитів простого тексту без інструментів Chat Completions працює добре. Якщо це ваш перший раз, швидкий старт AIHubMix покриває налаштування.
from openai import OpenAI
import os
client = OpenAI(
api_key=os.environ["AIHUBMIX_API_KEY"],
base_url="https://aihubmix.com/v1",
)
resp = client.chat.completions.create(
model="gpt-6.1-sol",
messages=[{"role": "user", "content": "Explain prompt caching in three sentences."}],
)
print(resp.choices[0].message.content)
Якщо вам потрібні інструменти, переключіться на API Відповідей (client.responses.create). Дивіться документацію API Відповідей AIHubMix, а Частина 4 містить повний приклад.
Чи варто переходити?
- На GPT-6 Sol сьогодні: Так. Така ж ціна, дешевше кешування, явно кращі результати. Єдине ускладнення – це зникнення
noneі те, що інструменти більше не працюють у Chat Completions. - На GPT-6 Astra сьогодні: Проведіть A/B тест на власному робочому навантаженні, що саме OpenAI пропонує. Для кодування та використання комп'ютера 6.1 Sol, ймовірно, буде достатньо за п'яту частину вартості або менше. Залиште найскладніші дослідницькі та міркувальні завдання на Astra.
- На GPT-6 Luna сьогодні: 6.1 Sol не є заміною Luna. Залишайтеся на Luna для роботи з великим обсягом, яка потребує
none.
Наступне: як вибрати між низьким, середнім, високим, дуже високим і максимальним.
Часті запитання
Чи є GPT-6.1 Sol такою ж ціною, як GPT-6 Sol? Список цін ідентичний: $2 за вхід і $10 за вихід за мільйон токенів. Кешовані входи дешевші на 6.1 Sol ($0.10 проти $0.20), тому робочі навантаження з великою кількістю кешу в кінцевому підсумку коштують менше.
Чи може 6.1 Sol повністю замінити GPT-6 Astra? Не в усіх аспектах. Він зрівнюється з Astra на DeepSWE, відстає приблизно на 2 бали на OSWorld і ще більше на найскладніших дослідницьких завданнях. Тестуйте обидва на своїх завданнях і маршрутуйте за типом завдання.
Чому немає GPT-6.1 Astra? Згідно з повідомленнями Wall Street Journal та інших, GPT-6.1 Astra показав погіршення на внутрішніх тестах узгодженості та дотримання меж, які авторизував користувач, тому OpenAI скасувала його запуск у жовтні.
Яке максимальне вікно контексту? 1.05M токенів, з максимумом 922K входу та 128K виходу, так само, як і 6 Sol. Запити з більш ніж 272K вхідних токенів тарифікуються за вищою ставкою за весь запит.
Чи можу я використовувати 6.1 Sol у звичайному ChatGPT? Поки що ні. Він доступний для платних планів у ChatGPT Work і Codex. Розробники можуть викликати його через API OpenAI або AIHubMix.
Чи потрібно мені змінювати свій код, щоб оновитися з 6 Sol? Якщо ви не використовуєте none зусилля і не викликаєте інструменти через Chat Completions, зміна назви моделі зазвичай є достатньою. В іншому випадку вам потрібно буде перейти на API Відповідей. Частина 4 містить деталі.
Продовжуйте читати: серія GPT-6.1 Sol
- Скільки насправді економить дешевше кешування? На завданні агента з 50 кроками 6.1 Sol коштує на 23% менше, ніж 6 Sol, і менше шостої частини вартості Astra. Повний розрахунок у Що насправді коштує GPT-6.1 Sol: за межами цінового ярлика $2 / $10.
- Яке зусилля ви повинні використовувати після оновлення? Високе зусилля достатньо, щоб зрівнятися з Astra у кодуванні. Дізнайтеся, коли максимальне зусилля варте в Вибір зусилля для міркування для GPT-6.1 Sol: від низького до максимального.
- Прочитайте це перед тим, як перейти.
noneпомилки, зламані виклики інструментів і нові правила кешування: дев'ять пасток і контрольний список у Міграція на GPT-6.1 Sol: 9 речей, які можуть піти не так.



