GPT-6.1 Sol має таку ж цінову категорію, як і GPT-6 Sol: $2 за мільйон вхідних токенів і $10 за мільйон вихідних токенів. Ваш рахунок залежить від чотирьох інших факторів: як часто ви використовуєте кеш, чи перевищуєте 272K вхідних токенів, який рівень сервісу ви використовуєте та скільки токенів для міркування спалює модель. У цьому пості розглядаються всі ці фактори.
Повний список цін
Стандартні тарифи (за 1M токенів)
| GPT-6.1 Sol | GPT-6 Sol | GPT-6 Astra | GPT-6 Luna | |
|---|---|---|---|---|
| Вхід | $2.00 | $2.00 | $10.00 | $0.10 |
| Кешовані вхідні | $0.10 | $0.20 | $1.00 | — |
| Записи кешу | $2.50 | $2.50 | — | — |
| Вихід (включаючи міркування) | $10.00 | $10.00 | $50.00 | $0.50 |
Тариф кешування Astra базується на звітах третіх сторін. Його тариф на записи кешу має становити $12.50 відповідно до правила OpenAI 1.25×. Для цін на кеш Luna дивіться сторінку цін OpenAI.
Множники
Ці правила походять з сторінки моделі GPT-6.1 Sol:
| Умова | Що відбувається |
|---|---|
| Більше 272K вхідних токенів | Вся запит раховується за 2× вхід та кеш, 1.5× вихід ($4 / $15, кеш-зчитування $0.20, кеш-записи $5) |
| Пакет / Гнучкість | Половина стандартного тарифу |
| Швидкий режим | Вдвічі більше стандартного тарифу (не доступно з резидентством даних в ЄС) |
| Регіональна обробка | +10% |
| Виклики інструментів (пошук, використання комп'ютера тощо) | Оплачується за виклик. AIHubMix вказує веб-пошук за $0.01 за запит |
| Ультра-швидкий (скоро в Codex) | Офіційно ще не оцінено. Один звіт говорить про 6× стандарт, не підтверджено |
На AIHubMix маршрути OpenAI та Azure коштують так само, як і безпосередньо OpenAI, і рівень понад 272K вже вказано.
Справжня зміна: кеш-зчитування на 5% від вхідних
Список цін не змінився. Кеш-зчитування змінилося, з 10% від тарифу на вхід ($0.20) до 5% ($0.10). Документи OpenAI з кешування запитів говорять прямо: кеш-зчитування становлять 0.1× вхід на більшості моделей і "0.05× на GPT-6.1 Sol."
Це важливо, оскільки агенти повторно надсилають один і той же матеріал на кожному кроці: системний запит, визначення інструментів, контекст репозиторію та історію розмови. Більшість їхнього вхідного матеріалу - це повторюваний контент. Для цих навантажень кешований тариф фактично є вашою реальною ціною на вхід.
Приклад: одне завдання кодувального агента
Припущення:
- Фіксований префікс 200K токенів (системний запит, інструменти, контекст репозиторію)
- 50 кроків, кожен з яких додає 2K нових вхідних токенів і виробляє 3K вихідних токенів (включаючи міркування)
- Щоб спростити, префікс залишається того ж розміру, записується в кеш на кроці 1 і використовується на всіх 49 залишкових кроках
| 6.1 Sol, без кешу | 6 Sol + кеш | 6.1 Sol + кеш | Astra + кеш | |
|---|---|---|---|---|
| Початкове 200K кеш-запис | — | $0.50 | $0.50 | $2.50 |
| 49 кеш-зчитувань | — | $1.96 | $0.98 | $9.80 |
| Префікс, що оплачується як звичайний вхід | $20.00 | — | — | — |
| 100K нових вхідних (за тарифом запису) | $0.20 | $0.25 | $0.25 | $1.25 |
| 150K виходу | $1.50 | $1.50 | $1.50 | $7.50 |
| Всього | $21.70 | $4.21 | $3.23 | $21.05 |
Три висновки:
- Кешування - це найбільший важіль. Та сама модель, та сама робота, а некешований запуск коштує майже в 7 разів більше.
- 6.1 Sol приблизно на 23% дешевше, ніж 6 Sol тут, при цьому також отримуючи вищі бали.
- Для роботи з великою кількістю кешу Astra коштує більше, ніж вказує розрив у 5× за списком цін. У цьому прикладі це 6.5×, оскільки Astra знижує кешовані вхідні дані на 90%, а 6.1 Sol - на 95%.
Це узгоджується з повідомленими OpenAI витратами на завдання (зібраними Vellum та The Next Web): приблизно $1.50 проти $7.70 на DeepSWE, $1.30 проти $9.30 на OSWorld та $5.47 проти $23.80 на Terminal-Bench Science.
Одна застереження: OpenAI стверджує, що Astra зазвичай потребує менше вихідних токенів для завершення того ж завдання. Порівнюйте моделі за вартістю за завданням, а не за вартістю за токен.
Записи кешу не безкоштовні
Записи кешу на 6.1 Sol коштують 1.25× від тарифу на вхід. Якщо префікс використовується лише один раз, кешування робить його на 25% дорожчим. Використовуючи формулу з документів OpenAI:
- Один запис плюс одне зчитування: 1.35× звичайної вартості вхідних (1.3× на 6.1 Sol), проти 2× без кешування
- Один запис плюс дев'ять зчитувань: приблизно 2.15× (приблизно 1.7× на 6.1 Sol), проти 10×
Мінімальний кешований префікс - 1,024 токени. Математика беззбитковості OpenAI говорить, що префікс з 102 токенів або менше ніколи не окупається. Якщо ви очікуєте 10 або більше повторних використань, розширення всього, що перевищує 221 токен до 1,024, буде дешевшим.
Для одноразових викликів, таких як класифікація в один хід або масова екстракція, використовуйте явний режим (prompt_cache_options.mode: "explicit") без контрольних точок. Вам не буде нараховано за жодні записи.
Кліф 272K
6.1 Sol приймає 1.05M токенів контексту, але якщо вхід перевищує 272K, весь запит переходить на вищий тариф, а не лише токени, що перевищують межу.
| Запит | Вхід | Вихід | Вартість |
|---|---|---|---|
| A | 270K | 10K | 0.27 × $2 + 0.01 × $10 = $0.64 |
| B | 280K | 10K | 0.28 × $4 + 0.01 × $15 = $1.27 |
Додаткові 10,000 вхідних токенів майже подвоюють рахунок.
Як залишитися нижче:
- Рахуйте токени на стороні клієнта та компактно або обрізайте перед досягненням 272K
- Отримуйте відповідні частини довгих документів замість того, щоб надсилати все
- Коли вам дійсно потрібен довгий контекст, помістіть фіксовану частину в кешований префікс
Як зусилля на міркування відображається в рахунку
Токени міркування нараховуються за тарифом виходу, $10 за мільйон. Переміщення того ж завдання з низького до максимального може збільшити кількість токенів міркування в десять і більше разів.
Повідомлені OpenAI витрати на завдання дають уявлення про масштаб (це різні бенчмарки, тому порівнюйте лише величини):
- AutomationBench (середній): ~$0.30
- GDP.pdf: ~$0.38
- DeepSWE (високий): ~$1.50
- Terminal-Bench Science (максимум): ~$5.47
Частина 2 охоплює, як вибрати рівень. Одна нагадування тут: зміна reasoning.effort серед розмови анулює кеш. Використовуйте configuration_update замість цього.
Як це порівнюється за ціною
| Модель | Вхід / вихід | Кешовані вхідні |
|---|---|---|
| GPT-6.1 Sol | $2 / $10 | $0.10 |
| Claude Sonnet 5.5 | $2 / $10 | $0.20 |
| GPT-6 Astra | $10 / $50 | $1.00 |
6.1 Sol та Claude Sonnet 5.5 мають однакову ціну, а кешований тариф 6.1 Sol вдвічі нижчий за тариф Sonnet. Проте вони сильні в різних аспектах. Наприклад, на AutomationBench Sonnet 5.5 показує значно кращі результати. Коли дві моделі коштують однаково за токен, та, що має нижчу вартість за завдання у вашому навантаженні, є дешевшою.
Список моделей AIHubMix показує актуальні ціни, і один API-ключ працює для всіх з них, тому тестування поряд з іншими є простим.
Ціни конкурентів походять з третіх сторін і можуть змінюватися. Перевіряйте офіційні сторінки цін перед тим, як покладатися на них.
Контрольний список витрат
- Спочатку розмістіть стабільний контент. Системний запит, визначення інструментів та довідковий матеріал розміщуються на початку. Позначки часу та дані за користувачем - в кінці.
- Додавайте, не переписуйте. Підсумовування, скорочення та компактування всі перезапускають кеш.
- Зберігайте список інструментів стабільним. Не додавайте або не видаляйте інструменти за запитом. Використовуйте
tool_choiceабоallowed_toolsзамість цього. - Змінюйте зусилля за допомогою
configuration_update, а не параметра запиту. - Залишайтеся нижче 272K вхідних.
- Надсилайте термінові роботи через Batch або Flex за половину ціни.
- Маршрутизуйте за завданням. Luna для простих об'ємних робіт, 6.1 Sol для більшості завдань, Astra для найскладніших проблем.
- Слідкуйте за трьома числами:
cached_tokens,cache_write_tokens, іreasoning_tokens.
Основний висновок: ціна за списком не змінилася, але кеш-зчитування стали на 50% дешевшими. Для навантажень агентів це робить 6.1 Sol найкращою моделлю за вартістю в родині GPT-6, якщо ви добре використовуєте кешування та залишаєтеся нижче 272K.
Наступне: проблеми, з якими ви, ймовірно, зіткнетеся при переході.
Питання та відповіді
Скільки коштує GPT-6.1 Sol? $2 за мільйон вхідних токенів, $10 за мільйон вихідних токенів, $0.10 за кешовані вхідні та $2.50 за записи кешу. Запити понад 272K вхідних токенів нараховуються за $4 вхід і $15 вихід для всього запиту.
Чи дешевше через AIHubMix чи безпосередньо OpenAI? Та ж ціна. Маршрути OpenAI та Azure в AIHubMix обидва відповідають офіційним тарифам OpenAI.
Чому мій рахунок вищий, ніж я оцінював? Чотири поширені причини: токени міркування нараховуються за тарифом виходу; ви перевищили 272K вхідних; ви пропустили кеш або сплатили збори за записи на одноразових префіксах; або увімкнено швидкий режим або регіональна обробка.
Чи коштують записи кешу додатково? Записані токени нараховуються за 1.25× тарифом на вхід. Це замінює звичайну плату за вхід, а не додає до неї. Префікс окупає себе після двох використань. Для одноразових префіксів явний режим дозволяє вам зовсім уникнути записів.
Наскільки дешевше 6.1 Sol, ніж Astra? У п'ять разів дешевше за списком цін. Для роботи з великою кількістю кешу розрив може досягати 6-7×, оскільки 6.1 Sol більше знижує кешовані вхідні дані. Проте Astra часто використовує менше вихідних токенів за завдання, тому порівнюйте вартість за завданням.
Чи можна поєднувати Batch з кешуванням? Batch і Flex коштують обидва в половину ціни. Для того, як вони поєднуються з кешуванням, перевірте сторінку цін OpenAI.
Продовжуйте читати: серія GPT-6.1 Sol
- Токени міркування - це найпростіша вартість, яку можна втратити з виду. Які завдання підходять для низького, і коли максимальний варіант виправдовує себе: Вибір зусилля на міркування для GPT-6.1 Sol: від низького до максимального.
- Нові правила кешування можуть підвищити ваш рахунок після міграції. Контрольні точки, тарифи на записи, TTL та вісім інших підводних каменів: Міграція на GPT-6.1 Sol: 9 речей, які можуть піти не так.
- Дешевше, але чи достатньо це добре? Наскільки близько 6.1 Sol підходить до Astra в кодуванні та використанні комп'ютера: GPT-6.1 Sol проти GPT-6 Sol: одне оновлення на тиждень, яке майже наздоганяє Astra.



