GPT-6.1 Sol имеет такую же розничную цену, как и GPT-6 Sol: $2 за миллион входных токенов и $10 за миллион выходных токенов. Ваш фактический счет зависит от четырех других факторов: как часто вы обращаетесь к кэшу, превышаете ли 272K входных токенов, какой уровень сервиса вы используете и сколько токенов рассуждения использует модель. В этом посте рассматривается каждый из этих факторов.
Полный список цен
Стандартные тарифы (за 1M токенов)
| GPT-6.1 Sol | GPT-6 Sol | GPT-6 Astra | GPT-6 Luna | |
|---|---|---|---|---|
| Вход | $2.00 | $2.00 | $10.00 | $0.10 |
| Кэшированный вход | $0.10 | $0.20 | $1.00 | — |
| Записи в кэш | $2.50 | $2.50 | — | — |
| Выход (включая рассуждения) | $10.00 | $10.00 | $50.00 | $0.50 |
Кэшированная ставка Astra основана на отчетах третьих лиц. Ее ставка на запись в кэш должна составлять $12.50 по правилу OpenAI 1.25×. Для цен на кэш Luna смотрите страницу цен OpenAI.
Множители
Эти правила взяты со страницы модели GPT-6.1 Sol:
| Условие | Что происходит |
|---|---|
| Более 272K входных токенов | Вся запрос оплачивается по ставке 2× за вход и кэш, 1.5× за выход ($4 / $15, чтение из кэша $0.20, запись в кэш $5) |
| Пакет / Гибкость | Половина стандартной ставки |
| Режим быстрого выполнения | Вдвое выше стандартной ставки (недоступно с резидентством данных в ЕС) |
| Региональная обработка | +10% |
| Вызовы инструментов (поиск, использование компьютера и т. д.) | Оплачивается за вызов. AIHubMix указывает веб-поиск по $0.01 за запрос |
| Ультрабыстрый (скоро в Codex) | Официальная цена еще не установлена. Один отчет говорит о 6× стандартной, не подтверждено |
На AIHubMix маршруты OpenAI и Azure стоят столько же, сколько и прямые маршруты OpenAI, и уровень выше 272K уже указан.
Реальное изменение: чтение из кэша по 5% от входа
Розничная цена не изменилась. Чтение из кэша изменилось с 10% от ставки входа ($0.20) до 5% ($0.10). Документы OpenAI по кэшированию подсказок говорят прямо: чтение из кэша составляет 0.1× входа на большинстве моделей и "0.05× на GPT-6.1 Sol."
Это важно, потому что агенты повторно отправляют один и тот же материал на каждом шаге: системная подсказка, определения инструментов, контекст репозитория и история разговора. Большая часть их входа — это повторяющийся контент. Для этих рабочих нагрузок ставка кэширования фактически является вашей реальной ценой входа.
Пример: задача одного кодирующего агента
Предположения:
- Фиксированный префикс в 200K токенов (системная подсказка, инструменты, контекст репозитория)
- 50 шагов, каждый из которых добавляет 2K новых входных токенов и производит 3K выходных токенов (включая рассуждения)
- Чтобы упростить, префикс остается того же размера, записывается в кэш на шаге 1 и используется на всех оставшихся 49 шагах
| 6.1 Sol, без кэша | 6 Sol + кэш | 6.1 Sol + кэш | Astra + кэш | |
|---|---|---|---|---|
| Начальная запись в кэш 200K | — | $0.50 | $0.50 | $2.50 |
| 49 чтений из кэша | — | $1.96 | $0.98 | $9.80 |
| Префикс оплачивается как обычный вход | $20.00 | — | — | — |
| 100K новых входных токенов (по ставке записи) | $0.20 | $0.25 | $0.25 | $1.25 |
| 150K выходных токенов | $1.50 | $1.50 | $1.50 | $7.50 |
| Итого | $21.70 | $4.21 | $3.23 | $21.05 |
Три вывода:
- Кэширование — это самый большой рычаг. Одна и та же модель, одна и та же работа, а не кэшированная работа стоит почти в 7 раз дороже.
- 6.1 Sol примерно на 23% дешевле, чем 6 Sol в этом случае, при этом также показывая более высокие результаты.
- Для работы с большим количеством кэша Astra стоит больше, чем предполагает разница в 5× по розничной цене. В этом примере это 6.5×, потому что Astra снижает цену на кэшированный вход на 90%, а 6.1 Sol — на 95%.
Это соответствует отчетным затратам OpenAI на каждую задачу (собранным Vellum и The Next Web): около $1.50 против $7.70 на DeepSWE, $1.30 против $9.30 на OSWorld и $5.47 против $23.80 на Terminal-Bench Science.
Одно предостережение: OpenAI утверждает, что Astra обычно требует меньше выходных токенов для завершения той же задачи. Сравнивайте модели по стоимости за задачу, а не по стоимости за токен.
Записи в кэш не бесплатны
Записи в кэш на 6.1 Sol стоят 1.25× от ставки входа. Если префикс используется только один раз, кэширование делает его на 25% дороже. Используя формулу из документации OpenAI:
- Одна запись плюс одно чтение: 1.35× обычной стоимости входа (1.3× на 6.1 Sol), по сравнению с 2× без кэширования
- Одна запись плюс девять чтений: около 2.15× (около 1.7× на 6.1 Sol), по сравнению с 10×
Минимальный кэшируемый префикс составляет 1,024 токена. Математика безубыточности OpenAI говорит о том, что префикс из 102 токенов или меньше никогда не окупается. Если вы ожидаете 10 или более повторных использований, увеличение любого значения выше 221 токена до 1,024 будет дешевле.
Для одноразовых вызовов, таких как классификация за один ход или массовая экстракция, используйте явный режим (prompt_cache_options.mode: "explicit") без контрольных точек. Вам не будут начислены сборы за записи.
Критическая точка 272K
6.1 Sol принимает 1.05M токенов контекста, но как только вход превышает 272K, весь запрос переходит на более высокую ставку, а не только токены, превышающие лимит.
| Запрос | Вход | Выход | Стоимость |
|---|---|---|---|
| A | 270K | 10K | 0.27 × $2 + 0.01 × $10 = $0.64 |
| B | 280K | 10K | 0.28 × $4 + 0.01 × $15 = $1.27 |
Еще 10,000 входных токенов почти удваивает счет.
Как оставаться ниже этого порога:
- Считайте токены на стороне клиента и компактируйте или обрезайте перед тем, как достичь 272K
- Извлекайте соответствующие части длинных документов, а не отправляйте все целиком
- Когда вам действительно нужен длинный контекст, поместите фиксированную часть в кэшированный префикс
Как усилие рассуждения отображается в счете
Токены рассуждения оплачиваются по ставке выхода, $10 за миллион. Перемещение той же задачи с низкого на максимальный уровень может увеличить количество токенов рассуждения в десять и более раз.
Отчетные затраты OpenAI на каждую задачу дают представление о масштабе (это разные бенчмарки, поэтому сравнивайте только величины):
- AutomationBench (средний): ~$0.30
- GDP.pdf: ~$0.38
- DeepSWE (высокий): ~$1.50
- Terminal-Bench Science (максимум): ~$5.47
Часть 2 охватывает, как выбрать уровень. Одно напоминание здесь: изменение reasoning.effort в середине разговора аннулирует кэш. Используйте configuration_update вместо этого.
Как это сравнивается по этой цене
| Модель | Вход / выход | Кэшированный вход |
|---|---|---|
| GPT-6.1 Sol | $2 / $10 | $0.10 |
| Claude Sonnet 5.5 | $2 / $10 | $0.20 |
| GPT-6 Astra | $10 / $50 | $1.00 |
6.1 Sol и Claude Sonnet 5.5 имеют одинаковую розничную цену, а кэшированная ставка 6.1 Sol вдвое ниже, чем у Sonnet. Однако они сильны в разных областях. Например, на AutomationBench Sonnet 5.5 показывает значительно лучшие результаты. Когда две модели стоят одинаково за токен, та, у которой более низкая стоимость за задачу в вашей рабочей нагрузке, является более дешевой.
Список моделей AIHubMix показывает текущие цены, и один API-ключ работает для всех из них, поэтому тесты бок о бок легко проводить.
Цены конкурентов основаны на данных третьих лиц и могут изменяться. Проверьте официальные страницы цен, прежде чем полагаться на них.
Контрольный список затрат
- Ставьте стабильный контент на первое место. Системная подсказка, определения инструментов и справочные материалы должны быть вверху. Временные метки и данные по пользователям идут в конце.
- Дополняйте, не переписывайте. Суммирование, обрезка и компактация все перезапускают кэш.
- Держите список инструментов стабильным. Не добавляйте и не удаляйте инструменты в каждом запросе. Вместо этого используйте
tool_choiceилиallowed_tools. - Меняйте усилие с помощью
configuration_update, а не параметра запроса. - Оставайтесь ниже 272K входа.
- Отправляйте не срочную работу через Batch или Flex по половинной цене.
- Маршрут по задаче. Luna для простой работы с высоким объемом, 6.1 Sol для большинства задач, Astra для самых сложных проблем.
- Следите за тремя числами:
cached_tokens,cache_write_tokens, иreasoning_tokens.
Итог: розничная цена не изменилась, но чтение из кэша стало на 50% дешевле. Для рабочих нагрузок агентов это делает 6.1 Sol моделью с наилучшей ценностью в семействе GPT-6, при условии, что вы хорошо используете кэширование и остаетесь ниже 272K.
В следующем посте: проблемы, с которыми вы, вероятно, столкнетесь при переходе.
Часто задаваемые вопросы
Сколько стоит GPT-6.1 Sol? $2 за миллион входных токенов, $10 за миллион выходных токенов, $0.10 за кэшированный вход и $2.50 за записи в кэш. Запросы, превышающие 272K входных токенов, оплачиваются по $4 за вход и $15 за выход за весь запрос.
Дешевле ли через AIHubMix или напрямую через OpenAI? Такая же цена. Маршруты OpenAI и Azure в AIHubMix соответствуют официальным тарифам OpenAI.
Почему мой счет выше, чем я оценивал? Четыре распространенные причины: токены рассуждения оплачиваются по ставке выхода; вы превысили 272K входных токенов; вы пропустили кэш или заплатили сборы за записи на одноразовые префиксы; или включен режим быстрого выполнения или региональная обработка.
Стоят ли записи в кэш дополнительно? Записанные токены оплачиваются по ставке 1.25× от ставки входа. Это заменяет обычный сбор за вход, а не добавляется к нему. Префикс окупается после двух использований. Для одноразовых префиксов явный режим позволяет вам полностью избежать записей.
Насколько дешевле 6.1 Sol, чем Astra? В пять раз дешевле по розничной цене. Для работы с большим количеством кэша разница может достигать 6-7×, потому что 6.1 Sol более резко снижает цену на кэшированный вход. Однако Astra часто использует меньше выходных токенов на задачу, поэтому сравнивайте стоимость за задачу.
Можно ли комбинировать Batch с кэшированием? Batch и Flex стоят обе половину цены. Для того, как они сочетаются с кэшированием, смотрите страницу цен OpenAI.
Продолжайте читать: серия GPT-6.1 Sol
- Токены рассуждения — это самые простые затраты, которые можно упустить из виду. Какие задачи подходят для низкого уровня, и когда максимальный уровень оправдывает себя: Выбор усилия рассуждения для GPT-6.1 Sol: от низкого до максимального.
- Новые правила кэширования могут увеличить ваши затраты после миграции. Контрольные точки, выставление счетов за записи, TTL и восемь других подводных камней: Миграция на GPT-6.1 Sol: 9 вещей, которые могут пойти не так.
- Дешевле, но достаточно ли это хорошо? Насколько близок 6.1 Sol к Astra в программировании и использовании компьютера: GPT-6.1 Sol против GPT-6 Sol: обновление за одну неделю, которое почти догоняет Astra.



