GPT-6.1 Sol има същата цена на списъка като GPT-6 Sol: $2 за милион входни токени и $10 за милион изходни токени. Вашата реална сметка зависи от четири други фактора: колко често използвате кеша, дали надвишавате 272K входни токени, какъв тарифен план използвате и колко токена за разсъждение изразходва моделът. Тази статия разглежда всеки един от тях.
Пълният ценови списък
Стандартни тарифи (на 1M токени)
| GPT-6.1 Sol | GPT-6 Sol | GPT-6 Astra | GPT-6 Luna | |
|---|---|---|---|---|
| Вход | $2.00 | $2.00 | $10.00 | $0.10 |
| Кеширани входни токени | $0.10 | $0.20 | $1.00 | — |
| Записи в кеша | $2.50 | $2.50 | — | — |
| Изход (включително разсъждения) | $10.00 | $10.00 | $50.00 | $0.50 |
Кешираната ставка на Astra идва от трети страни. Ставката за записи в кеша трябва да бъде $12.50 според правилото на OpenAI от 1.25×. За ценовото определяне на кеша на Luna, вижте ценовата страница на OpenAI.
Множители
Тези правила идват от страницата на модела GPT-6.1 Sol:
| Условие | Какво се случва |
|---|---|
| Повече от 272K входни токени | Цялата заявка се таксува на 2× вход и кеш, 1.5× изход ($4 / $15, кеш четения $0.20, кеш записи $5) |
| Пакет / Гъвкавост | Наполовина от стандартната ставка |
| Бърз режим | Двойна стандартна ставка (не е налична с резидентност на данни в ЕС) |
| Регионална обработка | +10% |
| Извиквания на инструменти (търсене, използване на компютър и др.) | Таксуват се на извикване. AIHubMix посочва уеб търсене на $0.01 на заявка |
| Ултра бързо (идва в Codex) | Още не е официално оценено. Един доклад казва 6× стандарт, не е потвърдено |
На AIHubMix, маршрутите OpenAI и Azure струват същото като директно от OpenAI, а тарифата над 272K вече е посочена.
Истинската промяна: кеш четения на 5% от входа
Цената на списъка не се е променила. Кеш четенията се промениха, от 10% от входната ставка ($0.20) до 5% ($0.10). Документите на OpenAI за кеширане на подканите го казват ясно: кеш четенията са 0.1× вход на повечето модели и "0.05× на GPT-6.1 Sol."
Това е важно, защото агентите изпращат същия материал на всяка стъпка: системна подканва, определения на инструменти, контекст на репозитория и история на разговорите. Повечето от техния вход е повторено съдържание. За тези натоварвания, кешираната ставка ефективно е вашата реална цена на входа.
Пример: задача на кодиращ агент
Предположения:
- Фиксиран префикс от 200K токена (системна подканва, инструменти, контекст на репозитория)
- 50 стъпки, всяка добавяща 2K нови входни токени и произвеждаща 3K изходни токени (включително разсъждения)
- За да е просто, префиксът остава същия размер, записва се в кеша на стъпка 1 и се използва на всички 49 останали стъпки
| 6.1 Sol, без кеш | 6 Sol + кеш | 6.1 Sol + кеш | Astra + кеш | |
|---|---|---|---|---|
| Начален 200K кеш запис | — | $0.50 | $0.50 | $2.50 |
| 49 кеш четения | — | $1.96 | $0.98 | $9.80 |
| Префикс таксуван като редовен вход | $20.00 | — | — | — |
| 100K нов вход (при ставка на запис) | $0.20 | $0.25 | $0.25 | $1.25 |
| 150K изход | $1.50 | $1.50 | $1.50 | $7.50 |
| Общо | $21.70 | $4.21 | $3.23 | $21.05 |
Три основни извода:
- Кеширането е най-голямото предимство. Същият модел, същата работа, а некешираната работа струва почти 7× повече.
- 6.1 Sol е около 23% по-евтин от 6 Sol тук, като същевременно постига по-високи резултати.
- За работа с много кеш, Astra струва повече от 5× разликата в цената на списъка. В този пример е 6.5×, защото Astra намалява кешираните входни токени с 90%, а 6.1 Sol ги намалява с 95%.
Това съвпада с отчетените от OpenAI разходи на задача (събрани от Vellum и The Next Web): около $1.50 срещу $7.70 на DeepSWE, $1.30 срещу $9.30 на OSWorld и $5.47 срещу $23.80 на Terminal-Bench Science.
Едно предупреждение: OpenAI казва, че Astra обикновено изисква по-малко изходни токени, за да завърши същата задача. Сравнявайте моделите по разходи на задача, а не по разходи на токен.
Записите в кеша не са безплатни
Записите в кеша на 6.1 Sol струват 1.25× входната ставка. Ако префиксът се използва само веднъж, кеширането го прави 25% по-скъпо. Използвайки формулата от документите на OpenAI:
- Едно записване плюс едно четене: 1.35× редовната цена на входа (1.3× на 6.1 Sol), срещу 2× без кеширане
- Едно записване плюс девет четения: около 2.15× (около 1.7× на 6.1 Sol), срещу 10×
Минималният кешируем префикс е 1,024 токена. Математиката на OpenAI за точка на равновесие казва, че префикс от 102 токена или по-малко никога не се изплаща. Ако очаквате 10 или повече повторения, добавянето на нещо над 221 токена до 1,024 е по-евтино.
За еднократни извиквания, като класификация с един ход или извличане на обем, използвайте експлицитен режим (prompt_cache_options.mode: "explicit") без точки на прекъсване. Няма да бъдете таксувани за никакви записи.
Прагът от 272K
6.1 Sol приема 1.05M токена контекст, но след като входът надвиши 272K, цялата заявка преминава на по-висока ставка, а не само токените над линията.
| Заявка | Вход | Изход | Цена |
|---|---|---|---|
| A | 270K | 10K | 0.27 × $2 + 0.01 × $10 = $0.64 |
| B | 280K | 10K | 0.28 × $4 + 0.01 × $15 = $1.27 |
Десет хиляди повече входни токени почти удвояват сметката.
Как да останете под него:
- Бройте токените на клиентската страна и компактирайте или отрежете преди да достигнете 272K
- Извличайте съответните части от дълги документи, вместо да изпращате всичко
- Когато наистина се нуждаете от дълъг контекст, поставете фиксираната част в кеширан префикс
Как усилието за разсъждение се отразява на сметката
Токените за разсъждение се таксуват на цената на изхода, $10 на милион. Преместването на същата задача от ниско до максимално може да умножи токените за разсъждение десет или повече пъти.
Отчетените от OpenAI разходи на задача дават представа за мащаба (тези са различни бенчмаркове, така че сравнявайте само величините):
- AutomationBench (средно): ~$0.30
- GDP.pdf: ~$0.38
- DeepSWE (високо): ~$1.50
- Terminal-Bench Science (максимално): ~$5.47
Част 2 обхваща как да изберете ниво. Едно напомняне тук: промяната на reasoning.effort по време на разговора анулира кеша. Използвайте configuration_update вместо това.
Как се сравнява на тази ценова точка
| Модел | Вход / изход | Кеширани входни токени |
|---|---|---|
| GPT-6.1 Sol | $2 / $10 | $0.10 |
| Claude Sonnet 5.5 | $2 / $10 | $0.20 |
| GPT-6 Astra | $10 / $50 | $1.00 |
6.1 Sol и Claude Sonnet 5.5 споделят цена на списъка, а кешираната ставка на 6.1 Sol е половината от тази на Sonnet. Те са силни в различни области, обаче. Например, на AutomationBench, Sonnet 5.5 постига значително по-добри резултати. Когато два модела струват еднакво на токен, този с по-ниска цена на задача за вашето натоварване е по-евтиният.
Списъкът с модели на AIHubMix показва текущите цени, а един API ключ работи за всички тях, така че тестовете един до друг са лесни.
Цените на конкурентите идват от трети страни и могат да се променят. Проверявайте официалните ценови страници преди да разчитате на тях.
Контролен списък за разходите
- Поставете стабилно съдържание на първо място. Системна подканва, определения на инструменти и референтен материал отиват на върха. Времеви печати и данни на потребителя отиват в края.
- Добавяйте, не пренаписвайте. Обобщаването, съкращаването и компактирането рестартира кеша.
- Дръжте списъка с инструменти стабилен. Не добавяйте или премахвайте инструменти на заявка. Използвайте
tool_choiceилиallowed_toolsвместо това. - Сменяйте усилието с
configuration_update, а не параметъра на заявката. - Останете под 272K вход.
- Изпращайте не спешна работа чрез Batch или Flex за половин цена.
- Маршрутизирайте по задача. Luna за проста работа с висока производителност, 6.1 Sol за повечето неща, Astra за най-трудните проблеми.
- Следете три числа:
cached_tokens,cache_write_tokens, иreasoning_tokens.
Основното заключение: цената на списъка не се е променила, но кеш четенията станаха 50% по-евтини. За натоварвания на агенти, това прави 6.1 Sol най-добрият модел по цена в семейството на GPT-6, стига да използвате кеширането добре и да останете под 272K.
Следва: проблемите, с които вероятно ще се сблъскате при превключване.
Често задавани въпроси
Колко струва GPT-6.1 Sol? $2 за милион входни токени, $10 за милион изходни токени, $0.10 за кеширани входни токени и $2.50 за записи в кеша. Заявките над 272K входни токени се таксуват на $4 вход и $15 изход за цялата заявка.
По-евтино ли е през AIHubMix или директно от OpenAI? Същата цена. Маршрутите на AIHubMix OpenAI и Azure съвпадат с официалните тарифи на OpenAI.
Защо сметката ми е по-висока от очакваното? Четири често срещани причини: токените за разсъждение се таксуват на цената на изхода; надвишили сте 272K вход; пропуснали сте кеша или платили сте такси за записи на еднократни префикси; или е включен бърз режим или регионална обработка.
Струват ли записите в кеша допълнително? Записаните токени се таксуват на 1.25× входната ставка. Това замества нормалната такса за вход, а не добавя към нея. Префиксът се изплаща след две употреби. За еднократни префикси, експлицитният режим ви позволява да пропуснете записите напълно.
Колко по-евтин е 6.1 Sol от Astra? Пет пъти по-евтин на цената на списъка. За работа с много кеш, разликата може да достигне 6 до 7×, защото 6.1 Sol намалява кешираните входни токени по-строго. Astra често използва по-малко изходни токени на задача, така че сравнявайте разходите на задача.
Може ли Batch да се комбинира с кеширане? Batch и Flex са и двете на половин цена. За това как се комбинират с кеширането, проверете ценовата страница на OpenAI.
Продължете да четете: серията GPT-6.1 Sol
- Токените за разсъждение са най-лесната цена, която да загубите от поглед. Кои задачи са подходящи за ниско ниво и кога максималното е изгодно: Избор на усилие за разсъждение за GPT-6.1 Sol: от ниско до максимално.
- Новите правила за кеширане могат да повишат сметката ви след миграция. Точки на прекъсване, таксуване на записи, TTL и осем други капани: Мигриране към GPT-6.1 Sol: 9 неща, които могат да се объркат.
- По-евтино, но достатъчно ли е добро? Колко близо 6.1 Sol достига до Astra при кодиране и използване на компютър: GPT-6.1 Sol срещу GPT-6 Sol: едноседмично обновление, което почти достига Astra.



