AI Radar
OpenAI резко удешевила API младшей GPT-5.6 Luna, на 20% снизила тарифы Terra и добавила платный Fast-режим для Sol. Компания одновременно нацелилась на массовые недорогие нагрузки и приложения, где задержка важнее цены.
После снижения Luna стоит $0,20 за миллион входных и $1,20 за миллион выходных токенов — на 80% меньше прежнего тарифа. Для средней Terra цены составляют $2 и $12 соответственно после сокращения на 20%. Стандартный Sol не подешевел и по-прежнему обходится в $5 за вход и $30 за выход. Таким образом, только по входному тарифу Luna теперь в 25 раз дешевле флагмана и лучше подходит для классификации, массовой обработки документов, поддержки пользователей и сравнительно простых агентов.
Для Sol компания выбрала другой способ улучшить предложение. Новый Fast-режим обещает до 2,5 раза большую пропускную способность без изменения базовых интеллектуальных возможностей модели, но стоит вдвое дороже: $10 за миллион входных и $60 за миллион выходных токенов. При максимальном заявленном ускорении это означает примерно на 25% меньшую стоимость единицы пропускной способности, хотя конкретный выигрыш будет зависеть от характера запросов и загрузки сервиса. Режим предназначен прежде всего для интерактивных агентов и приложений реального времени, где ожидание ответа непосредственно влияет на продукт.
По оценке Artificial Analysis, новая цена сразу переместила Luna в одну из наиболее привлекательных зон по соотношению интеллекта и стоимости. OpenAI приводит ориентир более 50 баллов Intelligence Index и около $0,05 за выполненную задачу. Простой суммарный тариф на миллион входных и выходных токенов у Luna равен $1,40 — немного ниже $1,50 у MiniMax M3 и $1,75 у Gemini Flash-Lite из приведённого сравнения, но всё ещё выше сверхдешёвых DeepSeek V4 Flash и Xiaomi MiMo-V2.5 Flash. Такое сложение условно: реальные расходы определяются долей выходных токенов, длиной рассуждений, кешированием и числом повторных вызовов.
Снижение цен произошло на фоне усиления конкуренции со стороны недорогих китайских и западных моделей. В те же недели Google продвигала экономичные Gemini Flash, Anthropic выпустила Claude Opus 5 без повышения цены относительно предшественника, а Moonshot открыла API модели Kimi K3. Генеральный директор OpenAI Сэм Альтман сформулировал цель как лучшее соотношение цены и интеллекта на каждом уровне линейки. Для разработчиков изменение распространяется не только на прямые API-вызовы: из-за новых тарифов Luna и Terra должен уменьшиться расход квот в ChatGPT Work и Codex.
OpenAI связывает экономию с внутренней оптимизацией инфраструктуры при участии самого GPT-5.6 Sol. Под руководством инженеров модель переписывала производственные GPU-ядра, искала операции, которые можно заранее вычислить, исключить или распараллелить, и помогала улучшать балансировку нагрузки. Компания сообщает о снижении общей стоимости обслуживания на 20%, а изменения в спекулятивном декодировании повысили эффективность генерации токенов более чем на 15%. Эти цифры объясняют инженерную основу манёвра, хотя не устанавливают прямого соответствия между каждой оптимизацией и 80-процентным снижением цены Luna.
Luna становится заметно практичнее для сервисов с большим объёмом запросов, где даже небольшая разница в цене токена превращается в существенные ежемесячные расходы. Sol Fast даёт отдельный выбор для систем с жёсткими требованиями к задержке, но его выгоду следует считать по фактической пропускной способности и структуре ответов, а не только по обещанному ускорению.
DSML editors review the selection. AI helps deduplicate signals and draft the text; the published edition remains an editorial product, not a feed of individual channels.