DSML Kazakhstan LogoDSMLKZ
HomeAboutPeopleNewsAI RadarJobsResearchEventsArticles
DSML Kazakhstan Logo© 2026 DSML Kazakhstan.
AboutCollaborateCommunity GuidelinesPrivacyTelegramAI Radar RSSYouTubeLinkedInInstagram
    AI RadarJuly 31, 2026

    AI Radar

    OpenAI снизила цену GPT-5.6 Luna на 80% и ускорила флагманский Sol

    OpenAI резко удешевила API младшей GPT-5.6 Luna, на 20% снизила тарифы Terra и добавила платный Fast-режим для Sol. Компания одновременно нацелилась на массовые недорогие нагрузки и приложения, где задержка важнее цены.

    July 31, 2026·3 min read·Источник: VentureBeat · 智东西 +3
    05

    Что изменилось

    После снижения Luna стоит $0,20 за миллион входных и $1,20 за миллион выходных токенов — на 80% меньше прежнего тарифа. Для средней Terra цены составляют $2 и $12 соответственно после сокращения на 20%. Стандартный Sol не подешевел и по-прежнему обходится в $5 за вход и $30 за выход. Таким образом, только по входному тарифу Luna теперь в 25 раз дешевле флагмана и лучше подходит для классификации, массовой обработки документов, поддержки пользователей и сравнительно простых агентов.

    Для Sol компания выбрала другой способ улучшить предложение. Новый Fast-режим обещает до 2,5 раза большую пропускную способность без изменения базовых интеллектуальных возможностей модели, но стоит вдвое дороже: $10 за миллион входных и $60 за миллион выходных токенов. При максимальном заявленном ускорении это означает примерно на 25% меньшую стоимость единицы пропускной способности, хотя конкретный выигрыш будет зависеть от характера запросов и загрузки сервиса. Режим предназначен прежде всего для интерактивных агентов и приложений реального времени, где ожидание ответа непосредственно влияет на продукт.

    По оценке Artificial Analysis, новая цена сразу переместила Luna в одну из наиболее привлекательных зон по соотношению интеллекта и стоимости. OpenAI приводит ориентир более 50 баллов Intelligence Index и около $0,05 за выполненную задачу. Простой суммарный тариф на миллион входных и выходных токенов у Luna равен $1,40 — немного ниже $1,50 у MiniMax M3 и $1,75 у Gemini Flash-Lite из приведённого сравнения, но всё ещё выше сверхдешёвых DeepSeek V4 Flash и Xiaomi MiMo-V2.5 Flash. Такое сложение условно: реальные расходы определяются долей выходных токенов, длиной рассуждений, кешированием и числом повторных вызовов.

    Снижение цен произошло на фоне усиления конкуренции со стороны недорогих китайских и западных моделей. В те же недели Google продвигала экономичные Gemini Flash, Anthropic выпустила Claude Opus 5 без повышения цены относительно предшественника, а Moonshot открыла API модели Kimi K3. Генеральный директор OpenAI Сэм Альтман сформулировал цель как лучшее соотношение цены и интеллекта на каждом уровне линейки. Для разработчиков изменение распространяется не только на прямые API-вызовы: из-за новых тарифов Luna и Terra должен уменьшиться расход квот в ChatGPT Work и Codex.

    OpenAI связывает экономию с внутренней оптимизацией инфраструктуры при участии самого GPT-5.6 Sol. Под руководством инженеров модель переписывала производственные GPU-ядра, искала операции, которые можно заранее вычислить, исключить или распараллелить, и помогала улучшать балансировку нагрузки. Компания сообщает о снижении общей стоимости обслуживания на 20%, а изменения в спекулятивном декодировании повысили эффективность генерации токенов более чем на 15%. Эти цифры объясняют инженерную основу манёвра, хотя не устанавливают прямого соответствия между каждой оптимизацией и 80-процентным снижением цены Luna.

    Почему это важно

    Luna становится заметно практичнее для сервисов с большим объёмом запросов, где даже небольшая разница в цене токена превращается в существенные ежемесячные расходы. Sol Fast даёт отдельный выбор для систем с жёсткими требованиями к задержке, но его выгоду следует считать по фактической пропускной способности и структуре ответов, а не только по обещанному ускорению.

    Primary and supporting sources

    • AI price wars: OpenAI cuts GPT-5.6 Luna prices by 80% as model competition shifts toward costOpens in a new tab
    • OpenAI突然宣布:GPT-5.6大幅降价,2折起售Opens in a new tab
    • Advancing the price-performance frontier with GPT‑5.6Opens in a new tab
    • OpenAI blinks in face-off with Chinese rivals, drops pricing for some models up to 80%Opens in a new tab

    DSML editors review the selection. AI helps deduplicate signals and draft the text; the published edition remains an editorial product, not a feed of individual channels.

    More from this edition

    July 31, 2026
    1. 01DeepSeek усилила V4-Flash постобучением и подготовила модель к работе с Codex
    2. 02MiniMax H3 объединила текст, изображения, видео и звук в одном генераторе роликов
    3. 03Агент Tencent Hyra помог найти конструкцию для 50-летней задачи аддитивной комбинаторики
    4. 04Thinking Machines открыла веса мультимодальной Inkling-Small с 12 млрд активных параметров
    Back to AI Radar