AI Radar

OpenAI добавила GPT-6.1 Sol платный режим Ultrafast

OpenAI выпустила режим Ultrafast для GPT-6.1 Sol с заявленным ускорением генерации до восьми раз. Его API-тариф за токен в шесть раз выше стандартного; одновременно в Codex улучшили корректировку задачи во время работы агента.

9 октября 2026 г.3 мин чтенияИсточник: Zhidx (智东西)
моделиинструменты
00

Что изменилось

У GPT-6.1 Sol теперь три ценовых режима. Согласно опубликованным в материале тарифам, стандартный API стоит $2 за миллион входных и $10 за миллион выходных токенов; Fast удваивает скорость и цену, а Ultrafast стоит $12 и $60 соответственно. Поэтому за максимальное ускорение относительно стандартного режима нужно платить в шесть раз больше за токен. OpenAI заявляет ускорение генерации до восьми раз, но формулировка «до» важна: это верхняя граница, а не гарантированный результат для каждого запроса.

Предложение адресовано прежде всего сценариям, где ожидание мешает следующему шагу: отладке, работе агента в приложениях и интерактивным задачам. Для длинного задания со множеством вызовов инструментов скорость выдачи токенов – только одна часть задержки. Время также уходит на рассуждение модели, выполнение внешних инструментов и обмен данными по сети. Поэтому восьмикратная генерация не означает, что агент завершит задачу в восемь раз быстрее. В материале упоминается рекомендация OpenAI использовать постоянные соединения WebSocket там, где частые сетевые обращения добавляют задержку.

Повод для споров – исходная скорость Sol. В статье приводится измерение Artificial Analysis: 54,9 токена в секунду при максимальной интенсивности рассуждений, а также отдельные сообщения пользователей о ещё более медленной работе. Это разные условия наблюдения, и по ним нельзя оценивать скорость каждого приложения. Но для разработчика ощущение задержки складывается именно из повторяющихся ожиданий: агент пишет код, запускает инструмент, получает ответ и снова обращается к модели. Платное ускорение выглядит полезнее, если заметно сокращает весь этот цикл, а не только один его этап.

Вместе с новым режимом OpenAI улучшила возможность направлять Codex во время исполнения задачи. Пользователь может вмешаться и скорректировать курс, пока агент ещё работает, вместо того чтобы дожидаться завершения неудачной попытки. Ускорение ответа и своевременная корректировка решают разные проблемы: первое сокращает ожидание генерации, второе может уменьшить число бесполезных шагов. Итог для команды будет зависеть от типа задач, частоты вмешательств и того, насколько часто агент вообще достигает нужного результата.

Для API-пользователей Ultrafast доступен напрямую. В Codex и ChatGPT Work, согласно приведённой информации, режим ограничен планом Pro 500, подходящими корпоративными планами с оплатой по использованию и образовательным планом на кредитах. Универсальной замены стандартному режиму здесь нет: при пакетной обработке документов или несрочном кодировании доплата может не окупиться. Сравнивать режимы разумнее на собственном наборе задач, учитывая стоимость полного выполнения, итоговую задержку и долю успешно завершённых работ.

Почему это важно

Для агентных приложений новый тариф стоит проверять по времени и цене законченной задачи: быстрый вывод токенов не обязательно ускоряет вызовы инструментов. Также важно учесть, доступен ли режим в используемом продукте или только через API.

Мнение редакции

OpenAI развивает Sol как более доступную альтернативу своей флагманской модели для программирования и агентных задач. Теперь компания продаёт скорость ответа как отдельный уровень сервиса, а не только улучшает качество модели. Такой подход проверяется простой мерой: сокращается ли время выполнения всей работы, а не лишь генерации текста.

Первоисточники и подтверждения

Подборку проверяет редакция DSML. AI помогает дедуплицировать сигналы и готовить текст, но опубликованный выпуск остаётся редакционным продуктом, а не лентой отдельных каналов.