AI Radar
OpenAI добавила GPT-6.1 Sol платный режим Ultrafast
OpenAI выпустила режим Ultrafast для GPT-6.1 Sol с заявленным ускорением генерации до восьми раз. Его API-тариф за токен в шесть раз выше стандартного; одновременно в Codex улучшили корректировку задачи во время работы агента.
Что изменилось
У GPT-6.1 Sol теперь три ценовых режима. Согласно опубликованным в материале тарифам, стандартный API стоит $2 за миллион входных и $10 за миллион выходных токенов; Fast удваивает скорость и цену, а Ultrafast стоит $12 и $60 соответственно. Поэтому за максимальное ускорение относительно стандартного режима нужно платить в шесть раз больше за токен. OpenAI заявляет ускорение генерации до восьми раз, но формулировка «до» важна: это верхняя граница, а не гарантированный результат для каждого запроса.
Предложение адресовано прежде всего сценариям, где ожидание мешает следующему шагу: отладке, работе агента в приложениях и интерактивным задачам. Для длинного задания со множеством вызовов инструментов скорость выдачи токенов – только одна часть задержки. Время также уходит на рассуждение модели, выполнение внешних инструментов и обмен данными по сети. Поэтому восьмикратная генерация не означает, что агент завершит задачу в восемь раз быстрее. В материале упоминается рекомендация OpenAI использовать постоянные соединения WebSocket там, где частые сетевые обращения добавляют задержку.
Повод для споров – исходная скорость Sol. В статье приводится измерение Artificial Analysis: 54,9 токена в секунду при максимальной интенсивности рассуждений, а также отдельные сообщения пользователей о ещё более медленной работе. Это разные условия наблюдения, и по ним нельзя оценивать скорость каждого приложения. Но для разработчика ощущение задержки складывается именно из повторяющихся ожиданий: агент пишет код, запускает инструмент, получает ответ и снова обращается к модели. Платное ускорение выглядит полезнее, если заметно сокращает весь этот цикл, а не только один его этап.
Вместе с новым режимом OpenAI улучшила возможность направлять Codex во время исполнения задачи. Пользователь может вмешаться и скорректировать курс, пока агент ещё работает, вместо того чтобы дожидаться завершения неудачной попытки. Ускорение ответа и своевременная корректировка решают разные проблемы: первое сокращает ожидание генерации, второе может уменьшить число бесполезных шагов. Итог для команды будет зависеть от типа задач, частоты вмешательств и того, насколько часто агент вообще достигает нужного результата.
Для API-пользователей Ultrafast доступен напрямую. В Codex и ChatGPT Work, согласно приведённой информации, режим ограничен планом Pro 500, подходящими корпоративными планами с оплатой по использованию и образовательным планом на кредитах. Универсальной замены стандартному режиму здесь нет: при пакетной обработке документов или несрочном кодировании доплата может не окупиться. Сравнивать режимы разумнее на собственном наборе задач, учитывая стоимость полного выполнения, итоговую задержку и долю успешно завершённых работ.
Почему это важно
Для агентных приложений новый тариф стоит проверять по времени и цене законченной задачи: быстрый вывод токенов не обязательно ускоряет вызовы инструментов. Также важно учесть, доступен ли режим в используемом продукте или только через API.
Мнение редакции
OpenAI развивает Sol как более доступную альтернативу своей флагманской модели для программирования и агентных задач. Теперь компания продаёт скорость ответа как отдельный уровень сервиса, а не только улучшает качество модели. Такой подход проверяется простой мерой: сокращается ли время выполнения всей работы, а не лишь генерации текста.
Первоисточники и подтверждения
Подборку проверяет редакция DSML. AI помогает дедуплицировать сигналы и готовить текст, но опубликованный выпуск остаётся редакционным продуктом, а не лентой отдельных каналов.