AI Radar
Claude Haiku 5.5 стала дешевле и получила настройку глубины рассуждений
Anthropic выпустила Claude Haiku 5.5 для быстрых массовых задач: по оценке компании, средние расходы на неё примерно на 75% ниже, чем на Haiku 4.5. Впервые для Haiku разработчики могут настраивать усилие, затрачиваемое моделью на рассуждение.
Что изменилось
Haiku 5.5 рассчитана на запросы, которых много и для которых важны задержка и стоимость: краткие пересказы, сжатие контекста, классификацию, обращения к базе данных и поддержку пользователей. Anthropic также предлагает использовать её как субагента рядом с Sonnet 5.5 или Opus 5.5 — например, поручать ей более узкие шаги в работе с кодом. Сложные агентные задачи по программированию компания по-прежнему относит к сфере более крупных моделей.
Главное изменение тарифа действует для запросов объёмом до 100 тысяч токенов: миллион входных токенов стоит $0,10, выходных — $0,50. Чтение из кэша оценивается в $0,01 за миллион токенов, запись — в $0,125. После порога в 100 тысяч тарифы увеличиваются в пять раз, до $0,50 и $2,50 за миллион входных и выходных токенов соответственно. Anthropic оценивает средние расходы на работу с Haiku 5.5 примерно на 75% ниже, чем с Haiku 4.5, с учётом тарифных уровней и нового токенизатора.
У Haiku впервые появилась настройка effort — объёма усилий, который модель тратит на рассуждение. Она позволяет выбирать баланс между расходами и качеством под конкретную задачу. Это не переключатель, полностью отключающий рассуждение: при практической проверке Simon Willison обнаружил, что оно включено по умолчанию на среднем уровне и не отключается. Поэтому при оценке стоимости полезно учитывать не только цену токена, но и то, сколько токенов потребует выбранный режим.
В опубликованных результатах заметен рост относительно Haiku 4.5: на офлайновой части OSWorld 2.1 показатель составил 72,4% против 15,7%, а на Terminal-Bench 4.0 — 39,2% против нуля у предшественницы. Это тесты работы с компьютером и терминальных задач, а не обещание такой же разницы на любом пользовательском запросе. Их стоит сопоставлять со своими сценариями — массовой классификацией, быстрыми ответами или небольшими поручениями внутри агента.
При сравнении бюджетов есть ещё две детали. Цена Haiku 5.5 на коротких запросах совпадает с тарифом GPT-6 Luna, но после порога в 100 тысяч токенов у моделей различается стоимость длинного контекста. Кроме того, Willison проверил один длинный запрос и получил примерно в 1,25 раза больше токенов с новым токенизатором Haiku 5.5, чем с Haiku 4.5. Отдельно от запуска Haiku Anthropic вдвое снижает цену чтения кэша Sonnet 5.5 и вводит ежемесячный API-кредит для подписчиков Max и Team.
Почему это важно
Для частых коротких запросов Haiku стала заметно дешевле, а effort позволяет подбирать расход под сложность задачи. При расчёте бюджета на длинные запросы нужно учитывать пятикратный рост тарифа после 100 тысяч токенов и новый токенизатор.
Мнение редакции
Anthropic развивает семейство Claude как для повседневных запросов, так и для сложной работы с кодом; Haiku в нём отвечает за быстрые и недорогие задачи. Раньше доступная модель этой линейки заметно уступала новым бюджетным предложениям конкурентов, включая GPT-6 Luna от OpenAI. Теперь Anthropic обновляет не только цену и качество Haiku, но и контроль над тем, сколько усилий модель тратит на ответ. Для длинных запросов тариф менее выгоден.
Первоисточники и подтверждения
Подборку проверяет редакция DSML. AI помогает дедуплицировать сигналы и готовить текст, но опубликованный выпуск остаётся редакционным продуктом, а не лентой отдельных каналов.