AI Radar

Claude Haiku 5.5 стала дешевле и получила настройку глубины рассуждений

Anthropic выпустила Claude Haiku 5.5 для быстрых массовых задач: по оценке компании, средние расходы на неё примерно на 75% ниже, чем на Haiku 4.5. Впервые для Haiku разработчики могут настраивать усилие, затрачиваемое моделью на рассуждение.

8 октября 2026 г.3 мин чтенияИсточник: TestingCatalog · Simon Willison's Weblog +5
моделиинструменты
00

Что изменилось

Haiku 5.5 рассчитана на запросы, которых много и для которых важны задержка и стоимость: краткие пересказы, сжатие контекста, классификацию, обращения к базе данных и поддержку пользователей. Anthropic также предлагает использовать её как субагента рядом с Sonnet 5.5 или Opus 5.5 — например, поручать ей более узкие шаги в работе с кодом. Сложные агентные задачи по программированию компания по-прежнему относит к сфере более крупных моделей.

Главное изменение тарифа действует для запросов объёмом до 100 тысяч токенов: миллион входных токенов стоит $0,10, выходных — $0,50. Чтение из кэша оценивается в $0,01 за миллион токенов, запись — в $0,125. После порога в 100 тысяч тарифы увеличиваются в пять раз, до $0,50 и $2,50 за миллион входных и выходных токенов соответственно. Anthropic оценивает средние расходы на работу с Haiku 5.5 примерно на 75% ниже, чем с Haiku 4.5, с учётом тарифных уровней и нового токенизатора.

У Haiku впервые появилась настройка effort — объёма усилий, который модель тратит на рассуждение. Она позволяет выбирать баланс между расходами и качеством под конкретную задачу. Это не переключатель, полностью отключающий рассуждение: при практической проверке Simon Willison обнаружил, что оно включено по умолчанию на среднем уровне и не отключается. Поэтому при оценке стоимости полезно учитывать не только цену токена, но и то, сколько токенов потребует выбранный режим.

В опубликованных результатах заметен рост относительно Haiku 4.5: на офлайновой части OSWorld 2.1 показатель составил 72,4% против 15,7%, а на Terminal-Bench 4.0 — 39,2% против нуля у предшественницы. Это тесты работы с компьютером и терминальных задач, а не обещание такой же разницы на любом пользовательском запросе. Их стоит сопоставлять со своими сценариями — массовой классификацией, быстрыми ответами или небольшими поручениями внутри агента.

При сравнении бюджетов есть ещё две детали. Цена Haiku 5.5 на коротких запросах совпадает с тарифом GPT-6 Luna, но после порога в 100 тысяч токенов у моделей различается стоимость длинного контекста. Кроме того, Willison проверил один длинный запрос и получил примерно в 1,25 раза больше токенов с новым токенизатором Haiku 5.5, чем с Haiku 4.5. Отдельно от запуска Haiku Anthropic вдвое снижает цену чтения кэша Sonnet 5.5 и вводит ежемесячный API-кредит для подписчиков Max и Team.

Почему это важно

Для частых коротких запросов Haiku стала заметно дешевле, а effort позволяет подбирать расход под сложность задачи. При расчёте бюджета на длинные запросы нужно учитывать пятикратный рост тарифа после 100 тысяч токенов и новый токенизатор.

Мнение редакции

Anthropic развивает семейство Claude как для повседневных запросов, так и для сложной работы с кодом; Haiku в нём отвечает за быстрые и недорогие задачи. Раньше доступная модель этой линейки заметно уступала новым бюджетным предложениям конкурентов, включая GPT-6 Luna от OpenAI. Теперь Anthropic обновляет не только цену и качество Haiku, но и контроль над тем, сколько усилий модель тратит на ответ. Для длинных запросов тариф менее выгоден.

Первоисточники и подтверждения

Подборку проверяет редакция DSML. AI помогает дедуплицировать сигналы и готовить текст, но опубликованный выпуск остаётся редакционным продуктом, а не лентой отдельных каналов.

8 октября 2026 г.
  1. 01Microsoft выпустила Agent Lightning 1.0 для обучения уже работающих AI-агентов
  2. 02Google и Кембридж открыли VeriHarness для проверки результатов AI-агентов
  3. 03В ChatGPT приходят GPT-6 и ответы с интерактивными интерфейсами
  4. 04Microsoft добавила защищённые среды для агентов в Windows и показала ПК на RTX Spark