AI Radar
SpaceXAI выпустила новую флагманскую модель Grok 4.6, рассчитанную на многошаговую работу с кодом, инструментами и сложными исследовательскими задачами. Модель уже появилась в API и популярных средах разработки, а базовые тарифы сохранились на уровне Grok 4.5.
Главное изменение относительно Grok 4.5 — ориентация не просто на генерацию отдельных ответов, а на продолжительные траектории, в которых агент исследует незнакомую область, перемещается между частями кодовой базы, собирает приложение и дорабатывает его по обратной связи. SpaceXAI также уделила внимание интерактивным и визуальным проектам: Grok 4.6 должна быстрее превращать общую продуктовую идею в работоспособный прототип со структурой, интерфейсом и основными сценариями. На длинных задачах модель чаще самостоятельно проверяет промежуточный результат перед следующим шагом.
Для этого компания продлила обучение базовой модели и использовала отфильтрованные синтетические данные для рассуждений и сложных технических дисциплин, а также инженерные наборы данных и обновлённую схему оптимизации. Траектории для SFT заново сгенерировали с помощью Grok 4.5 и отфильтровали модельными проверками. Затем Grok 4.6 обучали с подкреплением в агентных средах — от общего программирования и интеллектуальной работы до веб-разработки, проектирования в CAD и оптимизации вычислительных ядер.
На независимом Artificial Analysis Intelligence Index модель получила 61 балл — на пять пунктов больше Grok 4.5 High. Этот результат ставит её вровень с GPT-5.6 Sol Max, выше Kimi K3 и на третью позицию рейтинга после Claude Opus 5 и Fable 5. В профильных тестах опубликованы 69,9% на CursorBench и 61,3% на FrontierCode; в Code Arena WebDev версия Grok 4.6 High набрала 1618 баллов и заняла седьмое место рядом с GPT-5.6 Sol, GLM-5.2 и Claude Fable 5. Бенчмарки показывают заметный прогресс, хотя их результаты не гарантируют такого же преимущества на конкретной корпоративной кодовой базе.
Базовая цена API не изменилась: при запросах короче 200 тысяч токенов миллион входных токенов стоит $2, а выходных — $6. Для промптов от 200 тысяч токенов тариф удваивается до $4 и $12 соответственно; ускоренный вариант также стоит вдвое дороже обычного. Поэтому заявленная цена $2/$6 особенно привлекательна для длительных агентных запусков, но реальную стоимость нужно считать с учётом размера контекста, количества повторных вызовов, работы инструментов и объёма генерируемого кода.
Grok 4.6 уже доступна через собственный API, Grok Build и партнёрские площадки, включая Cursor, OpenRouter, Vercel и Cloudflare; также сообщается о доступе через Grok Bot и API DS Lab. На первую неделю после запуска пользователям Cursor и Grok Build предоставили удвоенные лимиты. Одновременно SpaceXAI сообщила о перенастройке защитных механизмов под выросшие возможности модели, в том числе для легитимных сценариев поиска и исправления уязвимостей, однако отдельной независимой оценки этих ограничений пока не приводится.
Grok 4.6 можно предметно тестировать как основу для агентов, которым приходится часами работать с репозиториями, терминалом и внешними инструментами, не переплачивая за каждый короткий вызов. При расчёте бюджета важно учитывать удвоение тарифа на очень длинном контексте и проверять качество на собственных задачах: близкие суммарные баллы не означают одинаковой надёжности в разработке, исследовании и автоматизации.
DSML editors review the selection. AI helps deduplicate signals and draft the text; the published edition remains an editorial product, not a feed of individual channels.