DSML Kazakhstan LogoDSMLKZ
HomeAboutPeopleNewsAI RadarJobsResearchEventsArticles
DSML Kazakhstan Logo© 2026 DSML Kazakhstan.
AboutCollaborateCommunity GuidelinesPrivacyTelegramAI Radar RSSYouTubeLinkedInInstagram
    AI RadarAugust 12, 2026

    AI Radar

    Grok 4.6 усилили для программирования и долгих агентных задач без повышения базовой цены

    SpaceXAI выпустила новую флагманскую модель Grok 4.6, рассчитанную на многошаговую работу с кодом, инструментами и сложными исследовательскими задачами. Модель уже появилась в API и популярных средах разработки, а базовые тарифы сохранились на уровне Grok 4.5.

    August 12, 2026·3 min read·Источник: Data Secrets · AI Newz +3
    03

    Что изменилось

    Главное изменение относительно Grok 4.5 — ориентация не просто на генерацию отдельных ответов, а на продолжительные траектории, в которых агент исследует незнакомую область, перемещается между частями кодовой базы, собирает приложение и дорабатывает его по обратной связи. SpaceXAI также уделила внимание интерактивным и визуальным проектам: Grok 4.6 должна быстрее превращать общую продуктовую идею в работоспособный прототип со структурой, интерфейсом и основными сценариями. На длинных задачах модель чаще самостоятельно проверяет промежуточный результат перед следующим шагом.

    Для этого компания продлила обучение базовой модели и использовала отфильтрованные синтетические данные для рассуждений и сложных технических дисциплин, а также инженерные наборы данных и обновлённую схему оптимизации. Траектории для SFT заново сгенерировали с помощью Grok 4.5 и отфильтровали модельными проверками. Затем Grok 4.6 обучали с подкреплением в агентных средах — от общего программирования и интеллектуальной работы до веб-разработки, проектирования в CAD и оптимизации вычислительных ядер.

    На независимом Artificial Analysis Intelligence Index модель получила 61 балл — на пять пунктов больше Grok 4.5 High. Этот результат ставит её вровень с GPT-5.6 Sol Max, выше Kimi K3 и на третью позицию рейтинга после Claude Opus 5 и Fable 5. В профильных тестах опубликованы 69,9% на CursorBench и 61,3% на FrontierCode; в Code Arena WebDev версия Grok 4.6 High набрала 1618 баллов и заняла седьмое место рядом с GPT-5.6 Sol, GLM-5.2 и Claude Fable 5. Бенчмарки показывают заметный прогресс, хотя их результаты не гарантируют такого же преимущества на конкретной корпоративной кодовой базе.

    Базовая цена API не изменилась: при запросах короче 200 тысяч токенов миллион входных токенов стоит $2, а выходных — $6. Для промптов от 200 тысяч токенов тариф удваивается до $4 и $12 соответственно; ускоренный вариант также стоит вдвое дороже обычного. Поэтому заявленная цена $2/$6 особенно привлекательна для длительных агентных запусков, но реальную стоимость нужно считать с учётом размера контекста, количества повторных вызовов, работы инструментов и объёма генерируемого кода.

    Grok 4.6 уже доступна через собственный API, Grok Build и партнёрские площадки, включая Cursor, OpenRouter, Vercel и Cloudflare; также сообщается о доступе через Grok Bot и API DS Lab. На первую неделю после запуска пользователям Cursor и Grok Build предоставили удвоенные лимиты. Одновременно SpaceXAI сообщила о перенастройке защитных механизмов под выросшие возможности модели, в том числе для легитимных сценариев поиска и исправления уязвимостей, однако отдельной независимой оценки этих ограничений пока не приводится.

    Почему это важно

    Grok 4.6 можно предметно тестировать как основу для агентов, которым приходится часами работать с репозиториями, терминалом и внешними инструментами, не переплачивая за каждый короткий вызов. При расчёте бюджета важно учитывать удвоение тарифа на очень длинном контексте и проверять качество на собственных задачах: близкие суммарные баллы не означают одинаковой надёжности в разработке, исследовании и автоматизации.

    Primary and supporting sources

    • SpaceXAI debuts Grok 4.6, overtaking Kimi K3's performance and matching GPT-5.6 Sol for world's third best on Artificial AnalysisOpens in a new tab
    • 昨夜,马斯克甩出Grok 4.6!性能直逼Fable 5,英伟达祝贺Opens in a new tab

    DSML editors review the selection. AI helps deduplicate signals and draft the text; the published edition remains an editorial product, not a feed of individual channels.

    More from this edition

    August 12, 2026
    1. 01DeepSeek выпустила финальную V4 Pro API с усиленной поддержкой агентов
    2. 02NVIDIA создала OmniDreams для интерактивной симуляции автономного вождения
    3. 03Qwen открыла веса модели Qwen3.8-2.4T-A95B с контекстом до миллиона токенов
    4. 04Gemini преодолел миллиард ежемесячных пользователей и приблизился к ChatGPT
    Back to AI Radar