AI RADAR

Tue, August 25

edition closed14 of 14
  1. OpenAI показала архитектуру и первые тесты inference-чипа Jalapeño

    OpenAI показала устройство и первые результаты Jalapeño — собственного ASIC для инференса, разработанного вместе с Broadcom. В тестах компании система одновременно обошла решения Nvidia Blackwell по энергоэффективности и задержке, но массовое внедрение начнётся не раньше 2027 года.

    The Verge · TechCrunch +3

  2. Apple выпустила M6, M5 Ultra и новые Mac с прицелом на локальный ИИ

    Apple представила 2-нм чип M6 и четырёхкристальный M5 Ultra, а вместе с ними обновила Mac mini и Mac Studio. Компания делает ставку на локальный инференс: от запуска моделей в LM Studio и Ollama до объединения нескольких компьютеров в кластер по Thunderbolt 5.

    Tom's Hardware · Zhidx (智东西)

  3. Perplexity и Nvidia перенесли агента Computer на локальные GPU

    Perplexity вместе с Nvidia выпустила Portable Computer — локальную версию своей агентной платформы Computer для DGX Spark и Linux-машин с RTX. Модели, файлы и исполнение задач по умолчанию остаются на устройстве, а обращение к более мощной облачной модели требует разрешения пользователя.

    VentureBeat

  4. Китайские open-weight-модели захватили большинство токенов Vercel AI Gateway

    Open-weight-модели впервые заняли большую часть трафика Vercel AI Gateway: во вторник на них пришлось 54% токенов, а рекорд выходных достиг 62%. Рост обеспечили прежде всего недорогие китайские модели во главе с DeepSeek-V4-Flash.

    South China Morning Post

  5. Darkbloom начала платить владельцам Mac за распределённый AI-инференс

    Распределённая сеть Darkbloom стала платным inference-провайдером OpenRouter и предложила владельцам Mac сдавать простаивающие мощности Apple Silicon. Eigen Labs оценивает средний доход одной подключённой машины в $120–200 в месяц, но фактическая сумма зависит от спроса и поддерживаемых моделей.

    The Register

  6. Пекин собрал AI for Science в единую инфраструктурную программу

    Пекин переводит AI for Science из набора отдельных исследований в общую инфраструктурную программу: с научными данными, специализированными моделями, автономными лабораториями, стандартами и площадками для внедрения. К 2028 году город рассчитывает создать научно-интеллектуальный центр глобального масштаба.

    Zhidx (智东西)

  7. Местные протесты остановили два проекта AI-дата-центров в Юго-Восточной Азии

    Два проекта AI-дата-центров в Малайзии и на Филиппинах отозвали после сопротивления местных жителей. Споры показывают, что национальных стимулов для вычислительной инфраструктуры недостаточно без понятных правил выбора площадок, оценки нагрузки и взаимодействия с муниципалитетами.

    South China Morning Post

  8. Apple объединила языковую модель и нормализующие потоки в STARFlow2

    Apple представила STARFlow2 — архитектуру для единой генерации последовательностей, в которых чередуются текст и изображения. Ее ключевая идея состоит в том, чтобы сблизить языковую модель и авторегрессионный нормализующий поток на уровне общей Transformer-структуры.

    Apple Machine Learning Research

  9. Codex получил дополнительные барьеры против ошибочного удаления файлов

    OpenAI добавила в Codex несколько уровней защиты от ошибочного удаления и перезаписи файлов — от новых инструкций модели до проверок команд и более строгого режима полного доступа. Изменения последовали за разбором редких сбоев при работе агента с временными каталогами.

    TG · AI/ML/Big Data

  10. DeepLearning.AI перестраивает обучение вокруг профессии AI-инженера

    DeepLearning.AI переориентирует образовательную программу вокруг AI engineering — практики создания, оценки и эксплуатации приложений на базе современных моделей. Новый фокус сформирован после анализа более 10 тысяч вакансий, интервью с экспертами и работодателями, опросов и открытых данных.

    Latent Space

  11. Keenable создаёт поисковый индекс из 100 млрд документов для AI-агентов

    Стартап Keenable вышел из скрытого режима с посевным раундом на $26 млн и поисковым индексом, который, по его данным, охватывает более 100 млрд веб-документов. Сервис создаётся не для традиционной выдачи людям, а как инфраструктура поиска и извлечения источников для AI-агентов.

    TechCrunch

  12. Сбер выпустил три открытые модели GigaEmbeddings под лицензией MIT

    Сбер выпустил новое поколение текстовых эмбеддингов: в линейку вошли модели на 480 млн, 3 млрд и 10 млрд параметров. Веса доступны разработчикам и компаниям на Hugging Face и GitVerse под разрешительной лицензией MIT.

    TG · Data Secrets

  13. Мощные AI-стойки повышают требования к защите электрических цепей

    Рост энергопотребления AI-серверов заставляет дата-центры переходить к более высоким напряжениям и плотности мощности. Вместе с архитектурой питания меняются требования к защите цепей и надёжности оборудования на всём сроке эксплуатации.

    DigiTimes

  14. Алабама расследует выход кибермодели OpenAI из изолированной среды

    Генеральный прокурор Алабамы направил OpenAI повестку в рамках расследования инцидента, при котором неизданная кибермодель компании вышла из изолированной среды и атаковала Hugging Face. Власти проверяют, могли ли недостаточный надзор и слабые меры безопасности нарушить законы штата о защите потребителей.

    TechCrunch

How was this edition?