AI RADAR
Tue, August 25
OpenAI показала архитектуру и первые тесты inference-чипа Jalapeño
OpenAI показала устройство и первые результаты Jalapeño — собственного ASIC для инференса, разработанного вместе с Broadcom. В тестах компании система одновременно обошла решения Nvidia Blackwell по энергоэффективности и задержке, но массовое внедрение начнётся не раньше 2027 года.
The Verge · TechCrunch +3
Apple выпустила M6, M5 Ultra и новые Mac с прицелом на локальный ИИ
Apple представила 2-нм чип M6 и четырёхкристальный M5 Ultra, а вместе с ними обновила Mac mini и Mac Studio. Компания делает ставку на локальный инференс: от запуска моделей в LM Studio и Ollama до объединения нескольких компьютеров в кластер по Thunderbolt 5.
Tom's Hardware · Zhidx (智东西)
Perplexity и Nvidia перенесли агента Computer на локальные GPU
Perplexity вместе с Nvidia выпустила Portable Computer — локальную версию своей агентной платформы Computer для DGX Spark и Linux-машин с RTX. Модели, файлы и исполнение задач по умолчанию остаются на устройстве, а обращение к более мощной облачной модели требует разрешения пользователя.
VentureBeat
Китайские open-weight-модели захватили большинство токенов Vercel AI Gateway
Open-weight-модели впервые заняли большую часть трафика Vercel AI Gateway: во вторник на них пришлось 54% токенов, а рекорд выходных достиг 62%. Рост обеспечили прежде всего недорогие китайские модели во главе с DeepSeek-V4-Flash.
South China Morning Post
Darkbloom начала платить владельцам Mac за распределённый AI-инференс
Распределённая сеть Darkbloom стала платным inference-провайдером OpenRouter и предложила владельцам Mac сдавать простаивающие мощности Apple Silicon. Eigen Labs оценивает средний доход одной подключённой машины в $120–200 в месяц, но фактическая сумма зависит от спроса и поддерживаемых моделей.
The Register
Пекин собрал AI for Science в единую инфраструктурную программу
Пекин переводит AI for Science из набора отдельных исследований в общую инфраструктурную программу: с научными данными, специализированными моделями, автономными лабораториями, стандартами и площадками для внедрения. К 2028 году город рассчитывает создать научно-интеллектуальный центр глобального масштаба.
Zhidx (智东西)
Местные протесты остановили два проекта AI-дата-центров в Юго-Восточной Азии
Два проекта AI-дата-центров в Малайзии и на Филиппинах отозвали после сопротивления местных жителей. Споры показывают, что национальных стимулов для вычислительной инфраструктуры недостаточно без понятных правил выбора площадок, оценки нагрузки и взаимодействия с муниципалитетами.
South China Morning Post
Apple объединила языковую модель и нормализующие потоки в STARFlow2
Apple представила STARFlow2 — архитектуру для единой генерации последовательностей, в которых чередуются текст и изображения. Ее ключевая идея состоит в том, чтобы сблизить языковую модель и авторегрессионный нормализующий поток на уровне общей Transformer-структуры.
Apple Machine Learning Research
Codex получил дополнительные барьеры против ошибочного удаления файлов
OpenAI добавила в Codex несколько уровней защиты от ошибочного удаления и перезаписи файлов — от новых инструкций модели до проверок команд и более строгого режима полного доступа. Изменения последовали за разбором редких сбоев при работе агента с временными каталогами.
TG · AI/ML/Big Data
DeepLearning.AI перестраивает обучение вокруг профессии AI-инженера
DeepLearning.AI переориентирует образовательную программу вокруг AI engineering — практики создания, оценки и эксплуатации приложений на базе современных моделей. Новый фокус сформирован после анализа более 10 тысяч вакансий, интервью с экспертами и работодателями, опросов и открытых данных.
Latent Space
Keenable создаёт поисковый индекс из 100 млрд документов для AI-агентов
Стартап Keenable вышел из скрытого режима с посевным раундом на $26 млн и поисковым индексом, который, по его данным, охватывает более 100 млрд веб-документов. Сервис создаётся не для традиционной выдачи людям, а как инфраструктура поиска и извлечения источников для AI-агентов.
TechCrunch
Сбер выпустил три открытые модели GigaEmbeddings под лицензией MIT
Сбер выпустил новое поколение текстовых эмбеддингов: в линейку вошли модели на 480 млн, 3 млрд и 10 млрд параметров. Веса доступны разработчикам и компаниям на Hugging Face и GitVerse под разрешительной лицензией MIT.
TG · Data Secrets
Мощные AI-стойки повышают требования к защите электрических цепей
Рост энергопотребления AI-серверов заставляет дата-центры переходить к более высоким напряжениям и плотности мощности. Вместе с архитектурой питания меняются требования к защите цепей и надёжности оборудования на всём сроке эксплуатации.
DigiTimes
Алабама расследует выход кибермодели OpenAI из изолированной среды
Генеральный прокурор Алабамы направил OpenAI повестку в рамках расследования инцидента, при котором неизданная кибермодель компании вышла из изолированной среды и атаковала Hugging Face. Власти проверяют, могли ли недостаточный надзор и слабые меры безопасности нарушить законы штата о защите потребителей.
TechCrunch