AI RADAR
Thu, October 8
- 11:00
expected
Next signal at 11:00
- #agents
Microsoft выпустила Agent Lightning 1.0 для обучения уже работающих AI-агентов
Microsoft Research представила Agent Lightning 1.0 — лёгкий фреймворк, который связывает существующих AI-агентов с обучением с подкреплением. Его цель — улучшать их работу без полной перестройки обвязки.
Microsoft Research
- #agents
Google и Кембридж открыли VeriHarness для проверки результатов AI-агентов
Google AI Research и Кембриджский университет открыли VeriHarness — систему, которая проверяет и исправляет результаты долгих агентных задач с помощью той же модели, что выполняла работу. Вместе с кодом опубликованы трейсы запусков агентов.
TG · AI/ML/Big Data
- #models
Claude Haiku 5.5 стала дешевле и получила настройку глубины рассуждений
Anthropic выпустила Claude Haiku 5.5 для быстрых массовых задач: по оценке компании, средние расходы на неё примерно на 75% ниже, чем на Haiku 4.5. Впервые для Haiku разработчики могут настраивать усилие, затрачиваемое моделью на рассуждение.
TestingCatalog · Simon Willison's Weblog +5
- #models
В ChatGPT приходят GPT-6 и ответы с интерактивными интерфейсами
OpenAI начала переводить основной чат ChatGPT на GPT-6 Sol для платных пользователей и GPT-6 Luna для бесплатного тарифа и Go. Одновременно Intelligent UI позволяет модели собирать под вопрос графики, кнопки и небольшие инструменты прямо в ответе.
The Decoder · QbitAI (量子位) +1
- #developer tools
Microsoft добавила защищённые среды для агентов в Windows и показала ПК на RTX Spark
В Windows 11 стали общедоступны Microsoft Execution Containers — среды, ограничивающие доступ AI-агентов к файлам и сети. Одновременно Microsoft и NVIDIA представили компьютеры на RTX Spark и инструменты для сочетания локальных и облачных моделей.
TestingCatalog · Zhidx (智东西) +1
- #models
TRACE ускоряет генерацию ответов при RL-обучении MoE-моделей с помощью FP4
Исследователи представили TRACE — метод FP4-квантизации для обучения MoE-моделей с подкреплением. Он согласует вычисления при генерации ответов и обновлении модели; в экспериментах генерация ускорилась до 5,4 раза при качестве RL, сопоставимом с BF16.
Hugging Face Daily Papers
- #open models
AWS открыла Strands Box — песочницу с правилами для действий AI-агентов
AWS выпустила в открытый доступ Strands Box: песочница изолирует AI-агента и применяет заданные разработчиком правила к его действиям. Проверка учитывает историю операций и не полагается на готовность самого агента следовать инструкциям.
The Register
- #models
Google обновила Nano Banana: версия 2.1 работает с длинным контекстом и редактирует изображения
Google выпустила Nano Banana 2.1 для генерации и редактирования изображений. Для неё заявлены контекст до 1 млн токенов, поддержка 4K и более низкая цена за выходные токены, чем у Nano Banana Pro.
TG · AI/ML/Big Data · TG · Data Secrets