AI Radar
Новая открытая модель Liquid AI предназначена для локального анализа экранов, документов и изображений. При 3 млрд параметров она может работать на смартфоне и требует около 3 ГБ памяти.
LFM2.5-VL-3B совмещает зрительное восприятие с генерацией текста и ориентирована в том числе на работу с графическими интерфейсами. Она умеет читать мобильные, веб- и настольные экраны, распознавать документы и реальные объекты, а также связывать найденные элементы с точными координатами — это необходимо агентам, которые должны не просто описывать интерфейс, а нажимать нужные кнопки и поля.
По опубликованным результатам, модель набрала 80,7 балла на ScreenSpot-v2 против 51,2 у Gemma-4-E4B и превзошла более крупные модели в задачах по интерфейсам, привязке объектов и распознаванию текста. На Galaxy S26 Ultra заявлена скорость около 20 токенов в секунду, а на компьютере с M5 Max — до 228 токенов в секунду. Веса LFM2.5-VL-3B уже размещены на Hugging Face, однако приведённые показатели пока представлены без независимой проверки в доступном evidence.
Модель такого размера позволяет запускать зрительных ассистентов непосредственно на пользовательском устройстве, сохраняя задержку, стоимость облачных вычислений и передачу чувствительных снимков экрана под контролем разработчика. Особенно практичны сценарии локальной автоматизации интерфейсов, обработки документов и вспомогательных функций на смартфонах.
DSML editors review the selection. AI helps deduplicate signals and draft the text; the published edition remains an editorial product, not a feed of individual channels.