AI Radar

Perplexity и Nvidia перенесли агента Computer на локальные GPU

Perplexity вместе с Nvidia выпустила Portable Computer — локальную версию своей агентной платформы Computer для DGX Spark и Linux-машин с RTX. Модели, файлы и исполнение задач по умолчанию остаются на устройстве, а обращение к более мощной облачной модели требует разрешения пользователя.

25 августа 2026 г.3 мин чтенияИсточник: VentureBeat
04

Что изменилось

Portable Computer переносит на локальную машину не только языковую модель, но и весь необходимый агентный контур: inference-движок, средства вызова инструментов, коннекторы приложений и защитную песочницу. Интерфейс повторяет облачный Perplexity Computer, который умеет разбирать документы, анализировать данные, готовить отчёты и передавать результат во внешние системы. Разница в том, что пользователю не нужно отдельно загружать веса, поднимать сервер инференса и вручную связывать его с инструментами.

Локальный режим выбран поведением по умолчанию. Каждая задача начинается на компьютере пользователя, а отдельный сложный шаг можно передать frontier-модели в облаке только после подтверждения. Работа, целиком завершённая на устройстве, не расходует биллинговые кредиты Perplexity. Это не делает эксплуатацию бесплатной — остаются стоимость оборудования и электроэнергии, — но устраняет переменную плату за токены и помогает заранее оценивать расходы на длинные агентные процессы.

В демонстрации агент на DGX Spark использовал 27-миллиардную Qwen и проверил папку с налоговыми формами 1099 и инвестиционными документами, выявляя лишние комиссии. Все чувствительные файлы обрабатывались локально, GPU работал с полной загрузкой, а счётчик облачных кредитов оставался на нуле. Другой сценарий показал гибридную схему: Portable Computer проанализировал CSV с воронкой продукта на устройстве, а затем отправил готовый результат в Slack.

Изоляция от облака при этом не абсолютная. Система умеет подключаться к Slack, Google Drive, Gmail и GitHub, поэтому фактическая граница данных зависит от выбранного сценария и разрешённых коннекторов. При недостатке возможностей локальной модели агент также может запросить эскалацию в облако. Такой подход оставляет пользователю контроль, но требует внимательно проверять каждый шаг, которому разрешена передача файлов или контекста во внешний сервис.

На старте можно установить Qwen 3.8 27B либо PPLX 27B — вариант, который Perplexity дополнительно обучила для работы со своим агентным harness. Позже ожидается Nvidia Nemotron 3.5 Lightning. Первой целевой платформой стал настольный суперкомпьютер DGX Spark, однако продукт также рассчитан на Linux-системы с Nvidia RTX, что заметно расширяет потенциальную аудиторию за пределы владельцев специализированной рабочей станции.

Почему это важно

Portable Computer упрощает развёртывание полноценного локального агента, а не только запуск модели через отдельный inference-сервер. Это полезно для анализа финансовых, корпоративных и иных чувствительных документов, которые нежелательно постоянно отправлять в облако. Гибридный режим сохраняет доступ к сильным моделям и внешним сервисам, но организациям всё равно понадобится политика контроля эскалаций и коннекторов.

Первоисточники и подтверждения

Подборку проверяет редакция DSML. AI помогает дедуплицировать сигналы и готовить текст, но опубликованный выпуск остаётся редакционным продуктом, а не лентой отдельных каналов.

25 августа 2026 г.
  1. 01OpenAI показала архитектуру и первые тесты inference-чипа Jalapeño
  2. 02Apple выпустила M6, M5 Ultra и новые Mac с прицелом на локальный ИИ
  3. 03Китайские open-weight-модели захватили большинство токенов Vercel AI Gateway
  4. 04Darkbloom начала платить владельцам Mac за распределённый AI-инференс