Локальные нейросети на мини-ПК: NPU, RAM и предел iGPU

Надпись Ryzen AI или NPU на коробке мини-ПК не значит, что локальная нейросеть полетит как на видеокарте. В 2026 году большинство домашних сценариев — Ollama, LM Studio, генерация картинок — считают на процессоре и встроенной графике, а токены упираются в оперативку. NPU полезен в Windows для отдельных функций, не как замена CUDA.

Короткий ответ. Для чата с моделью на 7–8 млрд параметров хватит 16–32 ГБ и Ryzen 5/7. Для 14B комфортнее 32 ГБ. Картинки и тяжёлые модели — это уже eGPU или другой компьютер. Покупать мини-ПК «ради NPU» без слотов памяти не стоит: модель съест гигабайты раньше, чем загрузит нейропроцессор.

Что реально ускоряет ответ

Задача Что важно NPU
Чат 7–8B, квантование Q4 32 ГБ RAM, быстрый CPU или iGPU Почти не используется в Ollama
Чат 14B 32 ГБ минимум, лучше запас Редко
32B и выше 64 ГБ и терпение, либо дискрет Нет
Картинки, SD Дискретная карта Нет
Шумодав, фон в Zoom, Studio Effects Драйвер Windows Иногда да

Модель на 8 миллиардов параметров в Q4 занимает примерно 5–6 ГБ плюс контекст и сама Windows. На 16 ГБ она запустится и начнёт свопить, как только откроете браузер. На 32 ГБ можно работать. Это тот же вывод, что в статье сколько оперативки нужно, только цена ошибки выше: модель не «подтормаживает», она встаёт.

Память для локальной модели должна быть съёмной. Запаянные 16 ГБ — потолок, который не поднять. Пайка или слоты.

NPU, iGPU и обычные ядра

NPU — отдельный блок под матричные операции. В ноутбуках Copilot+ он включает эффекты камеры и часть функций Windows. В мини-ПК на Ryzen 7040/8040 блок тоже есть, но софт вроде Ollama чаще гоняет модель на CPU или через Vulkan/ROCm на Radeon 760M и 780M. Драйвер NPU под каждую сборку с AliExpress — лотерея.

760M у FIREBAT F1 и 780M у UM780 XTX для маленькой языковой модели полезнее строчки «AI» на крышке. Они делят оперативку с системой, поэтому одноканал здесь особенно вреден. Intel UHD в CoreBox слабее в этом сценарии: корпус хорош дисками и экранами, не скоростью токенов.

Сравнение графики без маркетинга NPU — в материале 780M, 890M и Arc.

Сколько ждать от кубика

  • Короткий черновик, перевод абзаца, разбор своего текста офлайн — да, на 8B.
  • Длинный контекст на десятки страниц — упирается в RAM и становится медленным даже на 14B.
  • Генерация картинок на iGPU — эксперимент, не рабочий стол дизайнера.
  • Несколько моделей сразу — нет. Одна в памяти, вторая на диске.

Диск нужен быстрый и не забитый: веса моделей по 4–10 ГБ штука. Системные 256 ГБ кончатся на второй загрузке. Второй M.2 как раз для этого, см. SSD и как поставить планку.

Не оставляйте тяжёлую модель на ночь в закрытой тумбе. CPU и iGPU греются как при экспорте видео. Продувка и место для воздуха важнее «AI-режима». Чистка, TDP.

Когда имеет смысл eGPU

Если нужны картинки, видео по описанию или модель, которая на iGPU отвечает по слову в секунду. Тогда смотрите OCuLink, не ещё один «AI-процессор» в том же кубике. На UM780 внешняя карта как раз предусмотрена, но съедает слот M.2. Считайте чек бокса заранее: eGPU через OCuLink.

F1 и CoreBox внешнюю карту штатно не держат. Для них честный потолок — небольшая языковая модель и обычная работа.

Что поставить из софта

  • Ollama или LM Studio — проще всего поднять чат локально.
  • Модель берите в Q4 или Q5, не «full» на 16 ГБ.
  • Контекст на старте уменьшите. Длинное окно съедает RAM сильнее, чем хочется.
  • Браузер с десятком вкладок на время ответа закройте.
  • Облачный чат оставьте для задач, где кубик явно не тянет. Локальная модель не обязана заменять его целиком.

Локальная нейросеть на мини-ПК — это 32 ГБ и скромная модель. Не значок NPU на наклейке.

Частые вопросы

7640HS и 7840HS — это уже «AI PC»?

В линейке AMD блок Ryzen AI есть. Для домашнего чата важнее 780M или 760M и объём RAM, чем то, видит ли Windows отдельный NPU.

Хватит ли 16 ГБ?

На короткие ответы 8B — на грани. Как основной компьютер с браузером — нет. Берите слоты и 32 ГБ.

Нужна ли Windows или лучше Linux?

Ollama живёт и там и там. Часть эффектов NPU в Windows в Linux нет. Если цель — модель, а не Copilot, Linux нормален. Linux на мини-ПК.

Это замена подписки на чат?

Для черновиков и приватных заметок — частично. Для сложного кода и длинных отчётов облако пока заметно сильнее маленькой локальной модели.

Вывод

Мини-ПК тянет локальный чат на небольшой модели, если дать ему 32 ГБ и не запирать в тумбу. NPU в 2026-м не заменяет ни память, ни дискретную карту. F1 закрывает эксперимент, UM780 — запас RAM и путь к eGPU, CoreBox — слабый выбор именно под токены. Смотрите слоты и гигабайты, не бейдж AI.

Рядом: память, встроенная графика, внешняя карта.

Понравилась статья? Поделиться с друзьями:
Добавить комментарий

;-) :| :x :twisted: :smile: :shock: :sad: :roll: :razz: :oops: :o :mrgreen: :lol: :idea: :grin: :evil: :cry: :cool: :arrow: :???: :?: :!: