Надпись Ryzen AI или NPU на коробке мини-ПК не значит, что локальная нейросеть полетит как на видеокарте. В 2026 году большинство домашних сценариев — Ollama, LM Studio, генерация картинок — считают на процессоре и встроенной графике, а токены упираются в оперативку. NPU полезен в Windows для отдельных функций, не как замена CUDA.
Короткий ответ. Для чата с моделью на 7–8 млрд параметров хватит 16–32 ГБ и Ryzen 5/7. Для 14B комфортнее 32 ГБ. Картинки и тяжёлые модели — это уже eGPU или другой компьютер. Покупать мини-ПК «ради NPU» без слотов памяти не стоит: модель съест гигабайты раньше, чем загрузит нейропроцессор.
Что реально ускоряет ответ
| Задача | Что важно | NPU |
|---|---|---|
| Чат 7–8B, квантование Q4 | 32 ГБ RAM, быстрый CPU или iGPU | Почти не используется в Ollama |
| Чат 14B | 32 ГБ минимум, лучше запас | Редко |
| 32B и выше | 64 ГБ и терпение, либо дискрет | Нет |
| Картинки, SD | Дискретная карта | Нет |
| Шумодав, фон в Zoom, Studio Effects | Драйвер Windows | Иногда да |
Модель на 8 миллиардов параметров в Q4 занимает примерно 5–6 ГБ плюс контекст и сама Windows. На 16 ГБ она запустится и начнёт свопить, как только откроете браузер. На 32 ГБ можно работать. Это тот же вывод, что в статье сколько оперативки нужно, только цена ошибки выше: модель не «подтормаживает», она встаёт.
Память для локальной модели должна быть съёмной. Запаянные 16 ГБ — потолок, который не поднять. Пайка или слоты.
NPU, iGPU и обычные ядра
NPU — отдельный блок под матричные операции. В ноутбуках Copilot+ он включает эффекты камеры и часть функций Windows. В мини-ПК на Ryzen 7040/8040 блок тоже есть, но софт вроде Ollama чаще гоняет модель на CPU или через Vulkan/ROCm на Radeon 760M и 780M. Драйвер NPU под каждую сборку с AliExpress — лотерея.
760M у FIREBAT F1 и 780M у UM780 XTX для маленькой языковой модели полезнее строчки «AI» на крышке. Они делят оперативку с системой, поэтому одноканал здесь особенно вреден. Intel UHD в CoreBox слабее в этом сценарии: корпус хорош дисками и экранами, не скоростью токенов.
Сравнение графики без маркетинга NPU — в материале 780M, 890M и Arc.
Сколько ждать от кубика
- Короткий черновик, перевод абзаца, разбор своего текста офлайн — да, на 8B.
- Длинный контекст на десятки страниц — упирается в RAM и становится медленным даже на 14B.
- Генерация картинок на iGPU — эксперимент, не рабочий стол дизайнера.
- Несколько моделей сразу — нет. Одна в памяти, вторая на диске.
Диск нужен быстрый и не забитый: веса моделей по 4–10 ГБ штука. Системные 256 ГБ кончатся на второй загрузке. Второй M.2 как раз для этого, см. SSD и как поставить планку.
Не оставляйте тяжёлую модель на ночь в закрытой тумбе. CPU и iGPU греются как при экспорте видео. Продувка и место для воздуха важнее «AI-режима». Чистка, TDP.
Когда имеет смысл eGPU
Если нужны картинки, видео по описанию или модель, которая на iGPU отвечает по слову в секунду. Тогда смотрите OCuLink, не ещё один «AI-процессор» в том же кубике. На UM780 внешняя карта как раз предусмотрена, но съедает слот M.2. Считайте чек бокса заранее: eGPU через OCuLink.
F1 и CoreBox внешнюю карту штатно не держат. Для них честный потолок — небольшая языковая модель и обычная работа.
Что поставить из софта
- Ollama или LM Studio — проще всего поднять чат локально.
- Модель берите в Q4 или Q5, не «full» на 16 ГБ.
- Контекст на старте уменьшите. Длинное окно съедает RAM сильнее, чем хочется.
- Браузер с десятком вкладок на время ответа закройте.
- Облачный чат оставьте для задач, где кубик явно не тянет. Локальная модель не обязана заменять его целиком.
Локальная нейросеть на мини-ПК — это 32 ГБ и скромная модель. Не значок NPU на наклейке.
Частые вопросы
7640HS и 7840HS — это уже «AI PC»?
В линейке AMD блок Ryzen AI есть. Для домашнего чата важнее 780M или 760M и объём RAM, чем то, видит ли Windows отдельный NPU.
Хватит ли 16 ГБ?
На короткие ответы 8B — на грани. Как основной компьютер с браузером — нет. Берите слоты и 32 ГБ.
Нужна ли Windows или лучше Linux?
Ollama живёт и там и там. Часть эффектов NPU в Windows в Linux нет. Если цель — модель, а не Copilot, Linux нормален. Linux на мини-ПК.
Это замена подписки на чат?
Для черновиков и приватных заметок — частично. Для сложного кода и длинных отчётов облако пока заметно сильнее маленькой локальной модели.
Вывод
Мини-ПК тянет локальный чат на небольшой модели, если дать ему 32 ГБ и не запирать в тумбу. NPU в 2026-м не заменяет ни память, ни дискретную карту. F1 закрывает эксперимент, UM780 — запас RAM и путь к eGPU, CoreBox — слабый выбор именно под токены. Смотрите слоты и гигабайты, не бейдж AI.
Рядом: память, встроенная графика, внешняя карта.
- Небольшой локальный чат — FIREBAT F1
- 32–96 ГБ и OCuLink — Minisforum UM780 XTX
- Офис, не нейросети — Chuwi CoreBox i5-12450H