Коротко: диалог NPC грузит видеокарту, а не NPU
- ИИ-НПС в играх уже вышли из демо. NVIDIA ACE работает у обычных игроков в inZOI (Smart Zoi) и NARAKA: BLADEPOINT, в PUBG: Battlegrounds прошла ограниченная бета напарника PUBG Ally (17 июня – 1 июля 2026 года), а Total War: PHARAOH тестирует ИИ-советника.
- Считает всё видеокарта GeForce RTX. Ни одна игра из списка NVIDIA не использует NPU: порог 40+ TOPS — это требование Microsoft к ноутбукам Copilot+ PC для функций Windows (нынешние NPU дают 45–50 TOPS), а не к диалогам ИИ-NPC.
- Главный ресурс — видеопамять. Модель персонажа живёт в той же VRAM, что текстуры игры. Модель по умолчанию в Game Agent SDK (Qwen3.5-4B, 4 бита) занимает около 3,8 ГБ.
- Минимум для PUBG Ally — RTX 2080 Ti или RTX 3060 8 ГБ плюс 16 ГБ ОЗУ, рекомендовано RTX 4070 и 24 ГБ ОЗУ (патч-ноут PUBG, июнь 2026 года).
- Апгрейд ради одной функции не окупается, пока ИИ-NPC работает в бета-режимах и опциях. Если уже стоит RTX 3060 8 ГБ или карта мощнее, минимум закрыт.
- Моды вроде Mantella для Skyrim умеют работать и без мощной видеокарты — через облачный API, но тогда реплики уходят на чужой сервер.
NVIDIA ACE — что это и как устроен ИИ-персонаж внутри
NVIDIA ACE — это набор моделей и инструментов, из которых студии собирают игровых персонажей, способных слушать игрока, отвечать голосом и действовать в мире игры. Это не игра и не отдельная программа для игрока: ACE встраивают разработчики, а игрок получает функцию вместе с игрой. Анонс состоялся на Computex 28 мая 2023 года под названием Avatar Cloud Engine, то есть «облачный движок аватаров». К 2026 году акцент сместился: персонажи, которые реально вышли в играх, работают на маленьких моделях прямо на видеокарте игрока, без облака.
- Коротко: диалог NPC грузит видеокарту, а не NPU
- NVIDIA ACE — что это и как устроен ИИ-персонаж внутри
- Почему за диалог NPC отвечает GPU, а не NPU
- Что НЕ означает цифра 40–50 TOPS у NPU
- Сколько VRAM нужно ИИ-NPC: таблица по играм и SDK
- Бюджет видеопамяти: сколько остаётся игре после модели
- Минимальная и рекомендуемая видеокарта: требования PUBG Ally
- Просадка FPS с ИИ-NPC: модель и игра делят одну видеокарту
- Игры с ИИ-NPC: где это уже работает у игроков
- Моды для старых игр: Mantella в Skyrim и её аналоги
- Нужно ли апгрейдить ПК ради ИИ-NPC
- Риски ИИ-персонажей: галлюцинации, срыв погружения, приватность
- Частые вопросы про железо для ИИ-NPC
Чтобы дальше не спотыкаться, пять терминов, на которых держится весь разговор о железе:
- NPC (non-player character, в геймерском сленге «НПС») — персонаж, которым управляет игра, а не человек.
- SLM (small language model) — «маленькая» языковая модель на 0,5–8 млрд параметров. Она проще чат-ботов вроде ChatGPT, зато помещается в видеокарту рядом с игрой.
- VRAM — собственная память видеокарты. В ней лежат текстуры и кадры игры, а теперь и модель персонажа.
- Квантизация — сжатие модели за счёт снижения точности чисел (например, до 4 бит на параметр). Модель становится в несколько раз меньше и чуть теряет в качестве.
- NPU и TOPS — отдельный блок процессора для задач ИИ и его пиковая производительность в триллионах операций в секунду.
Четыре части персонажа на ACE: уши, мозг, голос и лицо
У персонажа на базе ACE четыре части, и игра может взять любую из них по отдельности:
- «Уши» — распознавание речи (ASR), превращает голос игрока в текст.
- «Мозг» — небольшая языковая модель, решает, что сказать и что сделать.
- «Голос» — синтез речи (TTS), озвучивает ответ.
- «Лицо» — Audio2Face, анимирует мимику под голос.
Вокруг них стоят два программных слоя. In-Game Inferencing SDK планирует работу ИИ так, чтобы она уживалась с графикой на одной видеокарте. Game Agent SDK — открытый C/C++-фреймворк (лицензия Apache 2.0, на GitHub с мая 2026 года), который связывает модель с состоянием игры: где персонаж, сколько у него патронов, что происходит рядом.
Скриптовые диалоги против генеративного персонажа
Классический NPC говорит по дереву диалогов: сценарист заранее написал реплики и варианты ответа, и персонаж выбирает ветку. Такой NPC предсказуем, но не отвечает на вопрос, которого сценарист не предусмотрел. ИИ-NPC генерирует реплику на лету и понимает свободную речь.
Самый подробно описанный пример — PUBG Ally. KRAFTON разделила персонажа на «быстрый» и «медленный» контуры: движение, прицеливание и реакция в бою остались за классическим деревом поведения, которое работает на частоте игрового тика, а языковая модель отвечает за разговор и обдуманные решения. Факты модель берёт не из памяти, а из движка: инструменты возвращают строки вроде «вооружён M416, 24/30 патронов, HP 78%», и системный промпт объявляет их единственным источником правды на матч. Поэтому напарника нельзя уговорить, что у него полный магазин: движок скажет иначе и будет прав.
Память тоже устроена структурно. На CES 2026 KRAFTON показала Ally с долгой памятью: профиль игрока (имя, любимое оружие, точки высадки) переносится между матчами. Академическая работа Орхусского университета (arXiv:2511.10277) предлагает похожую схему: одна дообученная модель задаёт характер, а память диалога и знания о мире лежат в отдельных сменных хранилищах. Для железа это важно: одна модель может обслуживать много персонажей, и видеопамять не растёт пропорционально числу NPC.
Почему за диалог NPC отвечает GPU, а не NPU
Короткий ответ: так устроены все игры, где ИИ-NPC уже работает. NVIDIA в техническом блоге от 16 июня 2026 года прямо пишет, что PUBG Ally «работает полностью на устройстве на GeForce RTX». README Game Agent SDK на GitHub формулирует то же для любого проекта на этом SDK: персонаж выполняет инференс «локально на GPU конечного пользователя» с помощью небольшой языковой модели. Документация SDK требует видеокарту NVIDIA архитектуры Ampere или новее, драйвер 570.65+ и CUDA 12.8. CUDA — платформа вычислений на видеокартах NVIDIA, NPU она не касается.
Откуда тогда миф про NPU? У Microsoft есть сертификация Copilot+ PC: чтобы ноутбук её получил, NPU обязан выдавать 40+ TOPS, плюс нужны 16 ГБ ОЗУ, SSD от 256 ГБ и Windows 11 24H2. Сама Microsoft объясняет пользу NPU так: он берёт на себя ИИ-задачи и освобождает GPU «для графики, анимации и игр». Звучит как готовый рецепт для ИИ-NPC, но на практике NPU в Copilot+ PC обслуживает функции Windows — Recall, Live Captions, Studio Effects, Click to Do.
Вторая причина — софт. По разбору Digital Applied от 29 июня 2026 года, популярные среды запуска моделей (Ollama, llama.cpp, LM Studio) отправляют вычисления на встроенную графику или процессор, а не на NPU. Чтобы задействовать NPU, модель вручную конвертируют в формат ONNX через QNN или OpenVINO. AMD описывает для своих NPU отдельный путь через Windows ML. Это специализированная дорожка, и ни одна игра из списка NVIDIA на неё не встала.
| Что сравниваем | Видеокарта GeForce RTX | NPU ноутбука Copilot+ PC |
|---|---|---|
| Кто использует в играх | PUBG Ally, Smart Zoi, NARAKA, Game Agent SDK | ни одна игра из списка NVIDIA |
| Чем занят сейчас | графика и параллельные вычисления, в том числе ИИ | фоновые функции Windows: Recall, Live Captions, Studio Effects |
| Память | своя VRAM, общая с игрой | общая системная ОЗУ ноутбука |
| Софт для моделей | CUDA, готовые плагины ACE для Unreal Engine 5 | ONNX через QNN, OpenVINO или Windows ML, модели конвертируют вручную |
| Потолок размера модели | ограничен объёмом VRAM | около 4 млрд параметров на специализированных SDK |
| Производитель | только NVIDIA (для ACE) | Qualcomm, Intel, AMD |
Есть нюанс, который стоит держать в голове. По размеру игровые модели NPU подошли бы: у Smart Zoi 0,5 млрд параметров, у PUBG Ally 2 млрд, а потолок NPU на специализированных SDK — около 4 млрд (Llama-3B, Phi4-mini, Qwen3-4B). То есть технически путь «диалог на NPU» не закрыт. Но на 26 сентября 2026 года его не реализовала ни одна выпущенная игра, поэтому покупать ноутбук с мощным NPU ради ИИ-NPC нет смысла.
Что НЕ означает цифра 40–50 TOPS у NPU
Цифра 40–50 TOPS не означает, что ноутбук потянет ИИ-NPC или быстро запустит языковую модель. Это пиковая производительность нынешних NPU в операциях с низкой точностью, а порог сертификации Copilot+ PC для функций Windows — 40+ TOPS. Скорость генерации текста определяет другое: пропускная способность памяти и объём, куда помещается модель. Вот что стоит за цифрами на коробке.
TOPS у NPU разных производителей на 29 июня 2026 года (по вендорским спецификациям в сводке Digital Applied):
- Qualcomm Snapdragon X Elite — 45 TOPS (INT8), память 135 ГБ/с.
- Intel Core Ultra 200V — 47–48 TOPS у самого NPU. Цифра 120 TOPS на слайдах — это сумма NPU, видеоядра и процессора, а не NPU.
- AMD Ryzen AI 300 — 50 TOPS (XDNA 2). Как этот чип ведёт себя с реальными моделями, мы разбирали на примере Ryzen AI 9 HX 370 для локального ИИ.
- Qualcomm Snapdragon X2 Elite — 80 TOPS, 152 ГБ/с (анонс сентября 2025 года).
Почему TOPS плохо предсказывает скорость. Языковая модель выдаёт текст по одному токену, и на каждом шаге читает свои веса из памяти. Потолок скорости поэтому считают так: пропускная способность памяти, делённая на размер модели. Посчитаем для модели по умолчанию из Game Agent SDK (около 3,8 ГБ):
| Платформа | TOPS | Пропускная способность | Теоретический потолок для модели 3,8 ГБ |
|---|---|---|---|
| Snapdragon X Elite | 45 | 135 ГБ/с | ≈35 токенов/с |
| Snapdragon X2 Elite | 80 | 152 ГБ/с | ≈40 токенов/с |
| Ryzen AI Max+ 395 (встроенная графика) | 50 у NPU | ≈256 ГБ/с | ≈67 токенов/с |
Расчёт наш и теоретический: реальная скорость ниже из-за накладных расходов и контекста. Но вывод он показывает наглядно. У X2 Elite TOPS выросли на 78% (с 45 до 80), а пропускная способность — только на 13%, и потолок генерации сдвинулся примерно на те же 13%. TOPS растёт на коробке, а скорость упирается в память.
Отдельный случай — AMD Ryzen AI Max+ 395 (Strix Halo). Среди чипов Windows-ноутбуков это редкий случай, который запускает даже модели уровня Llama 3.3 70B: у него 128 ГБ памяти LPDDR5X-8000 на 256-битной шине, и до 96 ГБ можно отдать встроенной графике на 40 вычислительных блоков. По оценке вендора и сообщества, это около 14 токенов в секунду на квантизованной 70B. Это не независимый замер, а ориентир. Работу при этом делает встроенная графика, а не 50-TOPS NPU того же чипа. Как Strix Halo держится против DGX Spark и Mac Studio на больших моделях, показывает наше сравнение трёх платформ.
Сколько VRAM нужно ИИ-NPC: таблица по играм и SDK
Сама языковая модель ИИ-NPC занимает от сотен мегабайт до 4–4,5 ГБ видеопамяти, но это только добавка к памяти игры. Для PUBG Ally KRAFTON и патч-ноут PUBG называют минимум 8 ГБ VRAM на всю связку «игра плюс три модели: распознавание речи, языковая модель и синтез голоса». Ниже — все публичные цифры в одной таблице, данные на 26 сентября 2026 года.
| Решение | Модель диалога | Видеопамять под модель | Карта | Источник и дата |
|---|---|---|---|---|
| PUBG Ally (PUBG: Battlegrounds) | Mistral-NeMo-Minitron-2B, квантизованная | н/д отдельно; вся связка — от 8 ГБ VRAM | мин. RTX 2080 Ti / RTX 3060 и 8 ГБ, рек. RTX 4070 и 12 ГБ | патч-ноут PUBG 42.1, июнь 2026 |
| Smart Zoi (inZOI) | Mistral NeMo Minitron 0.5B | н/д | GeForce RTX | NVIDIA, 13.03.2025 |
| Game Agent SDK, модель по умолчанию | Qwen3.5-4B, 4 бита | около 3,8 ГБ | Ampere и новее (RTX 30+) | NVIDIA и GitHub, 16.06.2026 |
| Академический NPC «Oliver» | Mistral-7B-Instruct + LoRA | около 4,2 ГБ | RTX 2070 Super 8 ГБ | arXiv:2511.10277, 13.11.2025 |
| Академический NPC «Casper» | TinyLlama-1.1B | около 807 МБ | RTX 2070 Super 8 ГБ | arXiv:2511.10277, 13.11.2025 |
| Академический NPC «Jack» | DistilGPT-2 | около 130 МБ | RTX 2070 Super 8 ГБ | arXiv:2511.10277, 13.11.2025 |
Как читать эту таблицу. Все четыре модели, которые идут в комплекте с Game Agent SDK (языковая модель, два эмбеддера для поиска по базе знаний и реранкер), по README на GitHub весят около 3 ГБ. В работе же, по тому же README, одна языковая модель занимает около 3,8 ГБ. Почему больше, чем весь комплект, в README не сказано. Вероятная причина — память под контекст разговора (так называемый KV-кэш) и служебные буферы, но это наша оценка. Как этот кэш растёт с длиной контекста, мы считали в материале про видеопамять под модель.
Академический замер полезен как независимая от NVIDIA точка. Авторы из Орхуса запускали свои NPC на связке Intel i7-8700K и RTX 2070 Super 8 ГБ. Самая точная версия (Mistral-7B) заняла около 4,2 ГБ, ответила на 93% вопросов по фактам верно, но на полный ответ ушло 5,49 секунды, хотя первый токен появлялся через 0,11 секунды. Самая лёгкая (DistilGPT-2, около 130 МБ) отвечала за 0,8 секунды, но верно — меньше чем в 20% случаев. Отсюда практический вывод: модель меньше 1 млрд параметров экономит память, но заметно чаще путает факты. Важная оговорка: замер сделан в отдельной программе, без запущенной игры, поэтому в реальном матче памяти будет не хватать сильнее.
Почему модели квантизуют до 4 бит и что при этом теряется, подробно разобрано в сравнении квантования Q4 и Q8. Для игр компромисс понятен: 4-битная модель занимает примерно вчетверо меньше памяти, чем та же модель в 16 битах, и оставляет место текстурам.
Бюджет видеопамяти: сколько остаётся игре после модели
Удобнее всего думать о VRAM как о бюджете: модель персонажа забирает свою долю заранее, а игре достаётся остаток. Возьмём модель по умолчанию из Game Agent SDK (около 3,8 ГБ) и посчитаем, что остаётся на текстуры, кадры и эффекты на картах разного объёма.
| Объём VRAM карты | Занимает модель SDK | Остаётся игре | Что это значит на практике |
|---|---|---|---|
| 8 ГБ | ≈3,8 ГБ | ≈4,2 ГБ | меньше, чем многие игры просят для высоких текстур; жить можно на средних настройках |
| 12 ГБ | ≈3,8 ГБ | ≈8,2 ГБ | запас как у обычной 8-гигабайтной карты без ИИ |
| 16 ГБ | ≈3,8 ГБ | ≈12,2 ГБ | модель почти не мешает игре |
Расчёт наш и упрощённый: Windows и фоновые программы тоже держат часть видеопамяти, а конкретная игра может использовать модель меньше или больше, чем 3,8 ГБ. Но порядок цифр согласуется с тем, что у PUBG Ally в минимуме стоит 8 ГБ, а в рекомендации — RTX 4070 с 12 ГБ, хотя у Ally своя модель на 2 млрд параметров, а не 3,8-гигабайтная из SDK.
Минимальная и рекомендуемая видеокарта: требования PUBG Ally
Единых требований «для ИИ-NPC вообще» нет: их задаёт каждая игра. Самый строгий и самый подробно описанный случай — режим Ally Duo в PUBG: Battlegrounds, вышедший с обновлением 42.1. По официальному патч-ноуту PUBG (июнь 2026 года; те же цифры 18 июня пересказал TechPowerUp):
- Минимум: RTX 2080 Ti или RTX 3060, 8 ГБ видеопамяти и 16 ГБ системной ОЗУ.
- Рекомендовано: RTX 4070, 12 ГБ видеопамяти и 24 ГБ системной ОЗУ.
- Драйвер: NVIDIA 555.85 или новее.
- Обязательно: включённое аппаратное планирование GPU (Hardware-Accelerated GPU Scheduling, HAGS). Путь в Windows: «Параметры → Система → Дисплей → Графика → Параметры графики по умолчанию», после включения нужна перезагрузка.
- Только NVIDIA GeForce RTX: если игра не видит такую карту, кнопка входа в режим неактивна. Поэтому на видеокартах AMD Radeon и Intel Arc режим PUBG Ally не запустится, даже если по мощности и памяти карта проходит минимум.
Здесь есть деталь, которую легко пропустить. RTX 2080 Ti — карта поколения Turing (RTX 20), а документация Game Agent SDK требует Ampere или новее, то есть RTX 30 и выше. Требования ACE-функций различаются от игры к игре и от инструмента к инструменту, поэтому ориентир «подходит любая RTX» неверен. Новые игры, собранные на Game Agent SDK, вероятнее всего унаследуют порог Ampere+, но это наша оценка, а не заявление NVIDIA.
Вторая деталь — системная ОЗУ. Рекомендация PUBG Ally поднимает планку до 24 ГБ: игра, распознавание речи, модель и синтез голоса вместе потребляют больше, чем одна игра. Для апгрейда это самая дешёвая строка: добавить память обычно проще, чем менять видеокарту.
Что с AMD и Intel. Официальные ACE-функции работают только на GeForce RTX, и владельцам Radeon или Arc их не видать. Но это ограничение NVIDIA, а не технологии: открытые модели на Radeon запускаются через ROCm или Vulkan, и для модов со своим локальным бэкендом карта AMD подходит. Где Radeon в нейросетях сравнялся с GeForce, а где нет, разобрано в материале ROCm против CUDA.
Просадка FPS с ИИ-NPC: модель и игра делят одну видеокарту
Главный риск для производительности — не «нагрузка на NPU», а конкуренция за одну и ту же видеокарту. KRAFTON в интервью NVIDIA от 25 июня 2026 года прямо сказала, что PUBG «уже потребляет значительную долю памяти GPU», и поэтому модель Ally квантизовали, чтобы она уместилась «в оставшийся запас VRAM». Это ключ к пониманию FPS в играх с ИИ-NPC.
Просадка может прийти двумя путями:
- Через память. Если модели и игре вместе не хватает VRAM, драйвер вытесняет часть данных в системную ОЗУ. Доступ к ним идёт через шину PCIe, она намного медленнее собственной памяти карты, и игра начинает подтормаживать: растут фризы и падает минимальный FPS.
- Через вычисления. Пока модель генерирует ответ, она занимает вычислительные блоки той же видеокарты. Для этого у NVIDIA есть In-Game Inferencing SDK, который распределяет работу ИИ и графики, а PUBG требует включённый HAGS, чтобы Windows точнее планировала задачи на GPU.
Сколько именно кадров теряется, публично не измерено: на 26 сентября 2026 года мы не нашли независимых тестов FPS с включённым и выключенным PUBG Ally, а NVIDIA и KRAFTON таких цифр не публиковали. Поэтому здесь нет процентов, только механизм. Сделать замер у себя несложно:
- включите счётчик кадров (оверлей GeForce или MSI Afterburner) и сыграйте один и тот же отрезок с ИИ-напарником и без него;
- в «Диспетчере задач» Windows на вкладке «Производительность → GPU» смотрите строку «Выделенная память GPU»: если она упирается в объём карты, ИИ и игре тесно;
- при нехватке памяти первым делом снижайте качество текстур — это самый «тяжёлый» для VRAM параметр;
- апскейлинг DLSS снижает нагрузку на вычисления, но память под модель он не освобождает. В самой PUBG поддержка DLSS 4.5 появилась только с обновлением 43.1 от 9 сентября 2026 года, уже после беты Ally.
Почему NVIDIA и KRAFTON всё равно пошли в локальное исполнение, а не в облако. По словам KRAFTON, облачные модели оказались слишком медленными: «сочетание сетевой задержки и задержки инференса часто делало ответы слишком медленными для живой командной связи». Локальная модель убирает путь до сервера и обратно, а платой за это становится видеопамять игрока.
Игры с ИИ-NPC: где это уже работает у игроков
ИИ-NPC перестали быть обещанием: по данным NVIDIA (страница ACE for Games и анонс 13 марта 2025 года), функция вышла как минимум в трёх играх и тестируется ещё в нескольких. Большинство русскоязычных материалов об ИИ-NPC до сих пор пишут в будущем времени и без дат, хотя первые игры с ИИ-NPC на ACE вышли в марте 2025 года. Статус на 26 сентября 2026 года:
| Игра | Роль ИИ | Статус и дата | Что нужно игроку |
|---|---|---|---|
| PUBG: Battlegrounds | напарница Ella (технология PUBG Ally) в режиме Ally Duo, карта Sanhok | ограниченная бета 17 июня – 1 июля 2026 года; в патчах 42.2–43.1 не возвращалась | RTX 2080 Ti / RTX 3060 8 ГБ и выше, 16 ГБ ОЗУ |
| inZOI | горожане Smart Zoi, которые планируют день и оценивают свои поступки | экспериментальная опция с марта 2025 года | GeForce RTX |
| NARAKA: BLADEPOINT MOBILE PC VERSION | ИИ-напарник на устройстве | с марта 2025 года | GeForce RTX |
| Total War: PHARAOH | ИИ-советник, который ищет ответ по 1200+ таблицам игровых данных (RAG) | программа плейтеста в 2026 году | н/д |
| MIR5 (Wemade Next) | боссы, которые учатся на тактике игрока | заявлено NVIDIA | н/д |
| Dead Meat | допрос подозреваемого, которому можно задать любой вопрос | анонс на 2026 год | н/д |
Осторожно со списками «игр на ACE» в сети. Когда ACE только запускали, NVIDIA называла студии, взявшие Audio2Face, — например, GSC Game World для S.T.A.L.K.E.R. 2 и Fallen Leaf для Fort Solis. Audio2Face только анимирует лицо по записанному звуку, разговаривать с такими персонажами нельзя. Игра может использовать одну часть ACE, а персонажи в ней останутся полностью скриптовыми.
Что в этом списке значит для железа. PUBG Ally — единственный случай с опубликованными требованиями, и это самый тяжёлый вариант: голосовой ввод, модель на 2 млрд параметров и синтез речи одновременно с шутером. inZOI и NARAKA используют модели меньше, но точных требований к VRAM для них NVIDIA не раскрывает.
Моды для старых игр: Mantella в Skyrim и её аналоги
Официальный ACE — не единственный способ поговорить с NPC. В Skyrim сообщество давно подключает языковые модели к персонажам через моды Mantella, SkyrimNet и CHIM. Разница с ACE принципиальная: мод не знает, какая у вас видеокарта, и не оптимизирован NVIDIA, зато позволяет выбрать, где считается модель.
Mantella — самый известный из них. По странице мода на Nexus Mods (на 26 сентября 2026 года) он связывает распознавание речи, языковую модель и синтез голоса, даёт собственные описания более чем 3000 персонажей, запоминает прошлые разговоры и знает о событиях в игре. Моду нужно около 5 ГБ места на диске и Windows 10 или 11. Модели он подключает трёх видов: локальные, OpenRouter и OpenAI.
Отсюда два пути по железу:
- Облачный API. При настройке Mantella по умолчанию предлагает OpenRouter: бесплатные модели там доступны в пределах 50 запросов в день, а после пополнения счёта на $10 — 1000 (правила OpenRouter на 26 сентября 2026 года), платные модели идут по предоплаченным кредитам. Видеокарта в этом режиме почти не нагружается: модель считается на сервере. В FAQ мода на Nexus Mods авторы ссылаются на демонстрационное видео, записанное на ноутбуке без видеокарты. Цена — задержка интернета, лимиты и то, что ваши реплики уходят стороннему сервису.
- Локальный бэкенд. Модель запускается на своём ПК через KoboldCpp, Ollama, LM Studio или llama.cpp. В журнале изменений CHIM прямо записано расширение локальной настройки именно под эти четыре среды. Тогда работает тот же принцип, что у ACE, только без оптимизаций NVIDIA. Участник r/skyrimmods сформулировал его так: «то, что можно гонять локально, сильно зависит от вашей видеокарты, потому что вся ИИ-нагрузка идёт поверх самой игры».
Для локального пути полезно помнить цифры из таблицы выше: модель на 4 млрд параметров в 4 битах — это около 4 ГБ видеопамяти, 7-миллиардная — около 4,2 ГБ в академическом замере. Если хочется понять, как вообще поднять такую модель на своём ПК, начните с разбора Qwen3 на своём ПК: это родственное семейство модели по умолчанию в Game Agent SDK (Qwen3.5). Дальше работает тот же расчёт бюджета, что и выше: чем меньше видеопамяти занимает сама игра со всеми модами на графику, тем больше места остаётся модели.
Нужно ли апгрейдить ПК ради ИИ-NPC
Для большинства игроков — нет. На сентябрь 2026 года ИИ-NPC — это завершившаяся двухнедельная бета в PUBG (в патч-ноутах 42.2 от 14 июля, 42.3 от 11 августа и 43.1 от 9 сентября 2026 года режим Ally Duo не возвращался), экспериментальная опция inZOI, напарник в NARAKA и несколько анонсов. Если у вас уже есть GeForce RTX 3060 или карта мощнее с 8 ГБ видеопамяти (RTX 3050 в минимум PUBG Ally не входит) и 16 ГБ ОЗУ, минимум самой требовательной из вышедших реализаций закрыт. Железо разумно выбирать под игры, в которые вы играете, а ИИ-NPC пока идёт бонусом.
Где ваша карта относительно требований PUBG Ally и сколько видеопамяти останется игре, если рядом работает модель размером с модель по умолчанию из Game Agent SDK (около 3,8 ГБ). Объёмы VRAM — по спецификациям NVIDIA, остаток — наш упрощённый расчёт:
| Карта | VRAM | Место в требованиях PUBG Ally | Остаётся игре после модели ≈3,8 ГБ | Что это значит |
|---|---|---|---|---|
| RTX 3050 8 ГБ | 8 ГБ | ниже минимума, в списке нет | ≈4,2 ГБ | официальный режим не рассчитан на эту карту; моды через облако работают |
| RTX 2080 Ti | 11 ГБ | минимум | ≈7,2 ГБ | Ally пускает, но Game Agent SDK требует Ampere и новее |
| RTX 3060 8 ГБ | 8 ГБ | минимум | ≈4,2 ГБ | минимум закрыт, текстуры придётся снижать |
| RTX 3060 12 ГБ | 12 ГБ | минимум | ≈8,2 ГБ | запас по памяти, но не по производительности |
| RTX 4060 | 8 ГБ | прямо не названа, не слабее RTX 3060 | ≈4,2 ГБ | как у RTX 3060 8 ГБ: работает, но впритык |
| RTX 4070 | 12 ГБ | рекомендация | ≈8,2 ГБ | апгрейд не нужен |
| RTX 4070 Ti Super, RTX 4080, RTX 5080 | 16 ГБ | выше рекомендации | ≈12,2 ГБ | модель почти не мешает игре |
Три оговорки к таблице. У PUBG Ally своя модель на 2 млрд параметров, и сколько видеопамяти она занимает отдельно, KRAFTON не публикует, поэтому столбец остатка — ориентир, а не замер. Для RTX 20-й серии вывод про будущее — наша оценка по требованиям SDK, а не заявление NVIDIA: игры на Game Agent SDK такие карты, скорее всего, не поддержат. И даже с запасом по видеопамяти рекомендация Ally требует 24 ГБ системной ОЗУ, так что владельцу мощной карты с 16 ГБ ОЗУ дешевле добавить память, чем думать о новой видеокарте.
Если дискретной GeForce RTX нет вовсе:
- GTX, Radeon, Intel Arc. Официальные ACE-функции недоступны. Остаются моды с облачным API или локальный бэкенд на ROCm/Vulkan.
- Ноутбук Copilot+ PC с NPU без дискретной RTX. NPU для ИИ-NPC не поможет; моды через облако работать будут.
Если вы всё равно выбираете новую видеокарту и хотите запас под ИИ в играх и вне их, считайте объём видеопамяти главным параметром: 12 ГБ — разумная середина, 16 ГБ — спокойный запас. Как подобрать железо под локальные модели целиком, от видеокарты до мини-ПК, мы собрали в гиде по выбору железа для локального ИИ.
Риски ИИ-персонажей: галлюцинации, срыв погружения, приватность
Железо — не единственное, что может пойти не так. У генеративных персонажей есть свои слабые места, и они задокументированы в научных работах, а не только в отзывах игроков.
- Галлюцинации и срыв погружения. В экспериментах с генеративными NPC (International Journal of Human–Computer Interaction, 2026) ошибки распознавания речи, сбои очерёдности реплик и выдуманные ИИ факты быстро разрушали ощущение погружения. Персонаж, который уверенно говорит неправду, раздражает сильнее скриптового.
- Риски, унаследованные от базовых моделей. Обзор 53 ИИ-нативных игр (arXiv:2607.00527) перечисляет предвзятость, токсичность, галлюцинации, утечки приватных данных и уязвимость к специально подобранным промптам. Игрок может «сломать» персонажа словами, если игра не ограничивает модель.
- Задержка ответа. Даже на своей видеокарте полный ответ 7-миллиардной модели в академическом замере занял 5,49 секунды. В бою это вечность, поэтому KRAFTON и оставила реакцию дереву поведения, а модели — только разговор.
- Приватность голоса. У ACE речь распознаётся и обрабатывается на вашем ПК, без отправки на сервер. У модов с облачным API реплики уходят стороннему сервису, и это стоит учитывать, если вы говорите с NPC голосом.
- Нехватка видеопамяти. На 8-гигабайтных картах модель забирает почти половину VRAM, и именно отсюда берутся фризы, а не из «слабого NPU».
Как с этим справляются лучшие реализации. PUBG Ally работает в закрытом мире: одна карта Sanhok, один режим и фиксированный список предметов, а все факты персонаж проверяет через движок. Так галлюцинация не превращается в ложь о состоянии матча.
Что устареет первым. Список игр и их требования: PUBG Ally пока прошёл только ограниченную бету (в патч-ноутах 42.2, 42.3 и 43.1 режим не возвращался, проверено 26 сентября 2026 года), и при постоянном запуске требования могут измениться, а Game Agent SDK тоже в бете. Свежий статус смотрите на официальной странице NVIDIA ACE и в патч-ноутах конкретной игры.
Частые вопросы про железо для ИИ-NPC
Хватит ли RTX 3060 8 ГБ для игр с ИИ-NPC?
Да, для PUBG Ally RTX 3060 с 8 ГБ входит в официальный минимум вместе с 16 ГБ системной ОЗУ (патч-ноут PUBG, июнь 2026 года). Запаса при этом нет: модель занимает заметную часть видеопамяти, и игре останется примерно половина из 8 ГБ. Рассчитывайте на средние текстуры и проверяйте загрузку VRAM в «Диспетчере задач».
Нужен ли ноутбук с NPU, чтобы играть с ИИ-NPC?
Нет. Ни одна игра из списка NVIDIA ACE не использует NPU: диалоги NPC считает видеокарта GeForce RTX. Порог 40+ TOPS — требование Microsoft к ноутбукам Copilot+ PC для функций Windows вроде Recall и Live Captions. Для ИИ-NPC в играх важнее дискретная RTX с достаточным объёмом видеопамяти.
Сколько оперативной памяти нужно для игр с ИИ-напарником?
По патч-ноуту PUBG (июнь 2026 года) для режима Ally Duo минимум — 16 ГБ системной ОЗУ, рекомендовано 24 ГБ. Это больше обычного для одной игры: рядом с ней работают распознавание речи, языковая модель и синтез голоса. Если видеокарта уже тянет рекомендацию, добавить оперативную память — самый дешёвый апгрейд.
Работает ли NVIDIA ACE на видеокартах AMD или Intel?
Официальные ACE-функции в играх рассчитаны только на GeForce RTX: PUBG Ally на картах AMD Radeon и Intel Arc не запускается, а Game Agent SDK требует CUDA 12.8 и архитектуру Ampere или новее. Владельцам AMD и Intel остаются моды вроде Mantella с облачным API или локальной моделью через ROCm или Vulkan.
Можно ли использовать открытые модели для своего ИИ-NPC?
Да. Сама NVIDIA кладёт в Game Agent SDK открытую Qwen3.5-4B, а SDK распространяется под лицензией Apache 2.0. Академическая работа Орхусского университета показала NPC на открытой Mistral-7B, которой хватило около 4,2 ГБ видеопамяти на RTX 2070 Super 8 ГБ. Моды для Skyrim подключают модели через Ollama, KoboldCpp или LM Studio.
