Коротко: діалог NPC навантажує відеокарту, а не NPU
- ШІ-NPC в іграх уже вийшли за межі демо. NVIDIA ACE працює у звичайних гравців в inZOI (Smart Zoi) і NARAKA: BLADEPOINT, у PUBG: Battlegrounds відбулася обмежена бета напарника PUBG Ally (17 червня – 1 липня 2026 року), а Total War: PHARAOH тестує ШІ-радника.
- Усе обчислює відеокарта GeForce RTX. Жодна гра зі списку NVIDIA не використовує NPU: поріг 40+ TOPS — це вимога Microsoft до ноутбуків Copilot+ PC для функцій Windows (нинішні NPU дають 45–50 TOPS), а не до діалогів ШІ-NPC.
- Головний ресурс — відеопам’ять. Модель персонажа живе в тій самій VRAM, що й текстури гри. Модель за замовчуванням у Game Agent SDK (Qwen3.5-4B, 4 біти) займає близько 3,8 ГБ.
- Мінімум для PUBG Ally — RTX 2080 Ti або RTX 3060 8 ГБ плюс 16 ГБ ОЗП, рекомендовано RTX 4070 і 24 ГБ ОЗП (патч-нотатки PUBG, червень 2026 року).
- Апгрейд заради однієї функції не окупається, поки ШІ-NPC працює в бета-режимах та опціях. Якщо вже стоїть RTX 3060 8 ГБ або потужніша карта, мінімум закрито.
- Моди на кшталт Mantella для Skyrim уміють працювати й без потужної відеокарти — через хмарний API, але тоді репліки йдуть на чужий сервер.
NVIDIA ACE — що це і як влаштований ШІ-персонаж усередині
NVIDIA ACE — це набір моделей та інструментів, з яких студії збирають ігрових персонажів, здатних слухати гравця, відповідати голосом і діяти у світі гри. Це не гра й не окрема програма для гравця: ACE вбудовують розробники, а гравець отримує функцію разом із грою. Анонс відбувся на Computex 28 травня 2023 року під назвою Avatar Cloud Engine, тобто «хмарний рушій аватарів». До 2026 року акцент змістився: персонажі, які справді вийшли в іграх, працюють на маленьких моделях просто на відеокарті гравця, без хмари.
- Коротко: діалог NPC навантажує відеокарту, а не NPU
- NVIDIA ACE — що це і як влаштований ШІ-персонаж усередині
- Чому за діалог NPC відповідає GPU, а не NPU
- Що НЕ означає цифра 40–50 TOPS у NPU
- Скільки VRAM потрібно ШІ-NPC: таблиця за іграми та SDK
- Бюджет відеопам’яті: скільки лишається грі після моделі
- Мінімальна й рекомендована відеокарта: вимоги PUBG Ally
- Просідання FPS із ШІ-NPC: модель і гра ділять одну відеокарту
- Ігри з ШІ-NPC: де це вже працює у гравців
- Моди для старих ігор: Mantella в Skyrim та її аналоги
- Чи потрібно апгрейдити ПК заради ШІ-NPC
- Ризики ШІ-персонажів: галюцинації, зрив занурення, приватність
- Часті запитання про залізо для ШІ-NPC
Щоб далі не спотикатися, п’ять термінів, на яких тримається вся розмова про залізо:
- NPC (non-player character, геймерською мовою «НПС») — персонаж, яким керує гра, а не людина. Персонажа з мовною моделлю в англомовних джерелах називають AI NPC, у нас — ШІ-NPC.
- SLM (small language model) — «мала» мовна модель на 0,5–8 млрд параметрів. Вона простіша за чат-боти на кшталт ChatGPT, зате вміщується у відеокарту поруч із грою.
- VRAM — власна пам’ять відеокарти. У ній лежать текстури й кадри гри, а тепер і модель персонажа.
- Квантизація — стиснення моделі завдяки зниженню точності чисел (наприклад, до 4 біт на параметр). Модель стає в кілька разів меншою, а якість відповідей трохи знижується.
- NPU і TOPS — окремий блок процесора для завдань ШІ та його пікова продуктивність у трильйонах операцій на секунду.
Чотири частини персонажа на ACE: вуха, мозок, голос і обличчя
Персонаж на базі ACE має чотири частини, і гра може взяти будь-яку з них окремо:
- «Вуха» — розпізнавання мовлення (ASR), перетворює голос гравця на текст.
- «Мозок» — невелика мовна модель, вирішує, що сказати й що зробити.
- «Голос» — синтез мовлення (TTS), озвучує відповідь.
- «Обличчя» — Audio2Face, анімує міміку під голос.
Навколо них працюють два програмні шари. In-Game Inferencing SDK планує роботу ШІ так, щоб вона уживалася з графікою на одній відеокарті. Game Agent SDK — відкритий C/C++-фреймворк (ліцензія Apache 2.0, на GitHub із травня 2026 року), який пов’язує модель зі станом гри: де персонаж, скільки в нього набоїв, що відбувається поруч.
Скриптові діалоги проти генеративного персонажа
Класичний NPC говорить за деревом діалогів: сценарист заздалегідь написав репліки й варіанти відповіді, і персонаж обирає гілку. Такий NPC передбачуваний, але не відповідає на запитання, якого сценарист не передбачив. ШІ-NPC генерує репліку на льоту й розуміє вільне мовлення.
Найдокладніше описаний приклад — PUBG Ally. KRAFTON розділила персонажа на «швидкий» і «повільний» контури: рух, прицілювання та реакція в бою лишилися за класичним деревом поведінки, яке працює на частоті ігрового тіку, а мовна модель відповідає за розмову й зважені рішення. Факти модель бере не з пам’яті, а з рушія: інструменти повертають рядки на кшталт «озброєний M416, 24/30 набоїв, HP 78%», і системний промпт оголошує їх єдиним джерелом правди на матч. Тому напарника не вийде переконати, що в нього повний магазин: рушій скаже інакше й матиме рацію.
Пам’ять теж влаштована структурно. На CES 2026 KRAFTON показала Ally з довгою пам’яттю: профіль гравця (ім’я, улюблена зброя, точки висадки) переноситься між матчами. Академічна робота Орхуського університету (arXiv:2511.10277) пропонує схожу схему: одна донавчена модель задає характер, а пам’ять діалогу й знання про світ лежать в окремих змінних сховищах. Для заліза це важливо: одна модель може обслуговувати багато персонажів, і відеопам’ять не зростає пропорційно кількості NPC.
Чому за діалог NPC відповідає GPU, а не NPU
Коротка відповідь: так влаштовані всі ігри, де ШІ-NPC уже працює. NVIDIA в технічному блозі від 16 червня 2026 року прямо пише, що PUBG Ally «працює повністю на пристрої на GeForce RTX». README Game Agent SDK на GitHub формулює те саме для будь-якого проєкту на цьому SDK: персонаж виконує інференс «локально на GPU кінцевого користувача» за допомогою невеликої мовної моделі. Документація SDK вимагає відеокарту NVIDIA архітектури Ampere або новішої, драйвер 570.65+ і CUDA 12.8. CUDA — платформа обчислень на відеокартах NVIDIA, NPU вона не стосується.
Звідки тоді міф про NPU? Microsoft має сертифікацію Copilot+ PC: щоб ноутбук її отримав, NPU мусить видавати 40+ TOPS, а ще потрібні 16 ГБ ОЗП, SSD від 256 ГБ і Windows 11 24H2. Сама Microsoft пояснює користь NPU так: він бере на себе ШІ-завдання й звільняє GPU «для графіки, анімації та ігор». Звучить як готовий рецепт для ШІ-NPC, але на практиці NPU в Copilot+ PC обслуговує функції Windows — Recall, Live Captions, Studio Effects, Click to Do.
Друга причина — софт. За розбором Digital Applied від 29 червня 2026 року, популярні середовища запуску моделей (Ollama, llama.cpp, LM Studio) відправляють обчислення на вбудовану графіку або процесор, а не на NPU. Щоб задіяти NPU, модель вручну конвертують у формат ONNX через QNN або OpenVINO. AMD описує для своїх NPU окремий шлях через Windows ML. Це спеціалізована доріжка, і жодна гра зі списку NVIDIA на неї не стала.
| Що порівнюємо | Відеокарта GeForce RTX | NPU ноутбука Copilot+ PC |
|---|---|---|
| Хто використовує в іграх | PUBG Ally, Smart Zoi, NARAKA, Game Agent SDK | жодна гра зі списку NVIDIA |
| Чим зайнятий зараз | графіка й паралельні обчислення, зокрема ШІ | фонові функції Windows: Recall, Live Captions, Studio Effects |
| Пам’ять | власна VRAM, спільна з грою | спільна системна ОЗП ноутбука |
| Софт для моделей | CUDA, готові плагіни ACE для Unreal Engine 5 | ONNX через QNN, OpenVINO або Windows ML, моделі конвертують вручну |
| Стеля розміру моделі | обмежена обсягом VRAM | близько 4 млрд параметрів на спеціалізованих SDK |
| Виробник | лише NVIDIA (для ACE) | Qualcomm, Intel, AMD |
Є нюанс, який варто тримати в голові. За розміром ігрові моделі NPU підійшли б: Smart Zoi має 0,5 млрд параметрів, PUBG Ally — 2 млрд, а стеля NPU на спеціалізованих SDK — близько 4 млрд (Llama-3B, Phi4-mini, Qwen3-4B). Тобто технічно шлях «діалог на NPU» не закритий. Але на 26 вересня 2026 року його не реалізувала жодна випущена гра, тож купувати ноутбук із потужним NPU заради ШІ-NPC немає сенсу.
Що НЕ означає цифра 40–50 TOPS у NPU
Цифра 40–50 TOPS не означає, що ноутбук потягне ШІ-NPC або швидко запустить мовну модель. Це пікова продуктивність нинішніх NPU в операціях із низькою точністю, а поріг сертифікації Copilot+ PC для функцій Windows — 40+ TOPS. Швидкість генерації тексту визначає інше: пропускна здатність пам’яті та обсяг, у який вміщується модель. Ось що стоїть за цифрами на коробці.
TOPS у NPU різних виробників на 29 червня 2026 року (за вендорськими специфікаціями у зведенні Digital Applied):
- Qualcomm Snapdragon X Elite — 45 TOPS (INT8), пам’ять 135 ГБ/с.
- Intel Core Ultra 200V — 47–48 TOPS у самого NPU. Цифра 120 TOPS на слайдах — це сума NPU, відеоядра й процесора, а не NPU.
- AMD Ryzen AI 300 — 50 TOPS (XDNA 2). Як цей чип поводиться з реальними моделями, ми розбирали на прикладі Ryzen AI 9 HX 370 для локального ШІ.
- Qualcomm Snapdragon X2 Elite — 80 TOPS, 152 ГБ/с (анонс вересня 2025 року).
Чому TOPS погано передбачає швидкість. Мовна модель видає текст по одному токену і на кожному кроці читає свої ваги з пам’яті. Тому стелю швидкості рахують так: пропускна здатність пам’яті, поділена на розмір моделі. Порахуймо для моделі за замовчуванням із Game Agent SDK (близько 3,8 ГБ):
| Платформа | TOPS | Пропускна здатність | Теоретична стеля для моделі 3,8 ГБ |
|---|---|---|---|
| Snapdragon X Elite | 45 | 135 ГБ/с | ≈35 токенів/с |
| Snapdragon X2 Elite | 80 | 152 ГБ/с | ≈40 токенів/с |
| Ryzen AI Max+ 395 (вбудована графіка) | 50 у NPU | ≈256 ГБ/с | ≈67 токенів/с |
Розрахунок наш і теоретичний: реальна швидкість нижча через накладні витрати й контекст. Але висновок він показує наочно. У X2 Elite TOPS зросли на 78% (із 45 до 80), а пропускна здатність — лише на 13%, і стеля генерації зсунулася приблизно на ті самі 13%. TOPS росте на коробці, а швидкість упирається в пам’ять.
Окремий випадок — AMD Ryzen AI Max+ 395 (Strix Halo). Серед чипів Windows-ноутбуків це рідкісний випадок, що запускає навіть моделі рівня Llama 3.3 70B: він має 128 ГБ пам’яті LPDDR5X-8000 на 256-бітній шині, і до 96 ГБ можна віддати вбудованій графіці на 40 обчислювальних блоків. За оцінкою вендора та спільноти, це близько 14 токенів на секунду на квантизованій 70B. Це не незалежний замір, а орієнтир. Роботу при цьому виконує вбудована графіка, а не 50-TOPS NPU того самого чипа. Як Strix Halo тримається проти DGX Spark і Mac Studio на великих моделях, показує наше порівняння трьох платформ.
Скільки VRAM потрібно ШІ-NPC: таблиця за іграми та SDK
Сама мовна модель ШІ-NPC займає від сотень мегабайтів до 4–4,5 ГБ відеопам’яті, але це лише додаток до пам’яті гри. Для PUBG Ally KRAFTON і патч-нотатки PUBG називають мінімум 8 ГБ VRAM на всю зв’язку «гра плюс три моделі: розпізнавання мовлення, мовна модель і синтез голосу». Нижче — усі публічні цифри в одній таблиці, дані на 26 вересня 2026 року.
| Рішення | Модель діалогу | Відеопам’ять під модель | Карта | Джерело й дата |
|---|---|---|---|---|
| PUBG Ally (PUBG: Battlegrounds) | Mistral-NeMo-Minitron-2B, квантизована | н/д окремо; уся зв’язка — від 8 ГБ VRAM | мін. RTX 2080 Ti / RTX 3060 і 8 ГБ, рек. RTX 4070 і 12 ГБ | патч-нотатки PUBG 42.1, червень 2026 |
| Smart Zoi (inZOI) | Mistral NeMo Minitron 0.5B | н/д | GeForce RTX | NVIDIA, 13.03.2025 |
| Game Agent SDK, модель за замовчуванням | Qwen3.5-4B, 4 біти | близько 3,8 ГБ | Ampere і новіші (RTX 30+) | NVIDIA і GitHub, 16.06.2026 |
| Академічний NPC «Oliver» | Mistral-7B-Instruct + LoRA | близько 4,2 ГБ | RTX 2070 Super 8 ГБ | arXiv:2511.10277, 13.11.2025 |
| Академічний NPC «Casper» | TinyLlama-1.1B | близько 807 МБ | RTX 2070 Super 8 ГБ | arXiv:2511.10277, 13.11.2025 |
| Академічний NPC «Jack» | DistilGPT-2 | близько 130 МБ | RTX 2070 Super 8 ГБ | arXiv:2511.10277, 13.11.2025 |
Як читати цю таблицю. Усі чотири моделі, що йдуть у комплекті з Game Agent SDK (мовна модель, два ембедери для пошуку в базі знань і реранкер), за README на GitHub важать близько 3 ГБ. У роботі ж, за тим самим README, одна мовна модель займає близько 3,8 ГБ. Чому більше, ніж увесь комплект, у README не сказано. Імовірна причина — пам’ять під контекст розмови (так званий KV-кеш) і службові буфери, але це наша оцінка. Як цей кеш зростає з довжиною контексту, ми рахували в матеріалі про відеопам’ять під модель.
Академічний замір корисний як незалежна від NVIDIA точка. Автори з Орхуса запускали свої NPC на зв’язці Intel i7-8700K і RTX 2070 Super 8 ГБ. Найточніша версія (Mistral-7B) зайняла близько 4,2 ГБ, правильно відповіла на 93% запитань щодо фактів, але на повну відповідь пішло 5,49 секунди, хоча перший токен з’являвся через 0,11 секунди. Найлегша (DistilGPT-2, близько 130 МБ) відповідала за 0,8 секунди, але правильно — менш ніж у 20% випадків. Звідси практичний висновок: модель, менша за 1 млрд параметрів, економить пам’ять, але помітно частіше плутає факти. Важливе застереження: замір зроблено в окремій програмі, без запущеної гри, тож у реальному матчі пам’яті бракуватиме сильніше.
Чому моделі квантизують до 4 біт і що при цьому втрачається, докладно розібрано в порівнянні квантизації Q4 і Q8. Для ігор компроміс зрозумілий: 4-бітна модель займає приблизно вчетверо менше пам’яті, ніж та сама модель у 16 бітах, і лишає місце текстурам.
Бюджет відеопам’яті: скільки лишається грі після моделі
Найзручніше думати про VRAM як про бюджет: модель персонажа забирає свою частку наперед, а грі дістається залишок. Візьмімо модель за замовчуванням із Game Agent SDK (близько 3,8 ГБ) і порахуймо, що лишається на текстури, кадри й ефекти на картах різного обсягу.
| Обсяг VRAM карти | Займає модель SDK | Лишається грі | Що це означає на практиці |
|---|---|---|---|
| 8 ГБ | ≈3,8 ГБ | ≈4,2 ГБ | менше, ніж багато ігор просять для високих текстур; жити можна на середніх налаштуваннях |
| 12 ГБ | ≈3,8 ГБ | ≈8,2 ГБ | запас як у звичайної 8-гігабайтної карти без ШІ |
| 16 ГБ | ≈3,8 ГБ | ≈12,2 ГБ | модель майже не заважає грі |
Розрахунок наш і спрощений: Windows і фонові програми теж тримають частину відеопам’яті, а конкретна гра може використовувати модель, меншу або більшу за 3,8 ГБ. Але порядок цифр узгоджується з тим, що PUBG Ally має в мінімумі 8 ГБ, а в рекомендації — RTX 4070 із 12 ГБ, хоча в Ally своя модель на 2 млрд параметрів, а не 3,8-гігабайтна з SDK.
Мінімальна й рекомендована відеокарта: вимоги PUBG Ally
Єдиних вимог «для ШІ-NPC загалом» немає: їх задає кожна гра. Найсуворіший і найдокладніше описаний випадок — режим Ally Duo в PUBG: Battlegrounds, що вийшов з оновленням 42.1. За офіційними патч-нотатками PUBG (червень 2026 року; ті самі цифри 18 червня переказав TechPowerUp):
- Мінімум: RTX 2080 Ti або RTX 3060, 8 ГБ відеопам’яті та 16 ГБ системної ОЗП.
- Рекомендовано: RTX 4070, 12 ГБ відеопам’яті та 24 ГБ системної ОЗП.
- Драйвер: NVIDIA 555.85 або новіший.
- Обов’язково: увімкнене апаратне планування GPU (Hardware-Accelerated GPU Scheduling, HAGS). Шлях у Windows: «Параметри → Система → Дисплей → Графіка → Параметри графіки за замовчуванням», після вмикання потрібне перезавантаження.
- Лише NVIDIA GeForce RTX: якщо гра не бачить такої карти, кнопка входу в режим неактивна. Тому на відеокартах AMD Radeon та Intel Arc режим PUBG Ally не запуститься, навіть якщо за потужністю й пам’яттю карта проходить мінімум.
Тут є деталь, яку легко пропустити. RTX 2080 Ti — карта покоління Turing (RTX 20), а документація Game Agent SDK вимагає Ampere або новішу, тобто RTX 30 і вище. Вимоги ACE-функцій різняться від гри до гри й від інструмента до інструмента, тож орієнтир «підходить будь-яка RTX» хибний. Нові ігри, зібрані на Game Agent SDK, найімовірніше успадкують поріг Ampere+, але це наша оцінка, а не заява NVIDIA.
Друга деталь — системна ОЗП. Рекомендація PUBG Ally піднімає планку до 24 ГБ: гра, розпізнавання мовлення, модель і синтез голосу разом споживають більше, ніж одна гра. Для апгрейду це найдешевший рядок: додати пам’ять зазвичай простіше, ніж міняти відеокарту.
Що з AMD та Intel. Офіційні ACE-функції працюють лише на GeForce RTX, і власникам Radeon чи Arc вони недоступні. Але це обмеження NVIDIA, а не технології: відкриті моделі на Radeon запускаються через ROCm або Vulkan, і для модів зі своїм локальним бекендом карта AMD підходить. Де Radeon у нейромережах зрівнявся з GeForce, а де ні, розібрано в матеріалі ROCm проти CUDA.
Просідання FPS із ШІ-NPC: модель і гра ділять одну відеокарту
Головний ризик для продуктивності — не «навантаження на NPU», а конкуренція за ту саму відеокарту. KRAFTON в інтерв’ю NVIDIA від 25 червня 2026 року прямо сказала, що PUBG «вже споживає значну частку пам’яті GPU», і тому модель Ally квантизували, щоб вона вмістилася «в залишковий запас VRAM». Це ключ до розуміння FPS в іграх із ШІ-NPC.
Просідання може прийти двома шляхами:
- Через пам’ять. Якщо моделі й грі разом бракує VRAM, драйвер витісняє частину даних у системну ОЗП. Доступ до них іде через шину PCIe, вона значно повільніша за власну пам’ять карти, і гра починає підгальмовувати: частішають фризи й падає мінімальний FPS.
- Через обчислення. Поки модель генерує відповідь, вона займає обчислювальні блоки тієї самої відеокарти. Для цього NVIDIA має In-Game Inferencing SDK, що розподіляє роботу ШІ та графіки, а PUBG вимагає увімкненого HAGS, щоб Windows точніше планувала завдання на GPU.
Скільки саме кадрів втрачається, публічно не виміряно: на 26 вересня 2026 року ми не знайшли незалежних тестів FPS з увімкненим і вимкненим PUBG Ally, а NVIDIA й KRAFTON таких цифр не публікували. Тому тут немає відсотків, лише механізм. Зробити замір у себе нескладно:
- увімкніть лічильник кадрів (оверлей GeForce або MSI Afterburner) і зіграйте той самий відрізок із ШІ-напарником і без нього;
- у «Диспетчері завдань» Windows на вкладці «Продуктивність → GPU» дивіться рядок «Виділена пам’ять GPU»: якщо вона впирається в обсяг карти, ШІ та грі тісно;
- за нестачі пам’яті насамперед знижуйте якість текстур — це найважчий для VRAM параметр;
- апскейлінг DLSS знижує навантаження на обчислення, але пам’ять під модель не звільняє. У самій PUBG підтримка DLSS 4.5 з’явилася лише з оновленням 43.1 від 9 вересня 2026 року, уже після бети Ally.
Чому NVIDIA і KRAFTON усе одно пішли в локальне виконання, а не в хмару. За словами KRAFTON, хмарні моделі виявилися надто повільними: «поєднання мережевої затримки й затримки інференсу часто робило відповіді надто повільними для живого командного зв’язку». Локальна модель прибирає шлях до сервера й назад, а платою за це стає відеопам’ять гравця.
Ігри з ШІ-NPC: де це вже працює у гравців
ШІ-NPC перестали бути обіцянкою: за даними NVIDIA (сторінка ACE for Games і анонс 13 березня 2025 року), функція вийшла щонайменше у трьох іграх і тестується ще в кількох. Більшість кириличних матеріалів про ШІ-NPC досі пишуть у майбутньому часі й без дат, хоча перші ігри з ШІ-NPC на ACE вийшли в березні 2025 року. Статус на 26 вересня 2026 року:
| Гра | Роль ШІ | Статус і дата | Що потрібно гравцеві |
|---|---|---|---|
| PUBG: Battlegrounds | напарниця Ella (технологія PUBG Ally) у режимі Ally Duo, мапа Sanhok | обмежена бета 17 червня – 1 липня 2026 року; у патчах 42.2–43.1 не поверталася | RTX 2080 Ti / RTX 3060 8 ГБ і вище, 16 ГБ ОЗП |
| inZOI | городяни Smart Zoi, що планують день і оцінюють свої вчинки | експериментальна опція з березня 2025 року | GeForce RTX |
| NARAKA: BLADEPOINT MOBILE PC VERSION | ШІ-напарник на пристрої | з березня 2025 року | GeForce RTX |
| Total War: PHARAOH | ШІ-радник, що шукає відповідь у 1200+ таблицях ігрових даних (RAG) | програма плейтесту у 2026 році | н/д |
| MIR5 (Wemade Next) | боси, які вчаться на тактиці гравця | заявлено NVIDIA | н/д |
| Dead Meat | допит підозрюваного, якому можна поставити будь-яке запитання | анонс на 2026 рік | н/д |
Обережно зі списками «ігор на ACE» в мережі. Коли ACE тільки запускали, NVIDIA називала студії, що взяли Audio2Face, — наприклад, GSC Game World для S.T.A.L.K.E.R. 2 і Fallen Leaf для Fort Solis. Audio2Face лише анімує обличчя за записаним звуком, розмовляти з такими персонажами не можна. Гра може використовувати одну частину ACE, а персонажі в ній лишаться повністю скриптовими.
Що цей список означає для заліза. PUBG Ally — єдиний випадок з опублікованими вимогами, і це найважчий варіант: голосове введення, модель на 2 млрд параметрів і синтез мовлення одночасно із шутером. inZOI та NARAKA використовують менші моделі, але точних вимог до VRAM для них NVIDIA не розкриває.
Моди для старих ігор: Mantella в Skyrim та її аналоги
Офіційний ACE — не єдиний спосіб поговорити з NPC. У Skyrim спільнота давно підключає мовні моделі до персонажів через моди Mantella, SkyrimNet і CHIM. Різниця з ACE принципова: мод не знає, яка у вас відеокарта, і не оптимізований NVIDIA, зате дає змогу обрати, де обчислюється модель.
Mantella — найвідоміший із них. За сторінкою мода на Nexus Mods (на 26 вересня 2026 року) він пов’язує розпізнавання мовлення, мовну модель і синтез голосу, дає власні описи понад 3000 персонажів, запам’ятовує минулі розмови й знає про події в грі. Моду потрібно близько 5 ГБ місця на диску та Windows 10 або 11. Моделі він підключає трьох видів: локальні, OpenRouter та OpenAI.
Звідси два шляхи щодо заліза:
- Хмарний API. Під час налаштування Mantella за замовчуванням пропонує OpenRouter: безплатні моделі там доступні в межах 50 запитів на день, а після поповнення рахунку на $10 — 1000 (правила OpenRouter на 26 вересня 2026 року), платні моделі оплачуються з передоплачених кредитів. Відеокарта в цьому режимі майже не навантажується: модель обчислюється на сервері. У FAQ мода на Nexus Mods автори посилаються на демонстраційне відео, записане на ноутбуці без відеокарти. Ціна — затримка інтернету, ліміти й те, що ваші репліки йдуть сторонньому сервісу.
- Локальний бекенд. Модель запускається на своєму ПК через KoboldCpp, Ollama, LM Studio або llama.cpp. У журналі змін CHIM прямо записано розширення локального налаштування саме під ці чотири середовища. Тоді діє той самий принцип, що й в ACE, лише без оптимізацій NVIDIA. Учасник r/skyrimmods сформулював його так: «те, що можна ганяти локально, дуже залежить від вашої відеокарти, бо все ШІ-навантаження йде поверх самої гри».
Для локального шляху корисно пам’ятати цифри з таблиці вище: модель на 4 млрд параметрів у 4 бітах — це близько 4 ГБ відеопам’яті, 7-мільярдна — близько 4,2 ГБ в академічному замірі. Якщо хочеться зрозуміти, як узагалі підняти таку модель на своєму ПК, почніть із розбору Qwen3 на своєму ПК: це споріднена родина моделі за замовчуванням у Game Agent SDK (Qwen3.5). Далі працює той самий розрахунок бюджету, що й вище: що менше відеопам’яті займає сама гра з усіма модами на графіку, то більше місця лишається моделі.
Чи потрібно апгрейдити ПК заради ШІ-NPC
Для більшості гравців — ні. На вересень 2026 року ШІ-NPC — це завершена двотижнева бета в PUBG (у патч-нотатках 42.2 від 14 липня, 42.3 від 11 серпня та 43.1 від 9 вересня 2026 року режим Ally Duo не повертався), експериментальна опція inZOI, напарник у NARAKA і кілька анонсів. Якщо у вас уже є GeForce RTX 3060 або потужніша карта з 8 ГБ відеопам’яті (RTX 3050 до мінімуму PUBG Ally не входить) і 16 ГБ ОЗП, мінімум найвибагливішої з випущених реалізацій закрито. Залізо розумно обирати під ігри, у які ви граєте, а ШІ-NPC поки йде бонусом.
Де ваша карта відносно вимог PUBG Ally і скільки відеопам’яті лишиться грі, якщо поруч працює модель розміром із модель за замовчуванням із Game Agent SDK (близько 3,8 ГБ). Обсяги VRAM — за специфікаціями NVIDIA, залишок — наш спрощений розрахунок:
| Карта | VRAM | Місце у вимогах PUBG Ally | Лишається грі після моделі ≈3,8 ГБ | Що це означає |
|---|---|---|---|---|
| RTX 3050 8 ГБ | 8 ГБ | нижче мінімуму, у списку немає | ≈4,2 ГБ | офіційний режим не розрахований на цю карту; моди через хмару працюють |
| RTX 2080 Ti | 11 ГБ | мінімум | ≈7,2 ГБ | Ally пускає, але Game Agent SDK вимагає Ampere і новіші |
| RTX 3060 8 ГБ | 8 ГБ | мінімум | ≈4,2 ГБ | мінімум закрито, текстури доведеться знижувати |
| RTX 3060 12 ГБ | 12 ГБ | мінімум | ≈8,2 ГБ | запас за пам’яттю, але не за продуктивністю |
| RTX 4060 | 8 ГБ | прямо не названа, не слабша за RTX 3060 | ≈4,2 ГБ | як у RTX 3060 8 ГБ: працює, але впритул |
| RTX 4070 | 12 ГБ | рекомендація | ≈8,2 ГБ | апгрейд не потрібен |
| RTX 4070 Ti Super, RTX 4080, RTX 5080 | 16 ГБ | вище рекомендації | ≈12,2 ГБ | модель майже не заважає грі |
Три застереження до таблиці. PUBG Ally має власну модель на 2 млрд параметрів, і скільки відеопам’яті вона займає окремо, KRAFTON не публікує, тож стовпець залишку — орієнтир, а не замір. Для RTX 20-ї серії висновок про майбутнє — наша оцінка за вимогами SDK, а не заява NVIDIA: ігри на Game Agent SDK такі карти, найпевніше, не підтримуватимуть. І навіть із запасом відеопам’яті рекомендація Ally вимагає 24 ГБ системної ОЗП, тож власникові потужної карти з 16 ГБ ОЗП дешевше додати пам’ять, ніж думати про нову відеокарту.
Якщо дискретної GeForce RTX немає зовсім:
- GTX, Radeon, Intel Arc. Офіційні ACE-функції недоступні. Лишаються моди з хмарним API або локальний бекенд на ROCm/Vulkan.
- Ноутбук Copilot+ PC з NPU без дискретної RTX. NPU для ШІ-NPC не допоможе; моди через хмару працюватимуть.
Якщо ви все одно обираєте нову відеокарту й хочете запас під ШІ в іграх і поза ними, вважайте обсяг відеопам’яті головним параметром: 12 ГБ — розумна середина, 16 ГБ — спокійний запас. Як підібрати залізо під локальні моделі повністю, від відеокарти до міні-ПК, ми зібрали в гіді з вибору заліза для локального ШІ.
Ризики ШІ-персонажів: галюцинації, зрив занурення, приватність
Залізо — не єдине, що може піти не так. Генеративні персонажі мають свої слабкі місця, і їх задокументовано в наукових роботах, а не лише у відгуках гравців.
- Галюцинації та зрив занурення. В експериментах із генеративними NPC (International Journal of Human–Computer Interaction, 2026) помилки розпізнавання мовлення, збої черговості реплік і вигадані ШІ факти швидко руйнували відчуття занурення. Персонаж, який упевнено каже неправду, дратує сильніше за скриптового.
- Ризики, успадковані від базових моделей. Огляд 53 ШІ-нативних ігор (arXiv:2607.00527) перелічує упередженість, токсичність, галюцинації, витоки приватних даних і вразливість до спеціально підібраних промптів. Гравець може «зламати» персонажа словами, якщо гра не обмежує модель.
- Затримка відповіді. Навіть на власній відеокарті повна відповідь 7-мільярдної моделі в академічному замірі тривала 5,49 секунди. У бою це вічність, тому KRAFTON і залишила реакцію дереву поведінки, а моделі — лише розмову.
- Приватність голосу. В ACE мовлення розпізнається й обробляється на вашому ПК, без відправлення на сервер. У модах із хмарним API репліки йдуть сторонньому сервісу, і це варто враховувати, якщо ви говорите з NPC голосом.
- Нестача відеопам’яті. На 8-гігабайтних картах модель забирає майже половину VRAM, і саме звідси беруться фризи, а не зі «слабкого NPU».
Як із цим дають раду найкращі реалізації. PUBG Ally працює в закритому світі: одна мапа Sanhok, один режим і фіксований список предметів, а всі факти персонаж перевіряє через рушій. Так галюцинація не перетворюється на брехню про стан матчу.
Що застаріє першим. Список ігор і їхні вимоги: PUBG Ally поки пройшов лише обмежену бету (у патч-нотатках 42.2, 42.3 і 43.1 режим не повертався, перевірено 26 вересня 2026 року), і з постійним запуском вимоги можуть змінитися, а Game Agent SDK теж у беті. Свіжий статус дивіться на офіційній сторінці NVIDIA ACE і в патч-нотатках конкретної гри.
Часті запитання про залізо для ШІ-NPC
Чи вистачить RTX 3060 8 ГБ для ігор із ШІ-NPC?
Так, для PUBG Ally RTX 3060 з 8 ГБ входить в офіційний мінімум разом із 16 ГБ системної ОЗП (патч-нотатки PUBG, червень 2026 року). Запасу при цьому немає: модель займає помітну частину відеопам’яті, і грі лишиться приблизно половина з 8 ГБ. Розраховуйте на середні текстури й перевіряйте завантаження VRAM у «Диспетчері завдань».
Чи потрібен ноутбук з NPU, щоб грати із ШІ-NPC?
Ні. Жодна гра зі списку NVIDIA ACE не використовує NPU: діалоги NPC обчислює відеокарта GeForce RTX. Поріг 40+ TOPS — вимога Microsoft до ноутбуків Copilot+ PC для функцій Windows на кшталт Recall і Live Captions. Для ШІ-NPC в іграх важливіша дискретна RTX з достатнім обсягом відеопам’яті.
Скільки оперативної пам’яті потрібно для ігор із ШІ-напарником?
За патч-нотатками PUBG (червень 2026 року) для режиму Ally Duo мінімум — 16 ГБ системної ОЗП, рекомендовано 24 ГБ. Це більше, ніж зазвичай для однієї гри: поруч із нею працюють розпізнавання мовлення, мовна модель і синтез голосу. Якщо відеокарта вже тягне рекомендацію, додати оперативну пам’ять — найдешевший апгрейд.
Чи працює NVIDIA ACE на відеокартах AMD або Intel?
Офіційні ACE-функції в іграх розраховані лише на GeForce RTX: PUBG Ally на картах AMD Radeon та Intel Arc не запускається, а Game Agent SDK вимагає CUDA 12.8 та архітектуру Ampere або новішу. Власникам AMD та Intel лишаються моди на кшталт Mantella з хмарним API або локальною моделлю через ROCm чи Vulkan.
Чи можна використати відкриті моделі для свого ШІ-NPC?
Так. Сама NVIDIA кладе в Game Agent SDK відкриту Qwen3.5-4B, а SDK поширюється за ліцензією Apache 2.0. Академічна робота Орхуського університету показала NPC на відкритій Mistral-7B, якій вистачило близько 4,2 ГБ відеопам’яті на RTX 2070 Super 8 ГБ. Моди для Skyrim підключають моделі через Ollama, KoboldCpp або LM Studio.
