Коротко: чи потрібен ноутбук з NPU і що сталося з Copilot+ PC
AI PC з NPU — це ноутбук, у процесор якого вбудовано окремий блок для нейромережевих обчислень. У травні 2024 року Microsoft перетворила цей блок на перепустку: лише машини з NPU від 40 TOPS отримували марку Copilot+ PC і набір локальних функцій Windows. У вересні 2026 року з’ясувалося, що саму марку тихо прибирають, а вимоги до заліза лишаються.
- Коротко: чи потрібен ноутбук з NPU і що сталося з Copilot+ PC
- Що таке NPU і чим він відрізняється від CPU та GPU
- Поріг 40 TOPS: що таке Copilot+ PC і що він гарантує
- Скільки TOPS у NPU в Snapdragon, Intel і AMD
- Чи може NPU замінити відеокарту для локальних нейромереж
- Чому Microsoft відмовляється від бренду Copilot+ PC
- Частка AI PC на ринку: чому цифри аналітиків розходяться
- Кому потрібен ноутбук з потужним NPU, а кому це переплата
- Ризики AI PC: приватність Recall, TOPS-маркетинг і слабкий попит
- Часті запитання про NPU і AI PC
Головне, що варто знати до покупки:
- 40 TOPS — це перепустка до функцій Windows, а не рейтинг швидкості ШІ. Поріг відкриває Recall, живі субтитри з перекладом та ефекти камери. Про швидкість локальної мовної моделі він не каже майже нічого.
- Швидкість локальної LLM упирається в пропускну здатність пам’яті. У Snapdragon X2 Elite кількість TOPS зросла на 78% порівняно з X Elite, а смуга пам’яті — лише на 13%. Стеля генерації тексту зсунулася приблизно на ті самі 13%.
- Популярні програми для локальних моделей NPU за замовчуванням не чіпають. Ollama, llama.cpp і LM Studio працюють на вбудованій графіці або процесорі.
- Бренд Copilot+ PC зникає. Нові Surface Pro 12″ і Surface Laptop 13″, за словами віцепрезидента Microsoft із Surface Бретта Острума, вимогам відповідають, але так уже не називаються.
- Оцінки частки AI PC в аналітиків помітно розходяться: за 2025 рік — від 31% (Gartner) до 39% (Counterpoint), у прогнозі на 2026-й — від «понад половину» до 59%, бо «AI PC» кожен визначає по-своєму.
Висновок: потужний NPU корисний тим, хто працює від батареї, часто має відеодзвінки й користується вбудованими функціями Windows. Якщо мета — запускати великі нейромережі в себе, дивитися треба на обсяг і швидкість пам’яті, а не на цифру TOPS на коробці.
Що таке NPU і чим він відрізняється від CPU та GPU
NPU (Neural Processing Unit, нейропроцесор) — це спеціалізований прискорювач для математики нейромереж. Він уміє одне: швидко й ощадливо перемножувати великі таблиці чисел, з яких складаються моделі. Так його описують і IBM, і Вікіпедія: клас апаратних прискорювачів для завдань штучного інтелекту та машинного навчання.
Зручна аналогія — кухня ресторану. Процесор (CPU) — шеф, який уміє все, але готує по одній страві. Відеокарта (GPU) — велика бригада кухарів: сотні простих операцій одночасно, зате багато споживає. NPU — автомат для однієї конкретної страви. Меню в нього вузьке, але цю страву він робить швидше й майже без витрат енергії.
Економія досягається ціною точності. NPU обчислює в «грубих» цілих числах — INT8 та INT4, тобто 8 і 4 біти на число замість 16 або 32. Для розпізнавання мовлення чи розмиття фону такої точності вистачає, а енергії йде в рази менше. Microsoft у документації для розробників прямо пише: багато NPU підтримують лише цілочисельну математику, тож моделі перед запуском доводиться конвертувати та квантувати.
| Блок | У чому сильний | Слабке місце | Типові завдання в ноутбуці |
|---|---|---|---|
| CPU | Будь-який код, складна логіка | Мало паралельних обчислень | Система, браузер, офіс |
| GPU | Тисячі операцій паралельно, швидка пам’ять | Високе енергоспоживання | Ігри, рендер, великі LLM |
| NPU | Нейромережева математика на мінімальному живленні | Вузький набір операцій, потрібні конвертовані моделі | Шумодав, субтитри, ефекти камери, малі моделі |
Важлива деталь: NPU не замінює інші блоки, а працює разом із ними. За описом Microsoft, Windows 11 сама розподіляє завдання туди, де воно виконається швидше й економніше. Академічний бенчмарк на arXiv показав ту саму картину: NPU виграє в GPU на одних операціях (множення матриці на вектор — на 58,6% швидше), а на звичайному множенні матриць попереду відеокарта. Універсального переможця немає — є розподіл праці.
Поріг 40 TOPS: що таке Copilot+ PC і що він гарантує
Copilot+ PC — це категорія Windows-ноутбуків, яку Microsoft запровадила у 2024 році з жорстким мінімумом щодо заліза. Офіційна сторінка Microsoft для розробників Copilot+ PC описує її як новий клас пристроїв на Windows 11 з NPU, що виконує понад 40 трлн операцій на секунду. Повний перелік вимог, який дублює PCWorld:
- NPU продуктивністю від 40 TOPS;
- щонайменше 16 ГБ оперативної пам’яті;
- SSD від 256 ГБ;
- Windows 11 версії 24H2 або новіша.
TOPS (trillions of operations per second) — трильйони операцій на секунду. Це пікова теоретична швидкість блока на цілих числах INT8. Цифра зручна, щоб порівняти два NPU на одному й тому самому завданні. Для реальної швидкості конкретної програми вона майже нічого не означає, і далі стане зрозуміло чому.
Що саме відкриває поріг у 40 TOPS? За зведенням Digital Applied та описами виробників, на NPU працюють вбудовані функції Windows:
- Recall — пошук в історії екрана: система робить знімки й будує за ними локальний індекс;
- Live Captions — субтитри до будь-якого звуку з перекладом у реальному часі;
- Windows Studio Effects — розмиття фону, корекція погляду, шумозаглушення для вебкамери й мікрофона;
- Click to Do і функції переписування тексту на вбудованій малій моделі Phi Silica.
Виходить, що поріг у 40 TOPS для NPU в AI PC — це вимикач конкретного набору функцій, а не мірило швидкості. Ноутбук нижче порогу просто не отримає частину з них, навіть якщо його відеокарта в рази потужніша. Навпаки теж працює: ноутбук на 45 чи 80 TOPS не стане від цього швидшим у тих програмах, які NPU не використовують.
Скільки TOPS у NPU в Snapdragon, Intel і AMD
Головна пастка під час читання специфікацій — дві різні цифри. NPU TOPS — продуктивність лише нейропроцесора. Overall TOPS (або Platform TOPS) — сума NPU, відеоядра й процесора. Друга завжди більша й частіше потрапляє в рекламу, але функції Copilot+ працюють саме на NPU, тож для них важить перша.
| Чип | NPU, TOPS | Уся платформа, TOPS | Пам’ять | Джерело |
|---|---|---|---|---|
| Qualcomm Snapdragon X Elite | до 45 | н/д | LPDDR5x, до 135 ГБ/с | Qualcomm |
| Qualcomm Snapdragon X2 Elite / X2 Plus | 80 | н/д | LPDDR5x, до 152 ГБ/с | Qualcomm |
| Intel Core Ultra 5 228V (Lunar Lake) | 40 | 97 | LPDDR5X-8533, до 32 ГБ | Intel ARK |
| Intel Core Ultra 7 258V / Ultra 9 288V | 47 / 48 | 115 / 120 | LPDDR5X-8533, до 32 ГБ | Intel ARK, Digital Applied |
| AMD Ryzen AI 9 HX 370 (Strix Point) | до 50 | до 80 | DDR5-5600 або LPDDR5X-8000 | AMD, TechPowerUp |
Приклад Intel добре показує, з чого складається «велика» цифра. У Core Ultra 5 228V, за даними Intel ARK, NPU дає 40 TOPS, вбудована графіка Arc 130V — 53 TOPS, а загалом платформу заявлено на 97 TOPS. NPU і графіка разом дають 93 з 97 «платформних» TOPS, решта — процесор. Скласти три блоки в одну цифру зручно для слайда, але в реальній програмі завдання зазвичай розв’язує якийсь один із них. Те саме в AMD: на офіційній сторінці Ryzen AI 9 HX 370 поруч стоять 50 TOPS у NPU і 80 TOPS у всієї платформи.
Друга пастка — розкид усередині однієї лінійки. У сімействі Intel Lunar Lake молодший 228V тримає рівно 40 TOPS на NPU, а старші 258V і 288V, за даними Intel ARK, — 47 і 48 TOPS. Напис «Intel AI PC з NPU» на ціннику не каже, який із чипів усередині, тому модель процесора варто звіряти за специфікацією ноутбука. Ще наочніше це видно на міні-ПК: Lenovo Yoga AI Mini PC обіцяє «до 180 TOPS», але це сума процесора, графіки й NPU, а не потужність одного блока.
AMD має свою особливість: NPU XDNA 2 в її AI PC, за даними Digital Applied, — єдиний із масових, що тримає заявлені 50 TOPS не лише в INT8, а й у форматі Block FP16. Це запас для моделей, яким потрібна вища точність. Практичний розбір цього чипа під локальні моделі є в нашому огляді Ryzen AI 9 HX 370 для локального ШІ.
Чи може NPU замінити відеокарту для локальних нейромереж
Коротка відповідь — ні, і не тому, що NPU слабкий. Генерація тексту в мовній моделі впирається не в обчислення, а в пам’ять: на кожному кроці модель знову прочитує свої ваги. Тому швидкість у токенах на секунду обмежена формулою «пропускна здатність пам’яті, поділена на розмір моделі». TOPS у цю формулу не входить узагалі.
Чому швидкість LLM залежить від пам’яті, а не від TOPS
Візьмімо популярну модель на 8 млрд параметрів, стиснуту до 4 біт. У пам’яті вона займає близько 4,5 ГБ. Теоретична стеля швидкості — смуга пам’яті, поділена на 4,5 ГБ. Методику наводить Digital Applied; для чипів Intel і AMD ми дорахували смугу самі зі швидкості пам’яті та ширини шини в 128 біт (16 байт за одну передачу даних).
| Платформа | NPU, TOPS | Смуга пам’яті | Стеля для 8B у 4 бітах |
|---|---|---|---|
| Snapdragon X Elite | 45 | 135 ГБ/с | близько 30 токенів/с |
| Snapdragon X2 Elite / X2 Plus | 80 | 152 ГБ/с | близько 34 токенів/с |
| Intel Core Ultra 5 228V | 40 | близько 136 ГБ/с (розрахунок) | близько 30 токенів/с |
| AMD Ryzen AI 9 HX 370, LPDDR5X-8000 | 50 | 128 ГБ/с (розрахунок) | близько 28 токенів/с |
| AMD Ryzen AI 9 HX 370, LPDDR5X-7500 | 50 | 120 ГБ/с (розрахунок) | близько 27 токенів/с |
| AMD Ryzen AI 9 HX 370, DDR5-5600 | 50 | 89,6 ГБ/с (TechPowerUp) | близько 20 токенів/с |
| AMD Ryzen AI Max+ 395 | 50 | близько 256 ГБ/с | близько 57 токенів/с |
Таблиця показує головне. Чотири ноутбучні чипи зі швидкою пам’яттю LPDDR5X і розкидом NPU від 40 до 80 TOPS упираються приблизно в ту саму стелю — 27–34 токени на секунду. У ноутбуках з HX 370 часто стоїть LPDDR5X-7500, а не максимальна 8000, тому для них ми додали окремий рядок. Єдиний помітний стрибок дає Ryzen AI Max+ 395, і річ не в його NPU (ті самі 50 TOPS), а у вдвічі ширшій шині пам’яті. У Snapdragon X2 Elite TOPS зросли з 45 до 80, тобто на 78%, а стеля генерації — лише на 13%, рівно на приріст смуги пам’яті.
Це саме стеля, а не обіцяна швидкість. Реальні цифри нижчі: заважають службові витрати програми, контекст та обробка запиту. У нашому огляді HX 370 незалежний замір моделі Qwen3-8B у тому самому 4-бітному форматі дав близько 13,4 токена на секунду — помітно нижче за теоретичну межу. Ще одна деталь із тієї ж таблиці: в одного й того самого AMD Ryzen AI 9 HX 370 вибір пам’яті змінює стелю сильніше (20 проти 28 токенів на секунду), ніж різниця в TOPS між Snapdragon X Elite та X2 Elite (30 проти 34).
Ollama, llama.cpp і LM Studio за замовчуванням оминають NPU
Друга причина, чому NPU не допомагає з локальними моделями, — програмна. За даними Digital Applied на середину 2026 року, найпопулярніші програми для локальних LLM — Ollama, llama.cpp і LM Studio — відправляють обчислення на вбудовану графіку (через Vulkan, ROCm або Metal) чи на процесор. NPU вони за замовчуванням не використовують.
Причина у форматі. Ці програми працюють із моделями GGUF, а NPU потрібна модель, окремо сконвертована в ONNX і зібрана під «провайдер» конкретного виробника: QNN у Qualcomm, OpenVINO в Intel. Microsoft радить розробникам звертатися до NPU через Windows ML — цей прошарок сам обирає відповідний провайдер і за потреби відкочується на GPU або CPU. Шлях робочий, але це спеціалізована доріжка для розробників, а не кнопка «пришвидшити» в Ollama. Якщо ви завантажили модель з Hugging Face і запустили її в LM Studio, NPU простоює, скільки б TOPS не було на коробці. Як самі ці програми різняться за швидкістю на одній моделі, ми розбирали в порівнянні Ollama, LM Studio і llama.cpp.
Цей пункт застаріє першим. Підтримка NPU в популярних програмах — рухома ціль, і за пів року картина може змінитися. Перед покупкою заради конкретної програми варто відкрити її список змін і перевірити, чи з’явився там бекенд для NPU вашого виробника.
Де NPU в локальному ШІ все ж корисний
Усе сказане не робить NPU марним. Це чудовий блок для малих моделей, які працюють постійно й у фоні. За зведенням Digital Applied, через спеціалізовані набори інструментів на Snapdragon X Elite запускаються моделі приблизно до 4 млрд параметрів. На NPU також працює вбудована у Windows мала модель Phi Silica — на ній тримаються дії Click to Do на кшталт «переписати» та «коротко переказати». Сюди ж належать шумозаглушення під час дзвінків, локальне розшифрування мовлення й субтитри — завдання, де важливіші тиша кулера й заряд батареї, ніж пікова швидкість.
Для великих моделей логіка інша. Скільки пам’яті реально потрібно під модель і контекст, розраховуємо в розборі відеопам’яті під LLM. А приклад ноутбучного чипа, який тягне моделі на 70 млрд параметрів завдяки вбудованій графіці й широкій пам’яті, — Ryzen AI Max+ 395. На ньому добре видно, як в AI PC ділять роботу NPU і GPU: великі моделі обчислює графіка, а не нейропроцесор.
Чому Microsoft відмовляється від бренду Copilot+ PC
У нових Surface Pro 12″ і Surface Laptop 13″, що вийшли у 2026 році, у назвах немає слів «Copilot+ PC». Судячи зі специфікацій, які TechAeris опублікував 23 вересня 2026 року, оновлені версії побудовано на Snapdragon X2 Plus з NPU на 80 TOPS і 16 або 24 ГБ пам’яті, тобто планку вони проходять із запасом. На Snapdragon Summit у вересні 2026 року представники Microsoft і Qualcomm пояснили Windows Central, чому наліпки немає. Видання запитало про це корпоративного віцепрезидента Microsoft із Surface Бретта Острума. Відповідь, опубліковану Windows Central, наводимо дослівно:
«Ці пристрої не називаються Copilot+ PC. Вони відповідають усім вимогам нашої попередньої планки для пристроїв Copilot+. Ми й далі робимо ставку на ШІ на пристрої та гібридну схему».
Старший віцепрезидент Qualcomm з обчислень та ігор Кедар Кондап у тому самому матеріалі сформулював суть: Copilot+ PC був потрібен, щоб окреслити категорію пристроїв з певною планкою, наприклад NPU на 45 TOPS, а тепер ті самі можливості пропонуватимуть, найімовірніше, уже без цієї назви. PCWorld, TechSpot і TechAeris підхопили новину 25 вересня 2026 року.
Підсумок важливий для покупця: назва зникає, специфікація лишається. Функції, прив’язані до NPU від 40 TOPS, і далі працюють на нових ноутбуках без наліпки. Схожу долю мала етикетка Ultrabook: слово зникло з реклами, а тонкий легкий ноутбук просто став звичайним класом пристроїв.
Чому бренд не прижився — три причини називають видання, четверта — наше трактування:
- Провальний старт. Головна функція категорії, Recall, на анонсі у 2024 році отримала хвилю критики від дослідників безпеки: базу знімків екрана зберігали в незашифрованому вигляді. Microsoft відклала запуск, і перші Copilot+ PC вийшли без своєї головної функції.
- Покупці обирали не через ШІ. За оцінкою TechSpot, AI PC продавалися тому, що людям був потрібен новий комп’ютер, а NPU просто опинився всередині. За даними того ж видання, у червні 2026 року Microsoft випустила дешевші Surface Pro 12″ і Surface Laptop 13″ з 8 ГБ пам’яті на першому Snapdragon X Plus — під стару планку в 16 ГБ вони не проходять. Словам Острума це не суперечить: в інтерв’ю йшлося про нові версії на X2 Plus, але під час купівлі Surface обсяг пам’яті варто звіряти в конкретній комплектації.
- Партнери тримають дистанцію. NVIDIA не використовує марку Copilot+ PC для майбутньої платформи RTX Spark, хоча, за словами Windows Central, усі такі ПК вимогам відповідають.
- Слово «Copilot» втратило вагу. Паралельно слабко продається й платний програмний Microsoft 365 Copilot — це окремий продукт, але з тим самим ім’ям.
Частка AI PC на ринку: чому цифри аналітиків розходяться
Якщо запитати трьох аналітиків, скільки на ринку AI PC, вийде три різні відповіді. Це не помилка даних, а різні визначення: одні зараховують до AI PC будь-який ПК з NPU, інші — лише з NPU чи графікою вище певної кількості TOPS.
| Аналітик | Дата оцінки | Як рахують | 2025 | 2026 |
|---|---|---|---|---|
| Gartner | 28 серпня 2025 | ПК зі ШІ в залізі й софті (виділений NPU) | 31% поставок, 77,8 млн шт. | понад 50% продажів (прогноз) |
| Counterpoint Research | 8 вересня 2025 | «AI-Advanced PC»: NPU або GPU вище базового рівня TOPS | близько 39% | близько 59% (прогноз) |
| Omdia | кінець 2025 | «AI-capable PC»; точне визначення у відкритому переказі не розкрито | н/д | близько 50% з 276 млн шт. (прогноз) |
Як читати цю таблицю. Gartner бере широке визначення, але власні очікування вже знижував: у вересні 2024 року компанія прогнозувала 43% на 2025 рік, а в серпні 2025-го скоригувала оцінку до 31%, пославшись на мита й паузу в закупівлях. Counterpoint виокремлює категорію «AI-Advanced PC» — окремо від AI-basic та AI-capable — і за нею дає найвищу цифру з трьох. Прогноз Omdia відомий з переказу звіту аналітиком компанії в LinkedIn, повна методика — у самому звіті, у відкритий доступ вона не потрапила.
Є й деталь, якої в цих прогнозах немає. Усі три зроблено у 2025 році — до того, як ринок накрив дефіцит пам’яті. У червні 2026 року IDC прогнозувала падіння світових поставок ПК на 11,3% за рік і зростання середньої ціни на 17%. Отже, «стабільні 276 млн штук» із прогнозу Omdia на 2026 рік уже не виглядають реалістично, а частка AI PC може зростати просто тому, що старих моделей без NPU стає менше, а не тому, що їх обирають заради ШІ. Відсоток поставок тут описує асортимент, а не попит на функції.
Кому потрібен ноутбук з потужним NPU, а кому це переплата
Відповідь залежить від завдання. Ми не тестували ці ноутбуки самі, тож матрицю нижче побудовано на специфікаціях виробників та опублікованих розрахунках, а не на власних замірах.
| Сценарій | Чи потрібен сильний NPU | На що дивитися насамперед |
|---|---|---|
| Офіс, навчання, часті відеодзвінки | Так, це його профіль | NPU від 40 TOPS, 16 ГБ пам’яті, автономність |
| Субтитри, переклад, розшифрування зустрічей | Так | Підтримка Live Captions, NPU від 40 TOPS |
| Локальні моделі до 8 млрд параметрів | Радше ні | Смуга пам’яті й обсяг ОЗП, якість вбудованої графіки |
| Моделі на 30–70 млрд параметрів | Ні | 64–128 ГБ швидкої пам’яті або дискретна відеокарта |
| Ігри, монтаж, 3D | Ні | Відеокарта, охолодження, процесор |
Щоб перевірити конкретну модель ноутбука, вистачить чотирьох кроків:
- Знайдіть точну модель процесора, а не напис AI PC на коробці: 228V і 288V — один бренд, але різні NPU.
- Дивіться NPU TOPS, а не Overall TOPS. Для функцій Windows важлива лише перша цифра, і вона має бути від 40.
- Перевірте тип і швидкість пам’яті. LPDDR5X-8000 і вище дає помітно більшу смугу, ніж DDR5-5600, а в Lunar Lake максимум 32 ГБ розпаяної пам’яті без апгрейду.
- Вирішіть, які функції вам потрібні. Якщо Recall, субтитри й ефекти камери не цікаві, переплата за NPU майже нічого не дасть.
Про «запас на майбутнє» варто думати тверезо. Поріг 40 TOPS зберігається, а Microsoft, за даними Digital Applied, поступово відкриває свою платформу Microsoft Foundry on Windows (колишня Windows AI Foundry) для GPU і CPU, а не лише для NPU. Отже, майбутні функції Windows навряд чи вимагатимуть більше TOPS так само різко, як у 2024 році.
Ризики AI PC: приватність Recall, TOPS-маркетинг і слабкий попит
Категорія AI PC має реальні слабкі місця, і про них варто знати заздалегідь.
- Приватність Recall. Функція робить знімки активного вікна й будує за ними індекс. Після скандалу 2024 року Microsoft її переробила: за документацією Microsoft, знімки тепер зберігаються лише за згодою користувача, дані шифруються, для доступу потрібна автентифікація Windows Hello. У корпоративній Windows 11 її можна заборонити політиками. Ризик перейшов із розряду «діра» в розряд «усвідомлений вибір», але довіра відновлюється повільно.
- Плутанина з TOPS. Написи на кшталт «80 TOPS» чи «180 TOPS» часто описують усю платформу. Покупець, який порівнює ноутбуки за цією цифрою, порівнює рекламу, а не можливості NPU.
- Обіцянки щодо локальних нейромереж. Реклама «NPU для локального ШІ» без застереження про конвертацію моделей вводить в оману: популярні програми NPU не використовують.
- Слабкий попит. Ще в січні 2026 року на CES продуктовий директор Dell Кевін Тервіллігер, за даними Windows Central з посиланням на PC Gamer, сказав, що покупці не обирають ноутбук через ШІ, а саме слово «ШІ» їх радше плутає. Для покупця це означає одне: платити «ШІ-націнку» не обов’язково.
- Контекст бренду Copilot. За даними The Register у переказі TechRadar, станом на лютий 2026 року з користувачів Microsoft 365 та Office 365, які відкривають Copilot Chat, платять за Copilot лише 3,3%. Це окремий програмний продукт, але слабкий попит на нього б’є по всьому, що має ім’я Copilot.
Водночас корисна частина в AI PC є. Шумозаглушення й ефекти камери на NPU не навантажують процесор, субтитри з перекладом працюють без інтернету, а тихий кулер під час дзвінка — це реальна зручність. Проблема категорії не в залізі, а в тому, що його продавали під гучною маркою, яка обіцяла більше, ніж давали функції.
Часті запитання про NPU і AI PC
Чи потрібен NPU, якщо я не користуюся функціями Copilot+ PC?
Майже не потрібен. NPU в ноутбуці пришвидшує насамперед вбудовані функції Windows: Recall, живі субтитри, ефекти камери, переписування тексту. Якщо вони вам не цікаві, вигода зводиться до тихішої роботи застосунків для дзвінків, які вміють віддавати шумозаглушення на NPU. Переплачувати за найвищий показник TOPS у такому разі мало сенсу: розумніше вкластися в пам’ять, екран чи батарею.
Чи можна запускати Ollama або LM Studio на NPU ноутбука?
За замовчуванням ні. На середину 2026 року Ollama, llama.cpp і LM Studio працюють на вбудованій графіці або процесорі, а NPU простоює. Щоб задіяти нейропроцесор, модель треба окремо конвертувати в ONNX і запускати через провайдер виробника (QNN у Qualcomm, OpenVINO в Intel). Це шлях для розробників: через спеціалізовані набори інструментів виробників на NPU запускають моделі приблизно до 4 млрд параметрів, а не звичні GGUF-файли.
Чим NPU TOPS відрізняється від Overall TOPS на коробці?
NPU TOPS — продуктивність лише нейропроцесора. Overall TOPS, або Platform TOPS, — сума NPU, відеоядра й центрального процесора. Наприклад, у Intel Core Ultra 5 228V NPU дає 40 TOPS, графіка — 53 TOPS, а платформу заявлено на 97. Функції Copilot+ працюють на NPU, тому для порогу в 40 TOPS враховується лише перша цифра.
Що буде з уже купленими Copilot+ PC?
Нічого поганого. Microsoft прибирає маркетингову назву, а не вимоги до заліза й не функції. За словами Бретта Острума, нові Surface відповідають «попередній планці» Copilot+, і можливості пропонуються ті самі. Recall, живі субтитри й ефекти камери на ноутбуках з NPU від 40 TOPS і далі працюють у складі Windows 11, як і раніше.
Чи варто доплачувати за максимальні TOPS заради майбутнього?
Як правило, ні. Для функцій Windows достатньо планки в 40 TOPS, а для локальних мовних моделей важливіші смуга й обсяг пам’яті: Snapdragon X2 Elite з 80 TOPS дає лише близько 13% приросту стелі генерації порівняно з X Elite з 45 TOPS. Платформа Microsoft до того ж відкривається для GPU і CPU, тож гонитва за TOPS навряд чи окупиться.
