Два міні-ПК замість хмарних API: як локальний ШІ економить на токенах
Журналіст Tom's Hardware переніс до двох третин ШІ-задач на пару міні-ПК з Ryzen AI Max+ 395, прокачуючи до 80 млн токенів на день. Коли це справді виправдано.
Gemma 3 і Gemma 4 на своєму ПК: найкраща модель під одну відеокарту
Огляд Gemma для локального запуску у 2026: лінійки 3 і 4, таблиця VRAM за квантами, QAT-кванти Google, мультимодальність, ліцензія Apache 2.0 та українська мова.
Mac Mini M4 Pro для нейромереж: найдешевший вхід у локальний ШІ
Mac Mini M4 Pro — найдешевший вхід у локальні LLM на єдиній пам'яті. Що влазить за RAM, реальні tok/s, ціна і де він поступається Strix Halo та Mac Studio.
Z.ai випустила GLM-5.2 з відкритими вагами: 753B параметрів, контекст 1M і ліцензія MIT
Z.ai (колишня Zhipu) випустила GLM-5.2 — відкриту MoE-модель на 753 млрд параметрів з контекстом 1M і ліцензією MIT. Заявлено, що обходить GPT-5.5 у коді.
DeepSeek-R1 на своєму ПК: модель, що міркує, через дистиляти
Як запустити DeepSeek-R1 локально у 2026: чому 671B не для дому, який дистилят обрати під VRAM, таблиця швидкості, ліцензія MIT і чесно про цензуру.
Qwen3 на своєму ПК: чому це «модель за замовчуванням» для локального ШІ
Огляд Qwen3 для локального запуску у 2026: лінійка моделей, таблиця VRAM і швидкості за квантами, гібридний режим міркувань, українська мова, чесно про цензуру.
Mac Studio M3 Ultra для нейромереж: тягне 671B локально — і де спотикається
Mac Studio M3 Ultra — 512 ГБ і 819 ГБ/с: єдиний десктоп, що тримає 671B локально. Розбираємо реальні tok/s, ціну і де він поступається відеокарті та DGX Spark.
Wispr Flow чи свій Whisper: хмарна та офлайн-диктовка
Розбираємо Wispr Flow і локальну диктовку на Whisper: тарифи, чому Privacy Mode не офлайн, вимоги до заліза та покрокова установка офлайн-диктовки.
