local-llm

Два міні-ПК замість хмарних API: як локальний ШІ економить на токенах

Журналіст Tom's Hardware переніс до двох третин ШІ-задач на пару міні-ПК з Ryzen AI Max+ 395, прокачуючи до 80 млн токенів на день. Коли це справді виправдано.

2 хв. читання

Gemma 3 і Gemma 4 на своєму ПК: найкраща модель під одну відеокарту

Огляд Gemma для локального запуску у 2026: лінійки 3 і 4, таблиця VRAM за квантами, QAT-кванти Google, мультимодальність, ліцензія Apache 2.0 та українська мова.

17 хв. читання

Mac Mini M4 Pro для нейромереж: найдешевший вхід у локальний ШІ

Mac Mini M4 Pro — найдешевший вхід у локальні LLM на єдиній пам'яті. Що влазить за RAM, реальні tok/s, ціна і де він поступається Strix Halo та Mac Studio.

15 хв. читання

Z.ai випустила GLM-5.2 з відкритими вагами: 753B параметрів, контекст 1M і ліцензія MIT

Z.ai (колишня Zhipu) випустила GLM-5.2 — відкриту MoE-модель на 753 млрд параметрів з контекстом 1M і ліцензією MIT. Заявлено, що обходить GPT-5.5 у коді.

2 хв. читання

DeepSeek-R1 на своєму ПК: модель, що міркує, через дистиляти

Як запустити DeepSeek-R1 локально у 2026: чому 671B не для дому, який дистилят обрати під VRAM, таблиця швидкості, ліцензія MIT і чесно про цензуру.

21 хв. читання

Qwen3 на своєму ПК: чому це «модель за замовчуванням» для локального ШІ

Огляд Qwen3 для локального запуску у 2026: лінійка моделей, таблиця VRAM і швидкості за квантами, гібридний режим міркувань, українська мова, чесно про цензуру.

22 хв. читання

Mac Studio M3 Ultra для нейромереж: тягне 671B локально — і де спотикається

Mac Studio M3 Ultra — 512 ГБ і 819 ГБ/с: єдиний десктоп, що тримає 671B локально. Розбираємо реальні tok/s, ціну і де він поступається відеокарті та DGX Spark.

16 хв. читання

Wispr Flow чи свій Whisper: хмарна та офлайн-диктовка

Розбираємо Wispr Flow і локальну диктовку на Whisper: тарифи, чому Privacy Mode не офлайн, вимоги до заліза та покрокова установка офлайн-диктовки.

24 хв. читання