Ollama, LM Studio и llama.cpp на одной модели: от 0,3% разницы до трёх раз
Ollama, LM Studio и llama.cpp на одной модели: сколько забирает обёртка, почему чужие замеры расходятся в разы и какие настройки решают больше выбора программы.
33 мин. чтения
Phi-4 на своём ПК: 14B-модель Microsoft против гигантов
Обзор Phi-4 для локального запуска в 2026: вся линейка, таблица VRAM, почему 14B бьёт GPT-4o в STEM, честно про контекст 16K, русский язык и лицензию MIT.
19 мин. чтения
Два мини-ПК вместо облачных API: как локальный ИИ экономит на токенах
Журналист Tom's Hardware перевёл до двух третей ИИ-задач на пару мини-ПК с Ryzen AI Max+ 395, прокачивая до 80 млн токенов в день. Когда это реально оправдано.
2 мин. чтения