LFM2.5-2.6B: модель на 2,6 млрд параметров держит агента в 2,5 ГБ памяти

3 мин. чтения
BYBIT · СПОТ И ФЬЮЧЕРСЫ
Крипта с нуля
Комиссия 0,1%, торги 24/7, старт с $10
Открыть счёт

Что произошло

6 августа стартап Liquid AI выложил LFM2.5-2.6B — языковую модель на 2,6 млрд параметров, обученную специально под агентские задачи: вызов инструментов и выполнение инструкций, а не разговоры. В открытом доступе на Hugging Face сразу две версии, базовая и дообученная под агентов. Заявленная особенность одна и понятная: модель работает в пределах 2,5 ГБ памяти, то есть помещается в телефон и ноутбук без отдельной видеокарты.

Детали

Скорость, которую приводит сам разработчик: 220 токенов в секунду на Apple M5 Max, 113 токенов в секунду на AMD Ryzen AI Max+ 395 и около 30 токенов в секунду на смартфоне через их приложение Apollo. На другом конце — примерно 15 000 токенов в секунду на одной NVIDIA H100 под постоянной нагрузкой, что компания пересчитывает в 1,3 млрд токенов в сутки с одной карты. Все эти цифры вендорские и независимо не перепроверены.

Сравнивали LFM2.5-2.6B с моделями, которые вдвое-вчетверо больше, — Gemma 4 E2B (5,1 млрд параметров) и E4B (8 млрд), Qwen3.5-4B (4,7 млрд) и Qwen3.5-9B (9,7 млрд):

ТестLFM2.5-2.6BЛучший из соперников
IFBench (следование инструкции)59,1756,47 (Qwen3.5-9B)
Multi-IF80,0777,35 (Gemma 4 E4B)
ToolSandbox (вызов инструментов)77,8376,44 (Qwen3.5-9B)
BFCLv456,8860,13 (Qwen3.5-9B)
LiveCodeBench v6 (код)59,4169,86 (Qwen3.5-9B)

Лицензия — собственная LFM Open License v1.0: коммерческое использование бесплатно для компаний с выручкой до $10 млн в год, для некоммерческих и исследовательских проектов ограничений нет.

Что это значит

Интересно это тем, кто держит локальные модели на своём железе и упирается не в качество, а в память: 2,5 ГБ — это разница между «работает на телефоне» и «нужен ПК с видеокартой». По инструкциям и вызову инструментов модель обходит соперников вчетверо крупнее, по коду — заметно уступает (59,41 против 69,86 у Qwen3.5-9B), так что закрывать ею задачи разработчика не выйдет. Отдельно стоит смотреть лицензию: порог в $10 млн выручки означает, что бесплатно это не для всех, и юристам компании текст читать придётся. Проверить обещанную скорость можно прямо сейчас — веса уже лежат на Hugging Face, независимых замеров ждать пару недель.

Bybit
$30,100 + $5,030
100 USDT в подарок
Получить →
Поделиться
Связаться:
Крипто- и data-аналитик, инженер-программист (факультет компьютерных наук ХНУРЭ). В IT с 2008 года: администрировал корпоративный мониторинг в «Vodafone Украина», семь лет разрабатывал и продвигал веб-проекты, пять лет руководил маркетингом на метриках — конверсия, CTR, ROI, LTV.Криптовалютными рынками занимаюсь с 2021 года: ончейн-метрики, токеномика, макроэкономические индикаторы. Разработал собственную data-driven модель анализа рынка на 30+ метрик. Стек — Python (pandas, NumPy, SciPy, matplotlib), математическая статистика и EDA; сбор и сверку данных автоматизирую AI-агентами.Принцип — «Don't trust, verify»: каждая цифра проверена по первоисточнику, ключевые — минимум по двум независимым; прогнозы — только сценарии с условиями. Тезис без данных не публикуется.