Что произошло
6 августа стартап Liquid AI выложил LFM2.5-2.6B — языковую модель на 2,6 млрд параметров, обученную специально под агентские задачи: вызов инструментов и выполнение инструкций, а не разговоры. В открытом доступе на Hugging Face сразу две версии, базовая и дообученная под агентов. Заявленная особенность одна и понятная: модель работает в пределах 2,5 ГБ памяти, то есть помещается в телефон и ноутбук без отдельной видеокарты.
Детали
Скорость, которую приводит сам разработчик: 220 токенов в секунду на Apple M5 Max, 113 токенов в секунду на AMD Ryzen AI Max+ 395 и около 30 токенов в секунду на смартфоне через их приложение Apollo. На другом конце — примерно 15 000 токенов в секунду на одной NVIDIA H100 под постоянной нагрузкой, что компания пересчитывает в 1,3 млрд токенов в сутки с одной карты. Все эти цифры вендорские и независимо не перепроверены.
Сравнивали LFM2.5-2.6B с моделями, которые вдвое-вчетверо больше, — Gemma 4 E2B (5,1 млрд параметров) и E4B (8 млрд), Qwen3.5-4B (4,7 млрд) и Qwen3.5-9B (9,7 млрд):Тест LFM2.5-2.6B Лучший из соперников IFBench (следование инструкции) 59,17 56,47 (Qwen3.5-9B) Multi-IF 80,07 77,35 (Gemma 4 E4B) ToolSandbox (вызов инструментов) 77,83 76,44 (Qwen3.5-9B) BFCLv4 56,88 60,13 (Qwen3.5-9B) LiveCodeBench v6 (код) 59,41 69,86 (Qwen3.5-9B)
Лицензия — собственная LFM Open License v1.0: коммерческое использование бесплатно для компаний с выручкой до $10 млн в год, для некоммерческих и исследовательских проектов ограничений нет.
Что это значит
Интересно это тем, кто держит локальные модели на своём железе и упирается не в качество, а в память: 2,5 ГБ — это разница между «работает на телефоне» и «нужен ПК с видеокартой». По инструкциям и вызову инструментов модель обходит соперников вчетверо крупнее, по коду — заметно уступает (59,41 против 69,86 у Qwen3.5-9B), так что закрывать ею задачи разработчика не выйдет. Отдельно стоит смотреть лицензию: порог в $10 млн выручки означает, что бесплатно это не для всех, и юристам компании текст читать придётся. Проверить обещанную скорость можно прямо сейчас — веса уже лежат на Hugging Face, независимых замеров ждать пару недель.



