
Liquid AI выпустила локальную модель для ИИ агентов, которая работает даже на телефоне
LFM2.5-2.6B содержит 2,6 миллиарда параметров и обучена специально для планирования, вызова инструментов и выполнения многошаговых задач. Модель работает полностью на устройстве, без облачных API и оплаты за токены.
Контекст составляет 128 тысяч токенов, а объём данных для предварительного обучения достиг 34 триллионов токенов. Модель дополнительно обучали внутри реальных агентных сред, включая Hermes Agent и OpenClaw.
На M5 Max она генерирует до 220 токенов в секунду, на Ryzen AI Max+ 395 выдаёт 113 токенов в секунду, а на смартфоне сохраняет скорость около 30 токенов в секунду. При этом модель занимает меньше 2,5 GB памяти.
На одной NVIDIA H100 производительность приближается к 15 тысячам токенов в секунду. Это около 1,3 миллиарда токенов в сутки без постоянных расходов на облачные модели.
Несмотря на небольшой размер, LFM2.5-2.6B обходит более крупные Gemma и Qwen в большинстве тестов на следование инструкциям и использование инструментов. Более крупные модели сохраняют преимущество в сложном программировании.
Модель уже доступна с открытыми весами на Hugging Face. Поддерживаются llama.cpp, MLX, ONNX, vLLM и SGLang.
Ежедневные подборки промптов, свежие новости и материалы об ИИ — там, где удобно. Без спама, только редакционный отбор.