🤖 Liquid AI выпустила LFM2.5-VL-3B — открытую зрительно-языковую модель для устройств
Модель построена на текстовой базе LFM2.5-2.6B и энкодере изображений SigLIP2 400M NaFlex: контекст 32 768 токенов, 16 языков, включая русский, ~3 ГБ памяти, ответы без цепочки рассуждений.
🌍 Это новый референс для on-device VLM: класс 3B впервые показывает уровень 4B-моделей в понимании экранов (ScreenSpot-v2 80.7) и function calling (ToolSandbox 59.5) — пригодится для локальных UI-агентов, работающих с интерфейсами без облака.
👤 Попробовать можно прямо сейчас: WebGPU-демо в браузере, Liquid AI Playground и сборки GGUF, ONNX и MLX для llama.cpp, LM Studio, Ollama и Jan. На Galaxy S26 Ultra модель держит ~20 ток/с.
Источник 1: https://www.liquid.ai/blog/lfm2-5-vl-3b Источник 2: https://huggingface.co/LiquidAI/LFM2.5-VL-3B
