LFM2.5-VL-3B Очередная компактная модель от Liquid AI Мультимодальная зрительно-языковая, работает…
Очередная компактная модель от Liquid AI
Мультимодальная зрительно-языковая, работает на самртфоне
Обходит заметно более крупные модели в задачах по экранам, привязке объектов и распознаванию текста.
• Понимание экранов мобильных, веб и настольных интерфейсов
• Grounding — привязка объектов к координатам по запросу на естественном языке
• Полностраничное OCR с разметкой макета — текст, таблицы, формулы, графики
• Вызов функций и инструментов
• Работа с несколькими изображениями сразу
• База LFM2.5-2.6B плюс визуальный энкодер SigLIP2 NaFlex 400M
• Контекст 32 768 токенов, 16 языков включая русский
• Около 3 ГБ памяти
• 20 ток/с на Galaxy S26 Ultra
Оцените материал:
Похожие записи
Как нейросеть превращает идею в 3D-объект, российские школьники могут узнать…
03.10.2026
Промо для вашего проекта — без монтажёра и копирайтера Скилл…
03.10.2026
«Хочу, чтобы было вот так» — как объяснить ИИ задание…
03.10.2026Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
