Одна модель вместо трёх: LongCat-Next объединяет текст, звук и визуал…
Одна модель вместо трёх: LongCat-Next объединяет текст, звук и визуал
Появился LongCat-Next — мультимодальная модель, которая работает сразу с несколькими типами данных в одной задаче.
Не «склеивает» результаты, а обрабатывает всё внутри одной системы.
Что внутри:
— архитектура MoE
— 74B параметров, но активны только 3B
— поддержка текста, изображений и аудио одновременно
Что умеет:
— генерировать визуальный контент
— понимать речь
— вести голосовые диалоги
— клонировать голос
То есть это не набор отдельных моделей, а единая система для разных модальностей.
Главный плюс — эффективность.
MoE позволяет держать большую модель, но включать только нужную часть под задачу.
Похожие записи
Оцените материал:
Похожие записи
B2B-продукты на стероидах: как запускать новое с AI в 2026-м….
13.02.2026
100-120 млрд руб. может достичь ущерб селлеров от атак на…
22.07.2026
⭐️Бесплатным Wi-Fi покрыли почти ВСЮ Россию — забираем все доступные…
16.07.2025Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
