Архив рубрики ~Коротко из Telegram~

Одна модель вместо трёх: LongCat-Next объединяет текст, звук и визуал…

Одна модель вместо трёх: LongCat-Next объединяет текст, звук и визуал…

Одна модель вместо трёх: LongCat-Next объединяет текст, звук и визуал

Появился LongCat-Next — мультимодальная модель, которая работает сразу с несколькими типами данных в одной задаче.

Не «склеивает» результаты, а обрабатывает всё внутри одной системы.

Что внутри:

— архитектура MoE
74B параметров, но активны только 3B
— поддержка текста, изображений и аудио одновременно

Что умеет:

— генерировать визуальный контент
— понимать речь
— вести голосовые диалоги
— клонировать голос

То есть это не набор отдельных моделей, а единая система для разных модальностей.

Главный плюс — эффективность.
MoE позволяет держать большую модель, но включать только нужную часть под задачу.

Оцените материал:

Поделиться
Понравилась статья? Расскажите другим
ВКонтакте
Читайте также
Архив рубрики ~Лента новостей~ Чего мы ожидаем от предстоящего запуска Apple? Архив рубрики ~Лента новостей~ «Гипотеза репродуктивной устойчивости» указывает на яичник как на источник открытий в исследованиях долголетия. Архив рубрики ~Лента новостей~ Компания MG Ship внедряет оптимизацию маршрутов с помощью ИИ, поскольку отдача от логистики растет. Архив рубрики ~Лента новостей~ ChatGPT называет клиентам вашу старую цену: как проверить, что нейросети говорят о вашем бренде Архив рубрики ~Лента новостей~ Модели прогнозирования способны восстановить до 65% фактов, которые они не могут вспомнить напрямую, — просто за счёт более длительного размышления. Архив рубрики ~Идей копилка~ Higgsfield Genjutsu: как зарабатывать на «легальном фотошопе для видео» — 7 схем Архив рубрики ~Лента новостей~ От клинических рекомендаций к графу патогенеза: как я уменьшаю галлюцинации LLM в медицинском knowledge graph Архив рубрики ~Лента новостей~ Действительно ли Вселенная расширяется? Анализ спектра квазара после 2 миллиардов световых лет пути Архив рубрики ~Лента новостей~ Как создать свой язык программирования? Архив рубрики ~Полезное~ ЛЕГАЛЬНЫЙ ФОТОШОП ДЛЯ ВИДЕО Higgsfield выкатили Genjutsu — инструмент, который… Архив рубрики ~Полезное~ Ловите огромный каталог дополнений для Claude. В Build with… Архив рубрики ~Полезное~ В Claude добавили собственный браузер. В Cowork теперь можно… Архив рубрики ~Полезное~ Вышел open-source сервис для нарезки видео на шорты. Архив рубрики ~Полезное~ Новый апскенйлер изображений работает с любой графикой Photo Enhancer Архив рубрики ~Лента новостей~ Чего мы ожидаем от предстоящего запуска Apple? Архив рубрики ~Лента новостей~ «Гипотеза репродуктивной устойчивости» указывает на яичник как на источник открытий в исследованиях долголетия. Архив рубрики ~Лента новостей~ Компания MG Ship внедряет оптимизацию маршрутов с помощью ИИ, поскольку отдача от логистики растет. Архив рубрики ~Лента новостей~ ChatGPT называет клиентам вашу старую цену: как проверить, что нейросети говорят о вашем бренде Архив рубрики ~Лента новостей~ Модели прогнозирования способны восстановить до 65% фактов, которые они не могут вспомнить напрямую, — просто за счёт более длительного размышления. Архив рубрики ~Идей копилка~ Higgsfield Genjutsu: как зарабатывать на «легальном фотошопе для видео» — 7 схем Архив рубрики ~Лента новостей~ От клинических рекомендаций к графу патогенеза: как я уменьшаю галлюцинации LLM в медицинском knowledge graph Архив рубрики ~Лента новостей~ Действительно ли Вселенная расширяется? Анализ спектра квазара после 2 миллиардов световых лет пути Архив рубрики ~Лента новостей~ Как создать свой язык программирования? Архив рубрики ~Полезное~ ЛЕГАЛЬНЫЙ ФОТОШОП ДЛЯ ВИДЕО Higgsfield выкатили Genjutsu — инструмент, который… Архив рубрики ~Полезное~ Ловите огромный каталог дополнений для Claude. В Build with… Архив рубрики ~Полезное~ В Claude добавили собственный браузер. В Cowork теперь можно… Архив рубрики ~Полезное~ Вышел open-source сервис для нарезки видео на шорты. Архив рубрики ~Полезное~ Новый апскенйлер изображений работает с любой графикой Photo Enhancer