Архив рубрики ~Коротко из Telegram~

SpikingBrain Все привыкли, что современные нейронки это прожорливые цифровые монстры….

SpikingBrain Все привыкли, что современные нейронки это прожорливые цифровые монстры….

SpikingBrain

Все привыкли, что современные нейронки это прожорливые цифровые монстры. Чтобы обучить одну, нужно спалить годовой бюджет маленькой страны на электричество. А стоит загрузить ей что-то длиннее короткой инструкции, она тут же теряется и тупит.

Китайские братушки придумали как это непотребство побороть. Идея проста: зачем заставлять всю систему работать на 100% мощности 24/7, если можно просто… не заставлять? Человеческий мозг работает по принципу «нет задачи — я сплю». Нейроны стреляют импульсами («спайками») только по делу. SpikingBrain делает то же самое: вместо постоянного гула вычислений используются короткие «выстрелы» там, где реально нужно.

Результаты, вроде как, хорошие:

Обучение на минималках. Модель натаскали всего на ~2% от данных, которые нужны привычным нам трансформерам.

Скорость. В тестах на длинный текст (до 4 млн токенов) SpikingBrain оказался в 100 раз быстрее.

Энергоэффективность. Экономия по сравнению с обычными методами — до 70%.

Но как обычно, не без ложки дёгтя:

— Самая быстрая и экономная версия (SpikingBrain-7B) работает почти на уровне обычной модели, но всё же теряет в качестве. Хороший «хорошист», но не отличник.
— Чтобы дотянуться до топ-результатов, пришлось собрать гибрид из линейного, локального и обычного внимания, да ещё нашпиговать все это Mixture-of-Experts. Так появился монстр SpikingBrain-76B. Он умнее, но куда сложнее и прожорливее.
— И вообще, пока это экспериментальная технология: вся магия со «спайками» по-настоящему раскроется только на специальных чипах, которых у нас пока нет.

Есть шанс, что на фоне дефицита энергии и подорожания железа именно такие подходы и выживут. Не дата-центры размером с город, а модели, которые учатся экономить. И тогда ИИ наконец перестанет делать вид, что он умнее мозга, и начнёт хотя бы его копировать. А там и до AGI недалеко: сначала модельки научатся «лениться правильно», а потом и думать осмысленно.

тут статья
тут гитхаб

file 534

❌ Нет похожих статей с такими тегами

Оцените материал:

Поделиться
Понравилась статья? Расскажите другим
ВКонтакте
Читайте также
Архив рубрики ~Лента новостей~ Призыв к коллективным действиям в области киберзащиты Архив рубрики ~Лента новостей~ Стартап Profound, работающий по модели AEO, достиг оценки «единорога» и привлек 180 миллионов долларов в рамках раунда финансирования серии D спустя 7 месяцев после предыдущего раунда. Архив рубрики ~Лента новостей~ StormWall представила локальное решение для защиты от DDoS-атак Архив рубрики ~Обо всем~ Команда исследователей из Университета Лихай использует цифровую копию оси «кишечник-мозг» для совершенствования нейростимуляционных методов лечения. Архив рубрики ~Лента новостей~ От видео к данным: как искусственный интеллект трансформирует обработку мультимедийного контента. Архив рубрики ~Лента новостей~ Выложить мозг мухи в опенсорс было ошибкой Архив рубрики ~Лента новостей~ В плане Амодеи по замедлению работы ИИ нигде не говорится о работе с открытыми весами. В этом нет необходимости. Архив рубрики ~Лента новостей~ Отличи меня, если сможешь! Как дипфейки меняют наем в ИТ (и не только) Архив рубрики ~Лента новостей~ Bio_news: как я делал ИИшный дайджест новостей по биологии Архив рубрики ~Обо всем~ Некоторые спутниковые компании по-прежнему заинтересованы в предоставлении специализированных услуг по запуску спутников. Архив рубрики ~Полезное~ Монтируем видосы через НЕЙРОНКУ совершенно БЕСПЛАТНО — нашли полноценный AI-видеоредактор… Архив рубрики ~Лента новостей~ Найт-Сити в 8K: 300 модов, трассировка пути и DLSS 5 превратили Cyberpunk 2077 в графический эталон! Архив рубрики ~Лента новостей~ Sophos заняла первое место в общем рейтинге по решениям Endpoint, XDR, MDR и Firewall в отчетах G2 за осень 2026 года. Архив рубрики ~Лента новостей~ Генеральный директор Nvidia Дженсен Хуанг заявил Трампу: «Мы не допустим [замедления развития ИИ]». Архив рубрики ~Лента новостей~ Призыв к коллективным действиям в области киберзащиты Архив рубрики ~Лента новостей~ Стартап Profound, работающий по модели AEO, достиг оценки «единорога» и привлек 180 миллионов долларов в рамках раунда финансирования серии D спустя 7 месяцев после предыдущего раунда. Архив рубрики ~Лента новостей~ StormWall представила локальное решение для защиты от DDoS-атак Архив рубрики ~Обо всем~ Команда исследователей из Университета Лихай использует цифровую копию оси «кишечник-мозг» для совершенствования нейростимуляционных методов лечения. Архив рубрики ~Лента новостей~ От видео к данным: как искусственный интеллект трансформирует обработку мультимедийного контента. Архив рубрики ~Лента новостей~ Выложить мозг мухи в опенсорс было ошибкой Архив рубрики ~Лента новостей~ В плане Амодеи по замедлению работы ИИ нигде не говорится о работе с открытыми весами. В этом нет необходимости. Архив рубрики ~Лента новостей~ Отличи меня, если сможешь! Как дипфейки меняют наем в ИТ (и не только) Архив рубрики ~Лента новостей~ Bio_news: как я делал ИИшный дайджест новостей по биологии Архив рубрики ~Обо всем~ Некоторые спутниковые компании по-прежнему заинтересованы в предоставлении специализированных услуг по запуску спутников. Архив рубрики ~Полезное~ Монтируем видосы через НЕЙРОНКУ совершенно БЕСПЛАТНО — нашли полноценный AI-видеоредактор… Архив рубрики ~Лента новостей~ Найт-Сити в 8K: 300 модов, трассировка пути и DLSS 5 превратили Cyberpunk 2077 в графический эталон! Архив рубрики ~Лента новостей~ Sophos заняла первое место в общем рейтинге по решениям Endpoint, XDR, MDR и Firewall в отчетах G2 за осень 2026 года. Архив рубрики ~Лента новостей~ Генеральный директор Nvidia Дженсен Хуанг заявил Трампу: «Мы не допустим [замедления развития ИИ]».