Архив рубрики ~Коротко из Telegram~

Я знаю, что ты видишь во сне! ИИ научился понимать,…

Я знаю, что ты видишь во сне! ИИ научился понимать,…
File 2411

Я знаю, что ты видишь во сне!

ИИ научился понимать, что человек видит, по скану его мозга. Шайтан-модельку создали и представили в прошлом месяце на конференции по вычислительной нейронауке в Нью-Йорке учёные из израильского Weizmann Institute of Science.

Модель работает и в обратную сторону: по изображению предсказывает, как на него отреагирует мозг. Учили её на данных функциональной МРТ (fMRI). Томограф отслеживает приток крови к активным участкам мозга. В новых сканерах один объёмный «пиксель», воксел, охватывает около 1 кубического миллиметра вместо обычных 3.

Похожие попытки делали и раньше, но, по словам руководителя проекта Михаль Ирани, получалось приблизительно. Человек смотрит на банан, и модель рисует банан, только другой, в другой позе и на другом месте. Поэтому её декодер разделён на две ветки. Одна угадывает структуру картинки, то есть где какие цвета, а другая угадывает содержание. Обе подсказки получает диффузионная модель, та же, что генерирует изображения из шума.

Данных при этом не хватало: 8 добровольцев, каждому показали около 9 000 изображений. Тогда команда научила вторую модель обратному ходу, чтобы по картинке предсказывать скан мозга. Дальше энкодер и декодер тренируют друг друга по кругу: картинка, «воображаемый» скан, снова картинка. В итоге около 70% обучающих данных составляют изображения, которых ни один живой человек в томографе не видел.

Побочный результат: «универсальный» энкодер, которому для нового человека хватает 1 часа калибровки вместо прежних 40. При цене томографа $600–1000 в час разница ощутимая. Нейробиолог Томми Спрэг из UC Santa Barbara честно признаётся, что 40 часов на одного испытуемого не может себе позволить никто.

Ошибки, конечно, случаются. Так модель однажды превратила торт в стопку из трёх сэндвичей, а собаку в ванне — в козу похожей масти. Тоже в ванне. Обстановку, по крайней мере, угадала.

Ирани на картинках останавливаться не собирается. Следующие на очереди — видео, звук, воображаемые образы и сны (о, да, бэйби!). Цели благородные: дать полностью парализованным людям способ общаться, а также понять, как выглядят флешбэки при ПТСР.

А вот коллеги смотрят на это без восторга. Спрэг говорит, что десять лет назад посмеялся бы над страхами о чтении мыслей, ведь уложить человека в томограф против воли непросто. Только Ирани и другие уже переносят подход на ЭЭГ. Там нужна шапочка с электродами, а то и обычные наушники.

Нейробиолог и философ Марчелло Иенка из Technical University of Munich называет такой переход переломным. Один раз откалибровал устройство под пользователя, и дальше из его мозга можно вытягивать данные, вообще не спрашивая. Иенка фантазирует о применении этих возможностей: например, суд, где реконструкция мысленного образа станет уликой.

Сама Ирани о злоупотреблениях пока не тревожится. По её словам, она старается думать только о хорошем. Как и все эти наивные учёные, да…

Оцените материал:

Поделиться
Понравилась статья? Расскажите другим
ВКонтакте
Читайте также
Новости робототехники Старых роботов Figure отправили в лаву расплавленную сталь. Компания списывает… Архив рубрики ~Полезное~ Первый проект в вайбкодинге Выбор первого проекта определяет весь дальнейший… Архив рубрики ~Лента новостей~ Папа Лев XIV: Наука должна учитывать риски технологий Архив рубрики ~Лента новостей~ Компания Lyft выплатила 272,5 млн долларов для урегулирования судебного иска по поводу классификации водителей. Архив рубрики ~Лента новостей~ Вышла ElevenLabs v4: как озвучить текст на русском с эмоциями Архив рубрики ~Лента новостей~ Каждый LLM-фреймворк описывает инструмент по-своему Архив рубрики ~Лента новостей~ Сегодняшний выпуск NYT Strands: подсказки, ответы и помощь от 1 октября, № 942 Архив рубрики ~Лента новостей~ ТОП направлений для программиста в 2026 году Архив рубрики ~Лента новостей~ Google выпустила Gemini 4 Argon, названную самой мощной моделью компании на сегодняшний день. Архив рубрики ~Полезное~ GPT-6.1 Sol: как сэкономить деньги на ИИ и получить качество… Архив рубрики ~Полезное~ Anthropic проверила GLM-5.3 — открытая китайская модель уже умеет искать… Архив рубрики ~Лента новостей~ Представляем dots | OpenAI Архив рубрики ~Лента новостей~ «Т-Технологии» представили открытые нейросетевые фреймворки: от персонализации до работы с большими каталогами Архив рубрики ~Лента новостей~ В соцсетях предполагают, что xAI специально заранее выкупила домен dot.com, узнав, что OpenAI планирует запуск Dots Новости робототехники Старых роботов Figure отправили в лаву расплавленную сталь. Компания списывает… Архив рубрики ~Полезное~ Первый проект в вайбкодинге Выбор первого проекта определяет весь дальнейший… Архив рубрики ~Лента новостей~ Папа Лев XIV: Наука должна учитывать риски технологий Архив рубрики ~Лента новостей~ Компания Lyft выплатила 272,5 млн долларов для урегулирования судебного иска по поводу классификации водителей. Архив рубрики ~Лента новостей~ Вышла ElevenLabs v4: как озвучить текст на русском с эмоциями Архив рубрики ~Лента новостей~ Каждый LLM-фреймворк описывает инструмент по-своему Архив рубрики ~Лента новостей~ Сегодняшний выпуск NYT Strands: подсказки, ответы и помощь от 1 октября, № 942 Архив рубрики ~Лента новостей~ ТОП направлений для программиста в 2026 году Архив рубрики ~Лента новостей~ Google выпустила Gemini 4 Argon, названную самой мощной моделью компании на сегодняшний день. Архив рубрики ~Полезное~ GPT-6.1 Sol: как сэкономить деньги на ИИ и получить качество… Архив рубрики ~Полезное~ Anthropic проверила GLM-5.3 — открытая китайская модель уже умеет искать… Архив рубрики ~Лента новостей~ Представляем dots | OpenAI Архив рубрики ~Лента новостей~ «Т-Технологии» представили открытые нейросетевые фреймворки: от персонализации до работы с большими каталогами Архив рубрики ~Лента новостей~ В соцсетях предполагают, что xAI специально заранее выкупила домен dot.com, узнав, что OpenAI планирует запуск Dots

Оставить комментарий