Архив рубрики ~Коротко из Telegram~

Apple выпустила новую дифузионную модель ИИ, генерирующую код необычным способом…

Apple выпустила новую дифузионную модель ИИ, генерирующую код необычным способом…

Apple выпустила новую дифузионную модель ИИ, генерирующую код необычным способом и с высокой эффективностью

Apple поделилась на Hugging Face новинкой в открытом доступе, её даже можно испытать при желании. Это dLLM «Coupled-GRPO» – диффузионная языковая модель, которая вместо написания кода как у традиционных LLM, генерируя текст слева направо, сверху вниз, также может писать не по порядку и улучшать несколько фрагментов одновременно, прямо как живой человек. Результатом является более быстрая генерация кода с высокой производительностью и эффективностью.

Coupled-GRPO значительно повышает производительность DiffuCoder, демонстрируя эффективность методов RL, согласованных с принципами диффузии. Исследование углубляет понимание dLLM и создаёт основу для их применения в сложных задачах генерации и рассуждения. Текстовые модели на основе диффузии (dLLM) могут быть быстрее, чем авторегрессивные, поскольку они могут в основном итеративно усовершенствовать весь текст параллельно.

Основная механика работы как с генерацией изображений: начало с зашумленной версии и затем постепенно очищается, чтобы получить желаемый чистый результат. Это включает в себя маску для токенов, преимущественно для максимизации вероятностной оценки.
Используя стратегию парного сэмплирования, она обеспечивает более точную оценку вероятности. Созданный Apple новый алгоритм с открытым исходным кодом DiffuCode-7B-cpGRPO, основан на документе под названием «DiffuCoder: Understanding and Improving Masked Diffusion Models for Code Generation», выпущенный в прошлом месяце. Сама модель dLLM от Apple построена в виде надстройки для Qwen2.5-7B от Alibaba. Apple взяла её и внесла свои собственные коррективы – в результате нейросеть превратили в новую модель с диффузионным декодером, а затем снова скорректировали, обучив ещё одну версию, используя более 20 000 тщательно отобранных примеров кодирования.

Результат работы этой сборной солянки в виде DiffuCoder-7B-cpGRPO от Apple – лучше конкурентов в некоторых показателях до 4,4%, но в сумме всё ещё далёк от уровня GPT-4 или Gemini Diffusion. Проверяли на тестах с Python в качестве языка кодирования – это обеспечивает разнообразный набор задач кодирования для оценки правильности и качества кода. Но как минимум, так Apple понемногу закладывает основу для своих генеративных моделей ИИ с некоторыми довольно интересными и новыми идеями. Компания также показала пример процесса декодирования DiffuCoder с температурой (влияет на эффективность процесса) выборки. Когда этапы декодирования уменьшаются вдвое, DiffuCoder-Instruct, обученный сопряженным GRPO, испытывает меньшее падение производительности по сравнению с самим Instruct.

Подробный материал с описанием методов, принципами встраивания и эксплуатации новой модели ИИ от Apple, доступен по ссылке

file 127

Оцените материал:

Поделиться
Понравилась статья? Расскажите другим
ВКонтакте
Читайте также
Архив рубрики ~Лента новостей~ Новые промты от Google и GPT (#5 выпуск) — возможно, вы искали именно их🤔 Архив рубрики ~Лента новостей~ Мост между SAST и фаззингом: как из сработки SAST получить подтверждённую уязвимость Архив рубрики ~Лента новостей~ Частый просмотр телевизора связали с патологией белого вещества головного мозга. Сидячий образ жизни с когнитивными нагрузками не оказывал подобного эффекта Архив рубрики ~Лента новостей~ Эта технология показала хорошие результаты. Системы обороны — это будущее. Архив рубрики ~Лента новостей~ Как мы «приручали» ИИ в WMS Новости робототехники Один ролик вместо четырёх часов переобучения Чтобы научить робота новой… Новости робототехники Роботы начнут чинить спутники — SpaceX запустила на орбиту беспилотник… Архив рубрики ~Лента новостей~ Каждый микробиом рассказывает изменчивую, поддающуюся вычислению историю. Архив рубрики ~Лента новостей~ Пользователи DeepSeek рассказали о баге, из-за которого чат-бот присылает фрагменты из переписок с другими пользователями Новости робототехники Андроид T800 потерял голову в поединке на ринге. В Китае прошел турнир по боям между человекоподобными роботами Новости робототехники Соучредитель Uber привлек $1,7 млрд для нового робототехнического стартапа ATOMS Архив рубрики ~Лента новостей~ Уязвимости SonicWall SMA1000 в процессе активной эксплуатации Архив рубрики ~Лента новостей~ Как механизмы защиты от угроз со стороны ИИ препятствуют работе исследователей в области наступательной кибербезопасности Архив рубрики ~Лента новостей~ Модель ведет себя хорошо, потому что знает, что ее тестируют: почему зеленый safety-бенч не значит зеленый прод Архив рубрики ~Лента новостей~ Новые промты от Google и GPT (#5 выпуск) — возможно, вы искали именно их🤔 Архив рубрики ~Лента новостей~ Мост между SAST и фаззингом: как из сработки SAST получить подтверждённую уязвимость Архив рубрики ~Лента новостей~ Частый просмотр телевизора связали с патологией белого вещества головного мозга. Сидячий образ жизни с когнитивными нагрузками не оказывал подобного эффекта Архив рубрики ~Лента новостей~ Эта технология показала хорошие результаты. Системы обороны — это будущее. Архив рубрики ~Лента новостей~ Как мы «приручали» ИИ в WMS Новости робототехники Один ролик вместо четырёх часов переобучения Чтобы научить робота новой… Новости робототехники Роботы начнут чинить спутники — SpaceX запустила на орбиту беспилотник… Архив рубрики ~Лента новостей~ Каждый микробиом рассказывает изменчивую, поддающуюся вычислению историю. Архив рубрики ~Лента новостей~ Пользователи DeepSeek рассказали о баге, из-за которого чат-бот присылает фрагменты из переписок с другими пользователями Новости робототехники Андроид T800 потерял голову в поединке на ринге. В Китае прошел турнир по боям между человекоподобными роботами Новости робототехники Соучредитель Uber привлек $1,7 млрд для нового робототехнического стартапа ATOMS Архив рубрики ~Лента новостей~ Уязвимости SonicWall SMA1000 в процессе активной эксплуатации Архив рубрики ~Лента новостей~ Как механизмы защиты от угроз со стороны ИИ препятствуют работе исследователей в области наступательной кибербезопасности Архив рубрики ~Лента новостей~ Модель ведет себя хорошо, потому что знает, что ее тестируют: почему зеленый safety-бенч не значит зеленый прод