👍 Исследователи представили Fast Byte Latent Transformer — новую архитектуру…
👍 Исследователи представили Fast Byte Latent Transformer — новую архитектуру для byte-level моделей, которые работают напрямую с байтами вместо токенов и словарей.
Проблема таких моделей всегда была в скорости: генерация шла буквально байт за байтом, из-за чего inference становился слишком дорогим и медленным.
📁 Теперь они добавили несколько новых режимов генерации:
— параллельную генерацию нескольких байтов сразу;
— diffusion-подход внутри BLT;
— self-speculative decoding;
— отдельный verification-слой для проверки качества.
В результате модели могут снижать memory bandwidth cost больше чем на 50% во время генерации.
💢 Если такие архитектуры начнут масштабироваться, индустрия может постепенно уйти от привычных tokenizer’ов и BPE-схем к полностью byte-level моделям без фиксированных словарей.
Похожие записи
Оцените материал:
Похожие записи
6G уже в Китае Первый городской тест сети передал файл…
30.07.2025
Историческое событие: Google разрешит менять адрес почты в Gmail. Фичу…
26.12.2025
Госдума приняла закон, который позволяет региональным властям участвовать в финансировании…
29.07.2026Присоединяйтесь и подпишитесь на рассылку самых свежих новостей по Email
Получайте свежие новости и идеи на почту. Без спама — только самое интересное.
Нажимая «Подписаться», вы соглашаетесь с политикой конфиденциальности.
