Архив рубрики ~Коротко из Telegram~
Бесплатный гайд OpenAI по внутреннему устройству LLM
Гид погружается в детали работы отдельных нейронов, архитектуру трансформеров, ускорение генерации, выполнение на нескольких видеокартах, KV‑кэш, FlashAttention, обучение на человеческих предпочтениях, расчёт потребления памяти и фрагменты кода на PyTorch. Материал предназначен для тех, кто хочет понять LLM глубже обычного чат‑бота.
Читать