Архив рубрики ~Лента новостей~

30 базовых концепций LLM

30 базовых концепций LLM

NOVOSTI

1. LLM (Large Language Model) — модель, которая генерирует текст, предсказывая наиболее вероятный следующий токен.

2. Token (токен) — фрагмент текста, например, слово или знак препинания.

3. Tokenization (токенизация) — процесс преобразования текста в последовательность токенов.

4. Embeddings (эмбеддинги) — числовые векторы, которые отражают значение токенов.

5. Latent Space (латентное пространство) — математическое пространство, где эмбеддинги организуются по смыслу.

6. Parameters (параметры) — внутренние переменные, хранящие усвоенные моделью паттерны.

7. Pre-training (предварительное обучение) — обучение на огромных объёмах текстовых данных для освоения языковых паттернов.

8. Base Model (базовая модель) — предварительно обученная модель, которая предсказывает текст, но не следует инструкциям.

9. Instruct Model (модель с инструкциями) — базовая модель, дополнительно обученная следовать инструкциям и давать полезные ответы.

10. Fine-Tuning (дообучение) — дополнительное обучение на меньшем наборе данных для формирования поведения модели.

11. Alignment (выравнивание) — обеспечение того, чтобы поведение модели было полезным, честным и безвредным.

12. RLHF (Reinforcement Learning with Human Feedback — обучение с подкреплением с обратной связью от человека) — использование ранжированных человеком ответов для корректировки поведения модели.

13. Prompt (промпт) — полный ввод, отправляемый модели, включая инструкции и контекст.

14. System Prompt (системный промпт) — высокоуровневые инструкции, определяющие роль и ограничения модели.

15. User Prompt (пользовательский промпт) — конкретный вопрос или инструкция, предоставленная пользователем.

16. Context Window (окно контекста) — максимальное количество токенов, которое модель может обработать за один раз.

17. Zero-Shot Learning (обучение без примеров) — выполнение задачи без примеров в промпте.

18. Few-Shot Learning (обучение на нескольких примерах) — включение примеров в промпт для направления формата вывода или поведения.

19. Chain of Thought (цепочка мыслей) — побуждение модели демонстрировать пошаговое рассуждение.

20. Inference (вывод) — процесс генерации выходных токенов с помощью обученной модели.

21. Latency (задержка) — время между отправкой промпта и получением вывода.

22. Temperature (температура) — параметр, контролирующий случайность при выборе токенов.

23. Hallucination (галлюцинация) — уверенная генерация неверной или вымышленной информации.

24. Grounding (привязка к реальности) — ограничение вывода предоставленной или проверяемой информацией.

25. RAG (Retrieval-Augmented Generation — генерация, дополненная поиском) — извлечение внешних данных и добавление их в промпт перед генерацией.

26. Workflow (рабочий процесс) — фиксированная, предопределённая последовательность шагов, которых придерживается LLM.

27. Agent (агент) — система, в которой LLM планирует действия, а затем динамически выбирает шаги и инструменты.

28. Multimodality (мультимодальность) — способность обрабатывать несколько типов входных данных, таких как текст и изображения.

29. Benchmarks (бенчмарки) — стандартизированные тесты для сравнения возможностей модели.

30. Guardrails (ограничители) — системы, блокирующие небезопасные или неподходящие входные и выходные данные.

Источник: vk.com

Источник: ai-news.ru

Оцените материал:

Поделиться
Понравилась статья? Расскажите другим
ВКонтакте
Читайте также
Новости робототехники Андроид T800 потерял голову в поединке на ринге. В Китае прошел турнир по боям между человекоподобными роботами Новости робототехники Соучредитель Uber привлек $1,7 млрд для нового робототехнического стартапа ATOMS Новости робототехники [Перевод] В Корее произошла первая в мире забастовка против использования гуманоидных роботов на производстве Новости робототехники Украинские беспилотники доставляют роботов непосредственно в зону боевых действий по морю и воздуху. Новости робототехники AMD представила модуль Kria для управления в кратчайшие сроки и унифицированную память для роботов. Архив рубрики ~Коротко из Telegram~ Создатель Twitter Джек Дорси выпустил аналог Discord и Slack —… Новости робототехники Роботакси Tesla движутся в обратном направлении. Архив рубрики ~Обо всем~ Вы умеете читать чужие мысли. Но наука уже 50 лет не может понять как Архив рубрики ~Обо всем~ Ложечка кваркового супа. Об истинных и возможных свойствах кварк-глюонной плазмы Архив рубрики ~Коротко из Telegram~ сегодня в интернетах все ждут подключение GPT-5.6 к cerebras со… Архив рубрики ~Коротко из Telegram~ Учёные нашли математический способ отличать настоящее искусство от изображений,… Архив рубрики ~Коротко из Telegram~ Samsung законтрил будущий iPhone Ultra — корейцы представили аж… Архив рубрики ~Коротко из Telegram~ ИИ-агентам выдали бесконечную память — вышел Obsidian Mind, который создаёт… Архив рубрики ~Коротко из Telegram~ OpenAI обновила свой сборник юзкейсов для Codex — теперь… Новости робототехники Андроид T800 потерял голову в поединке на ринге. В Китае прошел турнир по боям между человекоподобными роботами Новости робототехники Соучредитель Uber привлек $1,7 млрд для нового робототехнического стартапа ATOMS Новости робототехники [Перевод] В Корее произошла первая в мире забастовка против использования гуманоидных роботов на производстве Новости робототехники Украинские беспилотники доставляют роботов непосредственно в зону боевых действий по морю и воздуху. Новости робототехники AMD представила модуль Kria для управления в кратчайшие сроки и унифицированную память для роботов. Архив рубрики ~Коротко из Telegram~ Создатель Twitter Джек Дорси выпустил аналог Discord и Slack —… Новости робототехники Роботакси Tesla движутся в обратном направлении. Архив рубрики ~Обо всем~ Вы умеете читать чужие мысли. Но наука уже 50 лет не может понять как Архив рубрики ~Обо всем~ Ложечка кваркового супа. Об истинных и возможных свойствах кварк-глюонной плазмы Архив рубрики ~Коротко из Telegram~ сегодня в интернетах все ждут подключение GPT-5.6 к cerebras со… Архив рубрики ~Коротко из Telegram~ Учёные нашли математический способ отличать настоящее искусство от изображений,… Архив рубрики ~Коротко из Telegram~ Samsung законтрил будущий iPhone Ultra — корейцы представили аж… Архив рубрики ~Коротко из Telegram~ ИИ-агентам выдали бесконечную память — вышел Obsidian Mind, который создаёт… Архив рубрики ~Коротко из Telegram~ OpenAI обновила свой сборник юзкейсов для Codex — теперь…