Как работают LLM: визуальное путешествие через одно предложение
Digital Mirror
0:00 / 0:00
Как работают LLM: визуальное путешествие через одно предложение
207 просмотров · 8 часов назад
Digital Mirror
12,7 тыс. подписчиков
207 просмотров · 8 часов назад
Узнайте, как работают большие языковые модели (LLM), проследив за работой модели на примере одного предложения. Это наглядное руководство объясняет, как GPT обрабатывает текст и предсказывает следующее слово.
Мы начнем с разбора процесса обучения, который подготавливает эти системы к использованию. Вы увидите, как именно входной текст подвергается токенизации, преобразуя человеческий язык в формат, который может прочитать модель. Затем мы рассмотрим внутреннюю математику, лежащую в основе механизма внимания, где векторы запроса, ключа и значения взаимодействуют для вычисления связей между словами.
Наконец, мы свяжем эти вычисления с нейронной сетью прямого распространения, чтобы показать, как система приходит к своему результату. Независимо от того, интересуетесь ли вы механикой современного ИИ или просто хотите выйти за рамки «черного ящика», это пошаговое руководство дает четкое представление о том, что происходит внутри большой языковой модели. Проследив поток от входных данных до окончательного предсказания, вы получите фундаментальное понимание архитектуры, которая лежит в основе современных технологий ИИ.
Подпишитесь на еженедельные технические обзоры и напишите в комментариях, какую концепцию ИИ вы хотели бы увидеть визуализированной в следующий раз.
0:00 От слов к идентификаторам: процесс токенизации
2:26 Эмбеддинги
7:34 Почему порядок важен: позиционное кодирование
9:55 Внимание — это все, что вам нужно
23:29 Быстрые пути и нормализация
27:01 Окончательное предсказание: логиты и софтмакс
#AI #llm #howllmworks