Перейти к содержимому

Как работают LLM: визуальное путешествие через одно предложение

Digital Mirror

0:00 / 0:00

Как работают LLM: визуальное путешествие через одно предложение

207 просмотров · 8 часов назад
Digital Mirror
12,7 тыс. подписчиков
207 просмотров · 8 часов назад
Узнайте, как работают большие языковые модели (LLM), проследив за работой модели на примере одного предложения. Это наглядное руководство объясняет, как GPT обрабатывает текст и предсказывает следующее слово. Мы начнем с разбора процесса обучения, который подготавливает эти системы к использованию. Вы увидите, как именно входной текст подвергается токенизации, преобразуя человеческий язык в формат, который может прочитать модель. Затем мы рассмотрим внутреннюю математику, лежащую в основе механизма внимания, где векторы запроса, ключа и значения взаимодействуют для вычисления связей между словами. Наконец, мы свяжем эти вычисления с нейронной сетью прямого распространения, чтобы показать, как система приходит к своему результату. Независимо от того, интересуетесь ли вы механикой современного ИИ или просто хотите выйти за рамки «черного ящика», это пошаговое руководство дает четкое представление о том, что происходит внутри большой языковой модели. Проследив поток от входных данных до окончательного предсказания, вы получите фундаментальное понимание архитектуры, которая лежит в основе современных технологий ИИ. Подпишитесь на еженедельные технические обзоры и напишите в комментариях, какую концепцию ИИ вы хотели бы увидеть визуализированной в следующий раз. 0:00 От слов к идентификаторам: процесс токенизации 2:26 Эмбеддинги 7:34 Почему порядок важен: позиционное кодирование 9:55 Внимание — это все, что вам нужно 23:29 Быстрые пути и нормализация 27:01 Окончательное предсказание: логиты и софтмакс #AI #llm #howllmworks