Explicação completa do modelo Transformer com base no paper: Attention Is All You Need
Daniel Romero
0:00 / 0:00
Explicação completa do modelo Transformer com base no paper: Attention Is All You Need
12 541 просмотр · 2 года назад
Daniel Romero
18,3 тыс. подписчиков
12 541 просмотр · 2 года назад
Uma revisão completa de todas as camadas do modelo Transformer (incluindo matemática): autoatenção , multi head self-attention, positional encoding, incluindo todas as multiplicações de matrizes e um tour no processo de treinamento e inferência.
Paper: Attention is all you need - https://arxiv.org/abs/1706.03762