최신 글

Transformer는 어떻게 문맥을 계산하는가

DNN, CNN, RNN에서 Transformer로 이어지는 흐름과 self-attention, multi-head attention, MLP/FFN, positional encoding을 수식과 직관으로 정리합니다.

DEVELOP
글 읽기

최근 글

전체 글

© 2024. All rights reserved.