최신 글
Transformer는 어떻게 문맥을 계산하는가
DNN, CNN, RNN에서 Transformer로 이어지는 흐름과 self-attention, multi-head attention, MLP/FFN, positional encoding을 수식과 직관으로 정리합니다.
글 읽기최근 글
전체 글마르코프 체인은 어떻게 현재만 보고 미래를 계산하는가
마르코프 성질, 전이확률행렬, n-step 전이, 정지분포, 수렴 조건, 흡수 상태와 가역성을 중심으로 마르코프 체인을 정리합니다.
Diffusion 모델은 어떻게 노이즈에서 이미지를 꺼낼까
DDPM의 정방향/역방향 과정, 노이즈 예측 손실, score 관점, classifier-free guidance, AE/VAE, Latent Diffusion의 역할을 정리합니다.
관측성 연작