[LLM Pipeline 6] 언어 모델 헤드(LM Head)와 디코딩 전략: Temperature, Top-k, Top-p

·
Programming/Dev notes
참조 사이트SKALA 4기 - LLM과 Transformer 아키텍처 (SK AX SKALA)The Curious Case of Neural Text Degeneration (Holtzman et al., 2019)Hugging Face - How to generate text: using different decoding strategies개요지난 [LLM Pipeline 5]에서는 어텐션을 거친 텐서들이 깊은 신경망 레이어를 지나며 안정적으로 순전파되도록 지탱해 주는 잔차 연결(Residual Connection)과 정규화(RMSNorm), 그리고 비선형 사실적 지식을 저장하고 변환하는 SwiGLU FFN 기반의 트랜스포머 블록 연산을 살펴보았다.트랜스포머 블록의 최종 레이어를 거쳐 출력된 결과물은 ..