딥러닝 모델 최적화 이론 — 1. Quantization
Float32·Float16·Float8과 INT8의 표현 방식부터 Affine Quantization, PTQ, QAT, Fake Quantization과 STE까지 정리합니다.
Float32·Float16·Float8과 INT8의 표현 방식부터 Affine Quantization, PTQ, QAT, Fake Quantization과 STE까지 정리합니다.
Self-supervised contrastive learning 분야를 간단히 설명하고, 단순하지만 많은 인사이트를 담은 SimCLR 논문을 소개합니다.
Ubuntu 서버에 k3s를 설치하고 kubectl, Deployment, Service, Ingress, 롤링 업데이트를 진행합니다.
Kubernetes를 공부하면서 자주 만나는 핵심 용어를 Docker와 온프레미스와 비교하여 정리했습니다.
Docker, Docker Compose, Kubernetes, k3s의 차이를 정리했습니다.
GPU 서버를 운영하다 보면 신형 GPU 장착 또는 라이브러리 업데이트와 같은 이유로 NVIDIA 드라이버와 CUDA Toolkit을 최신화해야 하는 경우가 종종 있습니다. 도커 컨테이너를 사용하는 경우 도커 CUDA 런타임을 사용하기 때문에 CUDA Toolkit을 업데이트해 줄 필요는 없습니다. 하지만 NVIDIA 드라이버만큼은 호스트 OS의 것...