LLM은 구글의 2017년 Transformer 논문에서 출발해 다음 단어를 확률적으로 예측하는 대규모 언어 모델입니다.
쿠버네티스에서 애플리케이션은 수백 개의 Pod로 분산되고, 각 Pod는 수개의 컨테이너로 구성됩니다.
Active-Active(모든 사이트가 동시에 트래픽을 처리하는 구성)가 짧은 RTO를 얻는 대가는 데이터 계층의 복잡도입니다.
컨테이너는 이제 개발과 운영의 표준이 되었지만, 막상 "이미지는 왜 가볍고, 컨테이너는 가상머신과 뭐가 다르며, 여러 컨테이너를 한 번에 어떻게 띄우고, 서버 여러 대로는 어떻게 확장하는가"를 한 흐름으로 설명하려고 하면 막히는 경우가 많습니다.
젠킨스(Jenkins)는 코드를 받아 빌드하고, 테스트하고, 배포하는 과정을 자동화하는 CI/CD의 표준 도구입니다.
시스템을 여러 개의 마이크로서비스로 나누면서 배포 속도는 빨라졌지만, 하나의 요청이 어느 서비스에서 지연되는지, 어떤 서비스가 어떤 서비스를 호출하는지를 외부에서 추적하기는 더 어려워졌습니다.




