월 150만 유저가 사용하는 LLM Inference 인프라 안정적으로 운영하기
Mar 11, 2026
ML Engineering최대 24배 빠른 vLLM의 비밀 파헤치기
"최대 24배의 성능을 보인 vLLM, 코드 레벨까지 분석해보자!"
Sep 13, 2023
ML Engineering새로운 루다를 지탱하는 모델 서빙 아키텍처 — 3편: 안정적인 LLM 서비스를 위한 서빙 최적화 기법
LLM 서빙을 위한 다양한 최적화 기법과 그 효과를 검증하기 위한 부하 테스트 방법론
Aug 16, 2023
ML EngineeringDeduplication - 학습 데이터에서 중복 제거하기
Luda Gen 1.5 모델을 학습할 때 데이터셋에서 중복을 제거한 방법에 대해 이야기합니다.
Jul 10, 2023
ML Engineering