유저와 함께 만드는 LLM — 제타에 Preference Optimization 도입하기
May 06, 2026
ML Research스캐터랩이 가장 재밌는 LLM을 찾는 방법
실제 제품에서 유저 반응으로 LLM 평가하기: A/B 테스트·MAB·리더보드
Feb 12, 2026
ML ResearchRLHF 외에 LLM이 피드백을 학습할 수 있는 방법은 무엇이 있을까?
"RLHF 외에 Human feedback을 학습할 수 있는 방법론들에 대해서 소개하고 핑퐁팀에서 실험한 경험을 공유합니다."
Nov 17, 2023
ML Research멀티턴 이미지 대화: 조규성 vs 안정환, 루다야 누가 더 잘생겼어?
포토챗 베타보다 개선된 궁극의 이미지 대화 모델을 만드는 과정을 다룹니다.
Sep 13, 2023
ML Research