@Kamil Lee
비동기 파이썬 기반 LLM API 구현
다수의 프롬프트를 순차 처리할 때 생기는 대기 시간을 asyncio로 줄이는 방법을 다룹니다. 코루틴과 이벤트 루프, 워커 큐 패턴을 거쳐 실제 LLM 서비스 설계 예시까지 정리했습니다.
다수의 프롬프트를 순차 처리할 때 생기는 대기 시간을 asyncio로 줄이는 방법을 다룹니다. 코루틴과 이벤트 루프, 워커 큐 패턴을 거쳐 실제 LLM 서비스 설계 예시까지 정리했습니다.
문장 쌍을 매번 함께 입력해야 했던 BERT의 O(N²) 한계를 SBERT가 어떻게 O(N)으로 줄였는지 살펴보고, Multilingual E5와 비교하며 임베딩 모델 선택 기준을 정리했습니다.
Microsoft의 3D 생성 모델 TRELLIS를 다룹니다. SLAT 구조적 잠재 표현과 Rectified Flow Transformer의 원리부터 설치·사용법, 사전학습 모델과 학습 방법까지 단계별로 정리했습니다.