#nlp

@Kamil Lee
AI

비동기 파이썬 기반 LLM API 구현

다수의 프롬프트를 순차 처리할 때 생기는 대기 시간을 asyncio로 줄이는 방법을 다룹니다. 코루틴과 이벤트 루프, 워커 큐 패턴을 거쳐 실제 LLM 서비스 설계 예시까지 정리했습니다.

#
비동기 파이썬 기반 LLM API 구현
@Kamil Lee
AI

SBERT와 Multilingual E5 임베딩 모델 분석

문장 쌍을 매번 함께 입력해야 했던 BERT의 O(N²) 한계를 SBERT가 어떻게 O(N)으로 줄였는지 살펴보고, Multilingual E5와 비교하며 임베딩 모델 선택 기준을 정리했습니다.

#
SBERT와 Multilingual E5 임베딩 모델 분석
scroll to top