MODELS

알고몽이 실제로 쓰는 기법

자체 개발은 제품과 한국어 어댑터입니다. 라이브에 있는 경로만 적습니다.

vLLM

vLLM

공개 채팅 두뇌. NVFP4 35B, PagedAttention.

/chat
QLoRA

한국어 QLoRA

지시 데이터 어댑터 파이프라인. r=16. 재단 학습 아님. 라이브 서빙은 NVFP4 35B.

학습 파이프라인
sLLM

sLLM

작은 GPU·폐쇄망 납품. 게스트 폴백 아님.

온프렘 SKU
NVFP4

NVFP4

한 장 GPU에서 35B를 올리는 서빙 포맷.

라이브 가중치
Eval API

Eval API

벤치용 chat completions.

/api/eval
Agent OS

에이전트 OS

워커 5종 + 루틴.

/system
대화로 확인 시스템