서빙 · 알고몽 35B
공개 채팅은 알고몽 35B (mong-vllm)입니다. 온프레미스 vLLM · NVFP4. 파인튜닝이 아니고 재단 모델도 아닙니다. 엔진을 하나 더 띄우지 않습니다.
알고몽 35B이 공개 대화·코딩·자율개발의 라이브 두뇌입니다. 알고몽 Ko는 한국어 LoRA 이름이며 학습되어 있지만 아직 채팅에 연결되어 있지 않습니다. 처음부터 만든 파운데이션이 아닙니다.
| 스펙 | 알고몽 35B | 알고몽 Ko |
|---|---|---|
| 이름 | 알고몽 35B | 알고몽 Ko |
| id | mong-vllm | algomong-ko |
| 베이스 | Qwen3.6-35B-A3B | Qwen2.5-7B-Instruct |
| 양자화 | NVFP4 | — |
| 서빙 | vLLM · 라이브 | 미서빙 |
| LoRA | 없음 | LoRA r=16 α=32 |
| 샘플 | — | 18,118 |
| 학습일 | — | 2026-08-26 |
| 재단 | 아님 | 아님 |
공개 채팅은 알고몽 35B (mong-vllm)입니다. 온프레미스 vLLM · NVFP4. 파인튜닝이 아니고 재단 모델도 아닙니다. 엔진을 하나 더 띄우지 않습니다.
알고몽 Ko (algomong-ko)는 Qwen2.5-7B-Instruct 위 LoRA (r=16) 입니다. 18,118개 한국어 샘플, 2026-08-26 학습. 학습되어 있으나 라이브 채팅 두뇌가 아니며, 35B 서빙 가중치에 붙이지 않습니다.
작은 온프레미스 SKU는 Ollama로 서빙합니다. 공개 채팅 두뇌가 아니며, 라이브 대화가 여기로 넘어가지 않습니다.
평가 전용 경로는 POST /api/eval/v1/chat/completions 입니다. 게스트 채팅과 같은 길이 아니고, 순위를 붙여 팔지 않습니다.
바로 말해 보시겠어요? 대화 · 작업 컴퓨터 · 워커 허브
W-WEBSOFT 온프레미스에서 돌아가는 한국어 어시스턴트입니다. 대화, 워커, 기억을 한 곳에서 씁니다. 공개 대화는 알고몽 자체입니다.