GitHub 저장소 URL
https://github.com/mobilint/vllm-mblt
분류 (모듈)
infra-computing (인프라 & 컴퓨팅)
카테고리
ai-accelerator (AI 가속기 (GPU/NPU 등))
설명 (선택)
Mobilint NPU 런타임을 vLLM에 연동하는 out-of-tree 플러그인으로, vLLM을 수정하지 않고 mblt 플랫폼과 워커를 등록합니다. Llama, HyperCLOVAX, EXAONE, Qwen2/3, Qwen2/3-VL 계열 모델을 OpenAI 호환 API로 서빙하며 vLLM 0.11.2에 고정되어 있습니다.
체크리스트
추가 컨텍스트 (검토용)
- 기업/기관: 모빌린트 (NIPA 국내 기업 AI 오픈소스 목록, 엑셀 96행)
- Stars: 12
- Forks: 2
- License: Apache-2.0
- Language: Python
- Topics: ai-accelerator, mobilint, npu, quantization, vllm, vllm-plugins
- Homepage: N/A
- Last Pushed: 2026-09-21
- koreanSupport: false (README 영어 전용)
- 제안 태그: vllm-plugin, npu, llm-serving, openai-compatible, mobilint
Star 기준(1,000개)과 무관하게 국내 프로젝트 목록 등재를 위해 등록하는 이슈입니다. HuggingFace URL 항목은 HF 지원 PR이 머지된 뒤에 /approve 해야 합니다.
분류 근거
- 엑셀 분류: 인프라 & 컴퓨팅 > AI 가속기(GPU/NPU 등) → 검토 결과 적절
- vLLM 자체가 아니라 Mobilint NPU를 vLLM 플랫폼으로 등록해 주는 하드웨어 백엔드 플러그인이므로 AI 가속기 카테고리가 맞습니다(같은 성격의 vllm-rbln, 14행과 동일 분류).
GitHub 저장소 URL
https://github.com/mobilint/vllm-mblt
분류 (모듈)
infra-computing (인프라 & 컴퓨팅)
카테고리
ai-accelerator (AI 가속기 (GPU/NPU 등))
설명 (선택)
Mobilint NPU 런타임을 vLLM에 연동하는 out-of-tree 플러그인으로, vLLM을 수정하지 않고 mblt 플랫폼과 워커를 등록합니다. Llama, HyperCLOVAX, EXAONE, Qwen2/3, Qwen2/3-VL 계열 모델을 OpenAI 호환 API로 서빙하며 vLLM 0.11.2에 고정되어 있습니다.
체크리스트
추가 컨텍스트 (검토용)
분류 근거