cmp-170hx-vllm
Known-good vLLM recipe: Qwen3.8-27B-Int8 + MTP speculative decoding on NVIDIA CMP 170HX 64GB (Hynix) — 84 tok/s, 262k ctx
파일 탐색기
- gdn-prefix-caching-2026-08-23.md
- scope-longctx-ttft-2026-08-23.md
- sm80-int8-repack-cpu-fallback.patch
- vllm-pr50021-full-pr.diff
- vllm-pr50021-gdn-spec-bounds.patch
- bench-comprehensive.py
- booster-ab-test.py
- booster-proxy.py
- prod-cache-cliff.py
- prod-decode-speed.py
- prod-grown-prefix.py
- bench-comprehensive.py
- booster-proxy.py
- booster-watchdog.sh
- boot-recovery.sh
- LICENSE
- README.md
- serve-g3-int8df2.sh
- serve-qwen38-mtp.sh
- serve-qwen38-nightly.sh
# CDN으로 사용하기
jsDelivrjsDelivr는 공개 GitHub 리포지토리를 별도 설정 없이 CDN으로 즉시 서빙합니다. 버전과 파일을 고르면 웹페이지에 바로 붙일 수 있는 링크와 예시 코드가 만들어집니다.
링크
예시
// repository documentation
Was this content helpful?
(0 ratings)
