Qwen3.8-Flash-Next-DGX-Spark
Deploy the quantized version of the 180B hybrid-MoE model on a single NVIDIA DGX Spark (GB10, 128 GB unified memory, no multi-GPU, no cluster) and serve it stably
파일 탐색기
- benchmarks.md
- benchmarks.zh.md
- deploy_playbook.md
- deploy_playbook.zh.md
- deployment-matrix.md
- deployment-matrix.zh.md
- mtp-tracker.md
- mtp-tracker.zh.md
- speculative-analysis.md
- speculative-analysis.zh.md
- merge-mtp-shard.py
- qwen4exp-mtp-draft-head.patch
- baseline.json
- dl_q4_parallel.py
- monitor.py
- mtp_bench_safe.sh
- probe_mtp.py
- q4_bench.sh
- qwen38-q3.service
- run_qwen38_q3.sh
- system_watchdog.sh
- warm_table.py
- .gitignore
- LICENSE
- README.md
- README.zh.md
# CDN으로 사용하기
jsDelivrjsDelivr는 공개 GitHub 리포지토리를 별도 설정 없이 CDN으로 즉시 서빙합니다. 버전과 파일을 고르면 웹페이지에 바로 붙일 수 있는 링크와 예시 코드가 만들어집니다.
링크
예시
// repository documentation
Was this content helpful?
(0 ratings)
