本地部署Qwen3.8-Flash-Next模型的两条路线:halogen(AI Max+ 395+128G 统一内存)对比 Strata(CUDA 12G 显存 + 64G 内存)
Fri 02 October 2026
·
LLM
本地部署Qwen3.8-Flash-Next模型的两条路线:halogen(AI Max+ 395+128G 统一内存)对比 Strata(CUDA 12G 显存 + 64G 内存)
阿里的 Qwen3.8-Flash-Next 开源之后,社区里想在自己机器上把它跑起来的 …