用 4 张 V100 跑 Qwen3.8-Flash-Next家里的 Local AI 服务器是一台 Supermicro 双路 AMD EPYC 7K62:96 核、512GB ECC 内存。这篇用到其中 4 张 V100 PCIe 32GB,卡间没有 NVLink;推理服务跑在分配了 48 vCPU、160GiB 内存的 LXC 容器里。最近它常驻运行 Qwen3.8-Flash-Next 的 Uncensored …2026年9月27日 · 约 1 分钟阅读