8G GPU 运行35G大模型
使用8G3070显卡+32G内存运行35G模型,运行的是Qwen3.6-35B-A3B,一调用用MOE激活爸爸,这样CPUGPU混合工作。下面是我LMstudio配置。
LMstudio 配置。

运行时的CPU 和GPU 内存 使用情况

运行AI实际结果,实际我这是是15个token/S

使用8G3070显卡+32G内存运行35G模型,运行的是Qwen3.6-35B-A3B,一调用用MOE激活爸爸,这样CPUGPU混合工作。下面是我LMstudio配置。
LMstudio 配置。

运行时的CPU 和GPU 内存 使用情况

运行AI实际结果,实际我这是是15个token/S
