目前在我的台式机上(AMD Radeon 7600 XT 12GB + NVIDIA 1080 8GB)运行 Qwen 3.8 27B,使用 llama.cpp / pi coder,分配了 7:1 的 AMD/NVIDIA tensor 分割(预填充速度约为 129 tok/s,解码速度约为 16.0 tok/s)。
这玩意儿在某种程度上是可用的,但我在想,其他使用本地LLM进行游戏开发的人做了什么不同的事情/你的整体设置是什么样的。
目前在我的台式机上(AMD Radeon 7600 XT 12GB + NVIDIA 1080 8GB)运行 Qwen 3.8 27B,使用 llama.cpp / pi coder,分配了 7:1 的 AMD/NVIDIA tensor 分割(预填充速度约为 129 tok/s,解码速度约为 16.0 tok/s)。
这玩意儿在某种程度上是可用的,但我在想,其他使用本地LLM进行游戏开发的人做了什么不同的事情/你的整体设置是什么样的。
评论 (0)