据 AMD 官方博客,AMD 今日宣布在 Qwen3.8 27B 模型发布首日提供支持,使用户能够通过 llama.cpp 等开源框架,在搭载 AMD Ryzen AI Max+ 处理器的设备和配备 32GB 显存的 Radeon AI PRO R9700 显卡上进行本地推理。初步测试显示,Ryzen AI Max+ 395 的推理速度可达 24.5 tokens/s,而 Radeon AI PRO R9700 可达 51.8 tokens/s。用户还可以通过 LM Studio 快速测试该模型。