返回RCreddit.com12小时前Qwen3.8-Flash-Next-oQ4e-mtp: 45 tok/s on M4 Max, 25 tok/s on M2 Ultra for local inference — llm-bench.io查看原文端侧推理inferenceqwen3时间与来源发布09/06 08:42收录09/06 16:00来源类型开发者社区档位社区信源状态正常档位是按信源手工设定的编辑判断,不是逐条打分。Qwen 3.8 Flash Next gives similar speed than Qwen3.8 27B on Apple Silicon.