RCreddit.com
12
·16小时前·开发者社区 · RSS
Are we getting Qwen 3.8 35-A3B?
热度趋势
趋势数据积累中
百分比基于当前可用热度信号,而非评论数或独立用户人数。
这条记录涉及生成能力或端侧推理进展,适合跟踪模型效率、部署门槛和应用机会。
一位Reddit用户推测Qwen 3.8可能会在今天发布,预计它将是一个27B的密集模型。这意味着此次更新将不再支持MoE卸载,而该用户曾利用此功能在RTX 3060上以70 tok/s的速度运行Qwen 3.6 35B-A3B。用户指出,卸载密集模型的情况完全不同,其速度可能会“慢100倍”甚至更慢,这将对性能产生显著影响。
So far, it seems like Qwen 3.8 might drop today as a 27B dense model. If that’s the case, no MoE offloading this time, I used to run Qwen 3.6 35B-A3B at around 70 tok/s on an RTX 3060, but offloading a dense model is a completely different story it can be 100× slower or Even slower