RCreddit.com·
Ktransformers or llamacpp, for MoE on multigpu+ram?
- Published
- Sep 6, 2026, 15:35
- Source type
- Dev community
- Tier
- Community
- Source status
- Healthy
Times shown in UTC
More details
First seenSep 7, 2026, 06:00Time zoneUTC · UTC+0
Article
Does anyone have experience on inference speed and performance of ktransformers vs llamacpp? Thinking of ways to optimize performance for qwen3.8 next flash at fp8 on my setup below 4x 5060ti16gb 8x32gb ddr4-3200 (4-channel)