Skip to content
RCreddit.com·

Ktransformers or llamacpp, for MoE on multigpu+ram?

Time & source
Published
Sep 6, 2026, 15:35
Source type
Dev community
Tier
Community
Source status
Healthy
Tier is a per-source editorial setting, not a per-item score.

Times shown in UTC

More details
First seenSep 7, 2026, 06:00Time zoneUTC · UTC+0
Article

Does anyone have experience on inference speed and performance of ktransformers vs llamacpp? Thinking of ways to optimize performance for qwen3.8 next flash at fp8 on my setup below 4x 5060ti16gb 8x32gb ddr4-3200 (4-channel)

Source·reddit.com·reddit.com·Full text via RSS