RCreddit.com
16
·1天前·开发者社区 · RSS
llama.cpp support for Qwen3.8-Flash-Next has been merged
热度趋势
新上榜
百分比基于当前可用热度信号,而非评论数或独立用户人数。
Llama.cpp现已支持Qwen3.8-Flash-Next,用户可以下载GGUF文件。一位用户报告称,在下载Q4 GGUF后,其在配备4块3090显卡的系统上达到了每秒55个token的速度,并在评论中提供了相关视频。
UPDATE Q4 GGUF downloaded, I have 55 t/s on 4x3090, video in the comment