返回
RCreddit.com
19
·15小时前·开发者社区 · RSS

Qwen3.6 35b Q2_XXS: Being GPU poor in 2026 is not so bad

查看原文
LlamaQwen模型发布

热度趋势

新上榜
最近 24 小时与此前 24 小时对比 · 7 天曲线

百分比基于当前可用热度信号,而非评论数或独立用户人数。

推荐理由

Llama 相关模型动态已经出现,适合跟踪能力变化、生态影响和后续可用性。

AI 摘要

一位开发者展示了即使在GPU资源有限的情况下,也能在24分钟内创建一款RPG游戏,取得了令人印象深刻的成果。这通过使用Qwen3.6 35b Q2_XXS模型,特别是Qwen_Qwen3.6-35B-A3B-IQ2_XXS.gguf文件,并通过llama-server.exe实现。该设置利用了-c 8192-n 8192--cache-type-v q8_0等参数,表明了高效的资源管理,最终生成了一个HTML文件输出。

llama-server.exe --host 0.0.0.0 --port 8080 -m models\qwen3.6-35b-Instruct\Qwen_Qwen3.6-35B-A3B-IQ2_XXS.gguf -c 8192 -n 8192 -tb 4 -b 512 -ub 512 --cache-type-v q8_0 --cache-type-k q8_0 -fa auto -ngl 0 --temp 0.0 --reasoning off

MODEL: https://huggingface.co/bartowski/Qwen_Qwen3.6-35B-A3B-GGUF/resolve/main/Qwen_Qwen3.6-35B-A3B-IQ2_XXS.gguf