跳到正文
RCreddit.com·
暂不在当前实时榜单

ggml-cuda: assign four GDN state columns per warp by SongXiaoXi · Pull Request #30087 · ggml-org/llama.cpp

AI 摘要

A recent pull request, #30087, titled "ggml-cuda: assign four GDN state columns per warp by SongXiaoXi," has been submitted to the ggml-org/llama.cpp repository. This update aims to significantly speed up Qwen 3.x prompt processing. Performance tests show a +5.5% improvement for pp512 and a +5.3% improvement for pp4096, with a minor +0.1% change for tg128, indicating substantial gains in prompt processing efficiency.

为什么是这条

This update specifically targets Qwen 3.x, unlike previous general optimizations, and shows a notable +5.5% speedup in prompt processing for pp512.

时间与来源

时间显示为 UTC

显示时区:UTC

本地时区尚不可用,暂时显示 UTC。

收录当时偏移:UTC+02026年10月8日 10:00 UTC

收录
2026年10月8日 10:00
来源类型
开发者社区

讨论趋势

→ 平稳
最近 24 小时与此前 24 小时的快照均值对比 · 7 天曲线

百分比基于采集到的讨论信号,不代表新增评论数或独立参与人数。曲线仅用于同一话题在不同时段的比较。

本站未收录正文。

前往源站阅读 →
来源·reddit.com