RCreddit.com·
暂不在当前实时榜单
Qwen3-VL 8B on a laptop vs Opus 5.5 / Sonnet 5 / GPT-5.6 on 137 messy documents: beat GPT-5.6 on tax forms, lost badly on Indian date formats[R]
A benchmark compared Qwen3-VL 8B Instruct (Q4_K_M) running on a laptop against Claude Opus 5.5, Sonnet 5, and GPT-5.6 Terra using 137 messy documents. Qwen3-VL 8B achieved a 59% success rate, outperforming GPT-5.6 Terra (57%) but falling behind Opus (89%) and Sonnet (85%). While Qwen3-VL 8B beat GPT-5.6 on tax forms, it struggled with Indian date formats. All raw outputs and tests are available on GitHub.
时间与来源
时间显示为 UTC
显示时区:UTC
本地时区尚不可用,暂时显示 UTC。
收录当时偏移:UTC+02026年9月28日 18:00 UTC
- 收录
- 2026年9月28日 18:00
- 来源类型
- 开发者社区
讨论趋势
→ 平稳
百分比基于采集到的讨论信号,不代表新增评论数或独立参与人数。曲线仅用于同一话题在不同时段的比较。
本站未收录正文。
前往源站阅读 →