第 2026-09-28 期 · 行业追踪 · 研究 · 模型发布 · 开源
Qwen3-VL 8B笔记本运行可与顶级模型匹敌,但特定任务存短板
一项基准测试显示,在笔记本上运行的Qwen3-VL 8B(Q4量化)处理137份杂乱文档时,完全正确率为59%,超过GPT-5.6 Terra的57%,但低于Claude Opus 5.5的89%和Sonnet 5的85%。该模型在美国税表上表现优异(21/32对7/32),但在印度日期格式和长合同上表现较差。
查看原文 ↗一项基准测试显示,在笔记本上运行的Qwen3-VL 8B(Q4量化)处理137份杂乱文档时,完全正确率为59%,超过GPT-5.6 Terra的57%,但低于Claude Opus 5.5的89%和Sonnet 5的85%。该模型在美国税表上表现优异(21/32对7/32),但在印度日期格式和长合同上表现较差。
查看原文 ↗