第 2026-10-05 期 · 行业追踪 · 研究 · 模型发布

网友讨论Qwen 27B表现为何超越GPT-4o

r/LocalLLaMA上有用户发帖疑问,为何参数规模仅27B的Qwen表现如此出色,而拥有万亿参数的GPT-4o反而更差。帖子猜测可能源于更高质量的预训练数据或新技术。

r/LocalLLaMA22 小时前
查看原文 ↗