四款AI模型操控《毁灭战士》基准测试结果公布
一项实验让Jev、Laya、微调ModernCE和微调Qwen3.5-4B在ViZDoom中自主游玩,比较击杀、生存时间与响应延迟。微调Qwen3.5-4B平均击杀3.63,表现最佳;Jev平均生存5.63秒,p95延迟约200毫秒。所有模型均未针对Doom专门训练。
Laya 是一个由开发者发布的开源非自回归决策模型,2025 年 3 月通过 arXiv 论文、Hugging Face 权重和公开数据集公开,可在 100 多种语言下实现低于 35 毫秒的推理。近期内容围绕 Laya 与 TypeSafe AI 推出的 Jev 的对比展开:有开发者称自己的模型被重新包装为突破,另有测试在 ViZDoom 基准上比较了 Laya、Jev、微调 ModernCE 和微调 Qwen3.5-4B,其中微调 Qwen3.5-4B 平均击杀 3.63 最高,Jev 平均存活 5.63 秒。
一项实验让Jev、Laya、微调ModernCE和微调Qwen3.5-4B在ViZDoom中自主游玩,比较击杀、生存时间与响应延迟。微调Qwen3.5-4B平均击杀3.63,表现最佳;Jev平均生存5.63秒,p95延迟约200毫秒。所有模型均未针对Doom专门训练。
一位开发者称,他早在2025年3月就通过arXiv论文、Hugging Face权重和开源数据集发布了基于强化学习的非自回归决策模型Laya,可在35毫秒内完成推理并覆盖100多种语言。他指责由前OpenAI成员创立的前沿实验室TypeSafe AI在2026年9月推出的同类产品Jev未附论文、开源权重或训练数据,却将其包装为全新突破。
Reddit用户发布开源小型模型Laya(421M参数),声称在Jev基准中超越所有指标,模型在单块RTX 6000 Pro上训练并提供HF空间与代码仓库供测试与复现。