开源复现 Jev-like 模型并附游戏示例
开源项目发布了可对多个选项一次性打分的 Jev-like 小模型并附 Doom 与国际象棋示例;报告称 Doom 检查点在10个回合平均0.60击杀和-97.50奖励,棋类检查点对随机对手表现为4胜46和0负,但对 Stockfish level 0 为0胜2和48负。
AI 日报收录的 TypeSafe 相关报道,共 2 篇,按时间倒序,每小时更新。
开源项目发布了可对多个选项一次性打分的 Jev-like 小模型并附 Doom 与国际象棋示例;报告称 Doom 检查点在10个回合平均0.60击杀和-97.50奖励,棋类检查点对随机对手表现为4胜46和0负,但对 Stockfish level 0 为0胜2和48负。
TypeSafe 发布 System One 系列与首款模型 Jev,宣称在结构化决策任务上比现有大模型快 20–200×、成本低 40–400×,并采用新架构、并行采样与 RLCD 训练方法,首次推出早期访问。