Qwen3.8-Flash-Next在Strix Halo实现1M上下文
开发者发布halogen 0.12.0更新,修复长上下文性能衰减。在Ryzen AI Max+ 395与128GB内存上,100万token上下文的解码速度从27.3提升至38.3 tok/s,预填充耗时约18分钟。
AI 日报收录的 halogen 相关报道,共 1 篇,按时间倒序,每小时更新。
开发者发布halogen 0.12.0更新,修复长上下文性能衰减。在Ryzen AI Max+ 395与128GB内存上,100万token上下文的解码速度从27.3提升至38.3 tok/s,预填充耗时约18分钟。