NVIDIA推出AIPerf大规模测试LLM推理速度
NVIDIA发布AIPerf,替代GenAI-Perf,采用多进程ZMQ架构绕过Python GIL限制,可更准确测试LLM推理速度,支持超15种端点类型和多种数据集。
AI 日报收录的 Baseten 相关报道,共 2 篇,按时间倒序,每小时更新。
NVIDIA发布AIPerf,替代GenAI-Perf,采用多进程ZMQ架构绕过Python GIL限制,可更准确测试LLM推理速度,支持超15种端点类型和多种数据集。
Baseten 的研究机构 Base Labs 与 Hugging Face 和 Goodfire 联手,推出面向开放权重模型的安全评估与监测基础设施,旨在把安全性在模型训练与部署中内置化以对抗“abliteration”带来的风险。Hugging Face 已列出逾6000个被“abliterated”的模型;Baseten 今年6月完成15亿美元F轮融资,估值130亿美元。