Nvidia

51 篇报道

Nvidia 是一家设计图形与人工智能计算芯片与软件的公司。近期报道聚焦其 Vera Rubin NVL72 在 MLPerf Inference v6.1 的预览成绩、与 Google 和 Emerald AI 发起的 AI Energy Management Alliance、为 Salesforce 加速的 Nemotron 3 Super 与 Koa 推理模型、以及围绕 Anthropic Fable 数据保留和 Jensen Huang 在安全与监管上的表态。

相关话题

NVIDIA 推进原生 GPU Rust 编程

NVIDIA 宣布推进原生 GPU Rust 编程生态,推出两条路线:cuda-oxide(针对SIMT内核,需nightly和自定义LLVM)和cutile-rs(基于Tile、支持稳定Rust 1.89+与CUDA 13.3)。两者在编译期提供内存安全保障,cutile-rs已在HuggingFace的Grout和mistral.rs中使用。NVIDIA还计划实现与CUDA C++/Python的互操作。

Hacker News · · 详情

英伟达等限制Anthropic Fable涉敏感数据保留

受Anthropic在6月引入的客户使用日志保留政策影响,Nvidia、Palantir、Booz Allen等企业将Claude Fable 5限制用于非敏感任务或完全禁用,因政策允许在安全系统触发时保留日志至多两年。该变化显示数据保留条款已成为企业部署AI系统的关键考量。

PYMNTS.com · · 详情

2026:推理驱动的算力与硬件转向

到2026年,AI焦点从训练转向推理,推理负载因链式思路和代理式AI大幅上升,推动硬件厂商(如Tensordyne)推出面向推理的芯片(Napier),Nvidia在GTC 2026称这是“推理的拐点”。这意味着数据中心和厂商正为持续、频繁的推理请求调整产品与投资。

Hacker News · · 详情
NVIDIA@nvidia
247 赞 · 34 转发 ·
AI 正在改变我们构建、工作和发展经济的方式。 在 #AllInSummit 上,@JensenHuang 加入了 @theallinpod 讨论接下来会发生什么——从审慎的监管和开放模型到对 AI 基础设施的持续投资。 🎥 完整对话: [引用 @theallinpod]: THE ALL-IN SUMMIT 正在直播! @JensenHuang 加入 The Besties 现场!(并有一通来自 @POTUS 的传奇电话) -- AI 死亡论者骗局 -- 超智能已经到来? -- RSI 实际是什么 -- AI…

UkisAI 发布 Swift‑Qwen3.8‑27B 更快更省思考

UkisAI 在 Qwen 3.8 27B 基础上进行后训练,识别并惩罚导致“过度思考”的 token,结合 On‑Policy Distillation 将推理令牌减少 58%、速度提升 1.95 倍、准确率损失 <1%。模型开源于 Hugging Face,并提供由 NVIDIA 资助的免费 OpenAI 兼容 API(限速 5 RPM)。

r/LocalLLaMA · · 详情