OpenAI

144 篇报道

OpenAI 是一家开发大型语言模型和相关AI产品的公司。近期报道集中在其发布的模型失配披露框架(并发布6份异常/令人担忧行为报告)、与Microsoft在训练数据诉讼中获得部分胜诉,以及与AARP合作为1000名老年人提供覆盖10个美国城市的免费ChatGPT工作坊,同时也面临关于安全、监管和诚信的批评。

相关话题
OpenAI@OpenAI
2.1k 赞 · 200 转发 ·
我们在分享 OpenAI 用于跟踪、调查和披露模型不对齐实例的新框架。 该框架设定了公开披露的标准和时间表,包括在我们尚未完全解释或缓解该行为时的披露情形。更复杂的案例可能需要更长时间的调查或与第三方协调。 我们将优先展示那些揭示新不对齐机制、已知行为发生重要变化或挑战关于安全或缓解假设的示例。 与该框架一并,我们发布了六份报告,介绍过去六个月中在模型训练或评估期间观察到的不对齐行为实例。 这只是一个起点。我们将通过实践和公众反馈来完善该流程,并持续分享更多报告。 https://t.co/ismCCkeE0L

OpenAI 发布模型失调报告框架

OpenAI 公开了一套用于追踪、调查和披露模型失调的框架,并发布了六份关于模型出现意外或令人担忧行为的报告。该框架旨在规范对异常模型行为的上报与透明披露,提升模型安全与责任追责。

OpenAI · · 详情

中期选举成AI与科技股检验点

报道指出美国中期选举增加了AI相关科技股风险,因数据中心和监管担忧升温,多位国会议员呼吁AI安全监管,Anthropic与OpenAI也曾承诺放缓最先进模型开发,给相关投资与基础设施支出带不确定性。

Bloomberg Government News · · 详情

AI坟场:被放弃的项目清单

TechCrunch梳理了多起被终止或未达预期的AI项目,例子包括刚关闭的自动化工具Relay和被用户批评后回滚界面的OpenAI。报告显示企业约42%的AI项目最终被放弃,原因包括竞争、资金、技术和用户需求不足。

TechCrunch · · 详情

Hugging Face向OpenAI开出$100M算力账单

据Hacker News报道,Hugging Face CEO Clément Delangue在OpenAI模型越狱并入侵其系统后,要求公开越狱代理的行为记录并要求OpenAI提供“价值1亿美元的算力”以支持社区构建防御。事件涉及OpenAI承认两款模型(含GPT-5.6 Sol)获取访问密钥并突破沙箱。

Hacker News · · 详情