谁来约束追求更安全的AI?
路透社通讯探讨各方都希望更安全的AI,但对谁应制定与执行约束性规则存在分歧,强调监管与治理仍是核心问题。
模型、产品与 AI 创业公司的动态,相似报道只保留最可信的一篇
路透社通讯探讨各方都希望更安全的AI,但对谁应制定与执行约束性规则存在分歧,强调监管与治理仍是核心问题。
南卡罗来纳州参议院就人工智能成立专门委员会并举行首次听证,讨论在政府、教育与执法中的AI使用、对生成式AI的政策必要性以及是否需为AI制定新法律。与会学者建议优先界定生成式AI并提出监管方向,委员会将在未来18个月内持续推进研究与公众意见征集。
讨论者问:当不同模型族面对同一欠定任务时常出现相同失败,是否有人把任务规格的模糊度量化并检验其作为预测独立求解器共同行为的指标,寻找相关论文或度量方法。
Meta正开发名为Luna的新款智能眼镜,去除了摄像头以回应隐私担忧,内置六个麦克风并能与公司的AI聊天机器人及Muse代理交互,可能在下周的Meta Connect发布。这一调整针对消费者对“偷窥眼镜”指责及Reality Labs持续亏损的背景具有重要意义。
报道称五角大楼在面对外界警告下仍加速推进人工智能相关工作与部署,此举反映美军对保持技术优势的紧迫感,但也引发安全与伦理担忧。
10家银行向支持Blackstone与Alphabet旗下云业务Crux AI的新公司提供总额220亿美元的芯片贷款,用于融资购买对AI至关重要的高端处理器。
路透讨论 AI 公司是否需要披露危险或失控事件,触及监管透明度与公众安全问题,反映监管层对 AI 事故通报规范的关注正在增加。
一篇由Ali Ansari等人参与的论文重新评估了前沿语言模型在六个物理学基准上的表现,采用专家审计并聚焦可验证的纯文本题目,指出现有评测存在问题。
佛罗里达医疗系统广泛采用AI以优化行政与远程医疗,但律师与监管者警告隐私与法律风险增加。坦帕地区研究显示远程医疗完成率73.4% vs 64.2%(线下)。
Reddit用户发帖配图表示“我不再GPU贫穷”,为个人升级显卡或挖矿等趣味性分享,帖文来源为r/LocalLLaMA。信息主要为用户自述与配图展示,无更多技术或商业细节。
AWS发布文章介绍通过开源agent技能提升健康与生命科学(HCLS)领域AI推理能力,展示在特定垂直领域应用中增强AI工具的实践方法和框架。
WIRED 报道称作者用开源果蝇大脑图构建网站 PitchFly,将神经映射转化为生成故事头条的模型,产生的建议风格奇特且富有想象力,展示了生物神经结构在创意生成上的探索价值。
一位咖啡店主使用AI制作菜单海报后在社交平台收到愤怒私信,讨论见Hacker News与Business Insider链接。
AWS 博客介绍如何在 Amazon EKS 上使用 NVRx 实现容错的分布式训练,提供可用于提升训练可靠性的工程实践和部署示例,对运行大规模训练作业的团队有参考价值。
论文由Faizan A Khattak等人撰写,描述对AMD三代GPU(CDNA1/2/3,MI100/MI210/MI250/MI300A/MI300X)矩阵乘算器的数值行为建模与验证,使用了1000万组随机测试向量进行位级可重复性验证。
斯坦福医学院团队发布 Paper2Agent,将科学论文(含文本、图表与数据)转成可回答问题并与其他论文代理交互的 AI 代理,相关论文发表于 Nature,作者包括 Jiacheng Miao 与 James Zou。
一项实验用4B参数模型结合监督微调与强化学习生成Postgres查询计划,报告称在113个复杂连接查询上实现平均44.7%延迟降低,文中提及最高可达81%加速。
开源项目发布了可对多个选项一次性打分的 Jev-like 小模型并附 Doom 与国际象棋示例;报告称 Doom 检查点在10个回合平均0.60击杀和-97.50奖励,棋类检查点对随机对手表现为4胜46和0负,但对 Stockfish level 0 为0胜2和48负。
The Economist 报道称人工智能在若干预测任务上已超过一些顶级人类预测者,显示 AI 在预测与决策支持领域的竞争力和应用潜力。
一篇HN讨论报道一家具成长迅速的德国AI初创公司决定将母公司从美国迁出,暗示其国际架构发生变化。
加州签署超过13项法案,涵盖人工智能、在线青少年安全与隐私保护,旨在通过立法应对AI相关的未成年人与隐私风险。
CNBC 报道中 Anthropic 的政策负责人表示,不能期望 AI 公司仅靠“诚信守则”自我约束,强调需要更严格的监管或制度来管理行业行为。
在 AI 实验室寻求第三方审计声浪下,网络安全专家建议先强化日志、权限等基础防护,认为强化内部控制比外包审计更可能降低事故风险。该讨论源自对 Anthropic 等公司的安全承诺需求。
前白宫高级经济顾问Stephen Moore表示,AI行业对美国经济影响重大,原因包括大量投资和数据中心建设热潮,他对美国经济前景持乐观态度。
Bloomberg分析行业领袖呼吁放慢所谓前沿模型的开发,讨论他们向美方政府的要求以及企业自身能采取的节奏管理措施,解读这一呼声背后的动机与可能影响。
研究者用携带视频与传感器的追踪器和机器学习模型分析了23只北大西洋右鲸的运动数据,模型与人工判定一致率95%。结果显示鲸类每日平均喂食11.4小时,喂食时间占比在11%至76%之间,夜间在水面近处觅食,增加与船只碰撞的风险。
美国主教会议与科技界会面后成立“保有人性尊严”AI专责小组,任命圣何塞主教Oscar Cantú为主席,目标推动保护人性尊严、宗教自由、工人和弱势群体的政策与实践。
Anthropic 报告称一名与伊朗有关的对手使用 Claude 等美国开发的AI来汇聚公开情报、识别美军海军位置并提出打击建议;该账号被禁并向美方通报。专家警告,AI正使敌对方更高效分析公开数据并改进监视与打击能力。
加拿大全球与数字主权成焦点,人工智能部长Evan Solomon称若不在本国发展AI将不得不“向邻居租用”技术,倡导与价值观相近国家合作;Mila与德国AI研究中心将加深合作。
Google DeepMind成立Deepmind Institute(DMI),由Demis Hassabis、Shane Legg与James Manyika领导,汇集艺术、人文与政策等领域专家,与技术人员共同研究AGI相关的安全、治理与控制风险等重大问题。