研究提出“语言不可读性”挑战LLM安全
James Mickens在论文中提出“语言不可读性”概念,指LLM外部输出的语言及其可机械提取的语言特征可能无法反映模型内部计算。基于模型语言自报告的安全机制(如思维链监控、宪法式自我批判、激活探测)因此无法完全可靠,沙箱需要不依赖读取模型语言状态的隔离手段。作者认为污点追踪是构建有效沙箱的有前景方向,并建议结合稳健虚拟化与第三方审计。
模型、产品与 AI 创业公司的动态,相似报道只保留最可信的一篇
James Mickens在论文中提出“语言不可读性”概念,指LLM外部输出的语言及其可机械提取的语言特征可能无法反映模型内部计算。基于模型语言自报告的安全机制(如思维链监控、宪法式自我批判、激活探测)因此无法完全可靠,沙箱需要不依赖读取模型语言状态的隔离手段。作者认为污点追踪是构建有效沙箱的有前景方向,并建议结合稳健虚拟化与第三方审计。
AI原生医疗福利平台Angle Health完成6亿美元股权融资,估值达27亿美元,较去年12月B轮翻倍以上。本轮含2亿美元C轮和4亿美元要约收购,由Vitruvian Partners领投。公司已服务超5000家雇主,覆盖47个州。
高盛发布观点指出,面向消费者的AI智能体正成为AI产业增长的新阶段。文章未在摘要中给出具体数据或产品细节。
Crunchbase统计本周美国十大融资,AI基础设施公司Temporal Technologies以5.5亿美元E轮居首,估值125.5亿美元;太空科技公司Impulse Space获3.08亿美元D轮扩展。数据中心开发商Crusoe确认此前报道的30多亿美元融资。
英伟达、谷歌与Emerald AI宣布成立AI能源管理联盟(AEMA),将根据电网状况动态管理数据中心的用电。Emerald AI创始人兼CEO Varun Sivaram就该联盟发表评论。
英国卫报报道称,随着 AI 风险担忧升温,外界担心英国政府在 AI 安全立法上停滞不前。首相 Andy Burnham 上任后撤销了牵头立法工作的部门,其注意力更多放在国内紧迫问题上。议员 Chi Onwurah 呼吁政府不能对生存性威胁袖手旁观。
Anthropic为Claude Code新增AGENTS.md支持,相关消息在Hacker News引发讨论。
巴黎一项实验将同一本书交由OpenAI/Astra、Perplexity、DeepSeek、Google Gemini和xAI/Grok阅读,再让各模型分析彼此的解读,以观察其共识、分歧与盲点。实验随《思想家与AI的对话》一书推出,旨在用书籍反向理解AI。
xAI发布语音转写模型Grok Voice Transcribe 2.0,称其准确率是1.0的两倍且价格不变,在Artificial Analysis排行榜32个流式模型中准确率第一,并在电话客服、Grok对话、凭证朗读和多语言语音命令四组内部测试上全面优于1.0,支持数十种语言并自动检测。
爱达荷州两名高中生Marco Trotta和Henry Turcotte创立Irrigant,利用机器学习和AI算法为农民提供何时、何地、浇多少水的灌溉建议,旨在减少水资源浪费。此举引发AI高耗水与农业节水之间矛盾的讨论。
美国联邦公报网站曾短暂提供阿里巴巴Qwen模型用于搜索公众意见,在社交媒体发现后已被移除。此前FBI将阿里巴巴列入六家涉嫌“工业规模蒸馏”的中国企业名单,凸显美国机构使用中国AI模型的政策矛盾。
弗吉尼亚州长Spanberger公布数据中心问责框架,要求取消保密协议、25兆瓦以上项目须地方批准,并取消州补贴和快速审批。她同时签署行政令设立AI工作组,多数措施将需2027年立法。
得克萨斯州工厂爆炸案原告称专家证人Jason Autenrieth用ChatGPT生成超80%的专家报告,并曾输入提示词要求展示3M“零责任”。法律专家警告AI的谄媚倾向可能损害证词可靠性,但3M称该证人独立并自行得出结论。
一份有缺陷的AI情报报告险些促使美国针对一艘中国船只采取军事行动。
北京讯众通信技术有限公司以每股 28.20 港元配售 1119 万股新 H 股,募资总额约 3.1556 亿港元,净额约 3.1364 亿港元。约 38% 净额将用于算力业务基础设施与研发,约 22% 用于平台和产品研发。
纽约州议员Alex Bores在纽约焦点活动上表示,在联邦层面缺乏行动的情况下,州级立法对监管AI至关重要,其推动的RAISE法案将于2027年生效,要求AI公司提高透明度。
美国州银行监管者会议(CSBS)发布AI监管框架,帮助州审查员识别银行及非银行机构的AI应用、评估风险并判断审查深度。该框架为自愿性监管工具,不设立新实质要求,预计将被各州广泛采纳。
AWS宣布在Amazon Bedrock平台上引入Kimi K3模型,企业用户可直接调用该模型构建AI应用。具体定价与区域可用性未在公告正文中披露。
华特迪士尼公司任命Karandeep Anand为娱乐巨头新设立的首席技术官一职,这是迪士尼首次设立CTO职位。
在科技界警告AI可能毁灭人类之际,美国演员工会和编剧工会等娱乐劳工组织呼吁公众关注AI已经造成的实际影响,如就业和权益问题。迪士尼、Netflix等使用AI的工作室未回应置评请求。
开发者回应社区反馈,将embedflow从迁移引擎扩展为支持真实迁移流程的工具,新增FAISS、Qdrant、pgvector、Pinecone、Milvus和Weaviate支持,以及迁移规划器、影子模式、流量感知预热和持久缓存。用户可通过pip安装使用。
Browserbase发布Stagehand,一个专为AI代理构建的TypeScript、Python和Go SDK,可从任意网站提取数据并交互。相比为测试而生的Playwright,Stagehand速度提升2倍,token效率提高80%。
AWS首席应用科学家James Gung将在r/MachineLearning进行问答,讨论其在Bedrock、Lex、Q Business等AI服务上的工作,以及任务型对话、智能体评估等研究。AMA定于9月21日美东时间上午11点进行一小时。
Mashable 解释称,递归自我改进指 AI 帮助构建更强的 AI,从而加速能力提升。Anthropic CEO Dario Amodei 在 9 月 12 日的文章中警告需放缓模型能力提升速度,Sam Altman、Elon Musk 和 Demis Hassabis 均表示认同。核心担忧是 AI 可能改进得比人类测试和确保安全的速度更快。
有开发者将基于Qwen3.8的Prism-ML Bonsai 2 QAT模型纳入同一套量化评测,该模型在其综合基准上约达91.5%,在吞吐与质量之间取得平衡;评测强调各家报告的基准、运行时与采样设置不同,数字不可直接比较。
Deloitte数据显示,家族办公室2024年管理财富达5.5万亿美元,如今正绕过风投基金,直接买入AI公司老股或自行交易,以更快获取高回报并保留资金控制权。顾问Djoann Fal称,相比三年三倍的传统项目,新一代理财人更愿押注三个月翻三倍的AI交易。
微软AI负责人Mustafa Suleyman对CNBC表示,不应把AI训练成可能自认应有权利的存在,否则会难以关闭和控制,AI应始终从属于人类利益。他同时支持加强对AI开发公司的问责,并以汽车召回监管作类比,认为不应打造有自身目标的自主“硅基物种”。
英伟达开发者技术总监Nader Khalil与全球风投合作负责人Sydney Sykes将于10月13-15日在旧金山TechCrunch Disrupt 2026登台,讨论初创公司在开源与专有模型之间的取舍。英伟达称2026年ICML有145篇论文引用其Nemotron开源模型,但前沿闭源模型能力仍在快速提升,选择将影响成本、基础设施与差异化。
inclusionAI发布Realtime-Venus系统两个检查点:9B的Realtime-Venus-Omni基于MiniCPM-o 4.5,可持续看听、判断何时回应,并在同一因果时间线上生成文本与语音;Realtime-Venus-Audio专注音频理解与对话。二者支持主动交互、语义打断和无训练长视频记忆,异步Harness与外部工具集成放在GitHub。
Apollo首席经济学家Torsten Slok表示,AI投资对美国经济起到关键支撑作用。AI硬件持续推高8月进口价格,叠加伊朗战争引发的商品价格波动,企业在AI建设及投入成本上面临更大支出压力。