Qwen 3.8 27B 在本地推动三维游戏创作极限
一位用户用 Qwen 3.8 27B(q4xl)在本地 PI agent 环境下处理大型游戏设计文件,使用约120k 上下文并启用视觉与 MTP,读取约1100万 token 并写出320万 token,运行约12小时。作者表示这是将本地模型用于复杂游戏设计的示例。
模型、产品与 AI 创业公司的动态,相似报道只保留最可信的一篇
一位用户用 Qwen 3.8 27B(q4xl)在本地 PI agent 环境下处理大型游戏设计文件,使用约120k 上下文并启用视觉与 MTP,读取约1100万 token 并写出320万 token,运行约12小时。作者表示这是将本地模型用于复杂游戏设计的示例。
Meta在美国推出个人AI代理Muse,用户可按需连接邮箱、日历、支付、健康等应用,Muse由Meta的Muse Spark模型驱动并通过web、iOS、Android和WhatsApp提供。该代理可发送邮件、订票、下单并使用Link by Stripe完成结账,基础版免费并计划提供订阅。
Tech Transparency Project 报告称,Meta 在今年未能检测到332则含儿童性虐待材料(CSAM)的广告,其中多数推广来自中国的AI“nudify”应用。部分广告使用真实未成年人的照片并被AI合成成性行为视频,涉及欧洲皇室成员新闻照和一名14岁Instagram影响者的照片。
Google 发布了 WeatherNext 模型的第3版,主要改进是开始摄取部分卫星天气数据,从而缩短当前天气与生成新预报之间的滞后时间。该更新在白皮书中有详细说明,意在在更低算力下提高预报频率与准确性。
一群 Claude 订阅者对 Anthropic 提起扩展的集体诉讼,指控公司误导性宣传其 Max 高级订阅层级的使用限制。诉讼由前 FTC 官员 Monica Vaca 和 Kati Daffan 提起,案件旨在追究 Anthropic 在订阅承诺上的法律责任。
Qwen 发布了为自动驾驶微调的 Qwen-Drive-1.0,保留预训练视觉-语言架构并集成3D感知、视觉问答和运动规划。该模型的全 Bf16 检查点为 9B,并在 Hugging Face 仓库中链接到一篇约40页的技术报告。
OpenAI 展示 MIT 研究人员如何使用 GPT-5.6 Sol 与 Codex 联合,自治地运行量子计算实验、分析结果并校准量子比特。该演示说明 GPT-5.6 Sol 与 Codex 可用于实验自动化与分析工作流。
Reddit用户在r/LocalLLaMA发布了模型条目“nex-agi/Nex-N2.5-mini - 35b”。帖子仅列出模型名和参数规模(35B),未含其他细节。
Google Cloud与Accenture合作成立名为Accenture Gemini Enterprise Business Group的联合单位,将培训多达1000名前置部署工程师以在企业中构建定制AI应用并使用Gemini Enterprise平台。该组织将隶属Accenture。
inclusionAI 在 Hugging Face 发布 Ling-3.0-flash-VL,具备原生图像与视频理解、1M token 上下文窗口与 124B 总参数。模型每 token 激活约5.5B 参数,并采用稀疏 MoE 与混合骨干以提高长上下文多模态推理效率。
报道指出,阿根廷巴塔哥尼亚因气候凉爽、可再生能源和充足土地被视为大型AI数据中心的潜在地点。Pampa Energía 计划在内乌肯建最高500兆瓦设施,首批合同预计在2026年底确定;Green Capital 计划在Chubut起始300兆瓦。OpenAI 曾与Sur Energy 宣布项目但尚未签约。
ASML已说服台积电、三星和英特尔改用更大光罩,新一代EUV设备吞吐量预计提升约40%。同时,华为通过设备商Yuliangsheng及其供应商推动国产化对策,试图打破对荷兰光刻技术的依赖。
Chrome已将更新周期从四周缩短为两周,并随即发布Chrome 153,适用于桌面、iOS和Android。Google表示此举可更快修补安全漏洞并加速AI相关功能迭代,同时帮助缩短N-day补丁窗口。
一位用户发布了面向 LocalLLaMA 社区的 GPU 比价指南,包含 GB/美元、带宽和带宽/价格三张图表。作者说明价格来源于 ChatGPT,混合新旧价格,工具覆盖常讨论的几款 GPU。
开发者在 Galaxy Note 8(2017,6GB)上用 llama.cpp 运行 Qwen3-0.6B(Q4_K_M),通过中继驱动真实桌面 Chrome 并在三项任务中进行结构化页面感知与选择。Qwen3-0.6B 在多个测试上均取得 10/10 成绩;测试强调结构化感知比直接 HTML 更有效率。
Meta表示将不再以工程师使用AI工具的频次或代币计数作为绩效考核标准,内部备忘录由Maher Saba和Santosh Janardhan发布。公司称内部AI使用在2026年将导致数十亿美元成本,计划2027年推行预算和集中仪表盘,同时测试AI代理工具Hatch但遭到隐私方面的抵触。
Hugging Face 发布论文《Safety for Whom? Boundary-Aware Self-Distillation for Controlled LLM Safety Refusal》,指出现有安全工作以主题为单位拒绝请求会误伤安全子集,举例 LlamaGuard-3、基准 XSTest 与 OR-Bench 的相关失败模式。论文在政治提示构成的主题宇宙中形式化了“目标有害子集”与应答/拒绝边界,研究如何训练与衡量模型以在话题内精确拒绝有害子集而非整个话题。
法国AI实验室Mistral AI宣布完成30亿欧元的D轮融资,投后估值超过210亿欧元。本轮由Samsung Electronics领投,Scaleup Europe和现有投资者PSG Equity共同参与,Mistral表示将用于扩充算力、基础设施与国际化。
Google DeepMind 推出 AlphaGenome Atlas,预计算并展示了人类基因组中约 90 亿个单核苷酸变体的分子影响,供学术研究通过免费网站访问。DeepMind 还发布了 AVI(AlphaGenome Variant Impact)评分,将 AlphaGenome 与 AlphaMissense 的预测合并,便于对变体进行排序和解释。外部合作者已利用该资源在罕见病和常见性状研究中识别并实验验证关键变体。
Adobe 在 Premiere 中推出 Generative Media 工具,允许编辑在不离开项目时间线的情况下生成视频、音效、音乐和声景。新工具可在轨道上高亮空白区并生成与上下文相关的、可编辑的片段,优化编辑工作流。
OpenAI 发布文章《The Work Now Within Reach》,讨论更强、更廉价的人工智能如何扩展个人与企业可完成的工作量,并使经济增长更具成本效益。文章聚焦可及性与生产力影响。
DeepSeek 宣布内部测试 deepseek-v4.1-flash(标注为 expires-on-0910)的中间版本 V4.1 Flash 已开放内测,采用新架构支持原生多模态、更快更便宜。当前定价与 deepseek-v4-flash 相同,每账号并发限流为20。发布信息来自 Chubby 在 𝕏 的说明。
OpenAI 推出 ChatGPT Images 2.5,旨在将想法、草图与参考照片转化为更个性化、润色后的图像,以更好地反映用户创意与设想。
Danijar Hafner 在旧金山创立一家处于隐身状态的初创公司,致力于开发能在未遇到场景中规划的智能体,并在办公室展示多款从中国进口的人形机器人。Hafner 使用基于模型的强化学习训练世界模型,让智能体在模型中“想象”并适应未见真实环境。
NeurIPS Position Paper Track 使用专有AI检测器 Pangram 对投稿进行无人工复核的书面拒稿,导致18.4%(178篇)被撤回。检测器对主席作者的论文也有24%至69%打分,并曾将近半数提交标为90–100% AI,后通过调整设置将标记率降至12.7%。
OpenAI 分享了一份 AI 生成的 Navier–Stokes 千年难题解答,包含一篇写作说明与在 Lean 中的形式化证明。该材料公开了 AI 在数学问题求解与机器证明方面的应用示例。
OpenAI 设立总额 500 万美元的资助项目,支持独立研究项⽬,研究生成式 AI 对青少年发展、福祉与安全的影响,并公布现已开放申请。
1Password 报告称其工程团队使用 Codex 后,新功能与内部工具的开发速度提升,工程生产力提高 21%。案例同时提到在保持严格安全策略下实现生产就绪。
OpenAI 宣布扩大对新闻业的支持,提供工具、培训与合作伙伴关系,覆盖学生、教育者、记者与新闻机构等群体。
TechCrunch整理了一份AI术语词汇表,解释包括“AGI”“AI代理”“API端点”以及最近引发关注的“opaque recurrence”(OpenAI Astra模型中的推理技术)在内的重要概念。该词汇表将持续更新,以反映快速演进的领域。