Kev:基于Qwen3.5的微型决策模型家族
开发者jaredpalmer发布Kev,一系列基于Qwen3.5的小型决策模型,提供0.8B、4B和9B参数版本,含预训练权重、训练代码与评测数据。模型支持是/否、多选和评分问题,可在CUDA与Apple Silicon上运行,4B和9B模型用bf16可装入32GB Mac,API与TypeSafe System One兼容。
模型、产品与 AI 创业公司的动态,相似报道只保留最可信的一篇
开发者jaredpalmer发布Kev,一系列基于Qwen3.5的小型决策模型,提供0.8B、4B和9B参数版本,含预训练权重、训练代码与评测数据。模型支持是/否、多选和评分问题,可在CUDA与Apple Silicon上运行,4B和9B模型用bf16可装入32GB Mac,API与TypeSafe System One兼容。
OpenAI Academy推出面向员工、开发者、管理者、教育者和学生的新学习路径,帮助其构建并展示实用AI技能。
MIT燃气轮机实验室发起JARVIS挑战赛,各团队用ChatGPT、Claude等AI工具在四周内设计、制造并测试小型喷气发动机,推力指标50至100磅;AI可大幅缩短设计周期,但人类工程判断仍是决定性因素。
欧洲数字权利组织NOYB呼吁成员国反对《数字综合法案》修正案,该案拟规定在AI开发与运营背景下处理个人数据可自动视为合法,可能使欧洲用户历史数据被AI公司几乎不受限使用。成员国预计本周末前反馈意见。
开发者volotat发布Mini-AGI,一个可在8GB显存消费级硬件上训练的持续学习模型。项目采用动态增删专家的MoE架构和单条连续数据流上的batch size 1训练,以降低显存需求并让个人掌控训练数据,目前模型仍在处理首批7.8B字符数据,作者称扩展曲线表现良好。
名为Heretic的开源工具通过pip安装即可移除语言模型的限制,使其始终遵循用户指令,该工具在Hacker News上引发讨论。
Hacker News讨论的一篇文章指出,AI聊天机器人在回答金融问题时的错误率很高,多数情况下给出错误答案。这凸显出金融机构部署聊天机器人时需谨慎对待其输出准确性。
一只业绩领先的T. Rowe Price基金正加大对大中华区AI供应链下游公司的投资,押注该地区投资周期仍有追赶全球趋势的空间。
欧洲人民党议员Adrián Vázquez延续Dario Amodei九月发起的讨论,指出AI正加速就业流失、权力集中、全球安全风险和注意力危机,呼吁紧急恢复教育者核心地位并强化学生认知能力。
美银全球研究亚太研究主管Chris Oberoi在香港BofA亚太会议期间,分享了对全球市场前景、AI投资主题及央行政策走向的看法。
华为云在上海发布AI Cluster Service,支持云端超40天稳定训练、10分钟故障恢复,token吞吐量较上代提升20%,并将于9月30日在中国、11月30日海外商用。同时推出Agentic MaaS平台、AgentArts智能体平台(已服务超100家企业)及行业AI铸造厂。
QBE参与的研究显示,约60%的商业领袖因担忧AI出错和故障而有意放缓部署,文章认为AI只有在企业能理解并管理风险时才会大规模采用,否则难以转化为生产力。
有Reddit用户对ICLR审稿政策提出疑问:政策规定名字出现在3篇及以上论文上就需担任审稿人,却未说明资格要求。发帖者担心,仅作为第四作者参与多篇论文的新生可能被要求审稿,却未必具备相应能力。
马里兰州州长Wes Moore呼吁美国联邦层面以两党合作方式对人工智能实施监管,反映州级官员对国家AI治理框架的诉求。
报道称Apple Intelligence在部分iPhone机型上最多占用14GB存储空间,反映端侧AI功能对设备存储的需求正显著上升。
AI Weekly发文警告企业注意Google AI Studio在数据留存方面的欺诈风险,提示企业核查相关条款与实践。
彭博社报道,澳大利亚将依靠人工智能的部署和发展来推动未来40年的经济增长,而这一时期的全球经济预计将更加碎片化和难以预测。
针对社区报告的安全问题,ZCode完成整改并在GitHub开源,涵盖桌面端、Web工作区、后端、Agent CLI和运行时。官方称未保留相关代码数据、未用于模型训练,经CAICT和NSFOCUS评估确认OSS桶已清空,v3.14.0移除了Repo Wiki功能及本地仓库快照上传流程。
Hacker News上出现一场讨论,探讨犹太教安息日规定是否允许AI智能体自动运行,涉及宗教律法与自动化代理的边界。讨论未形成统一结论。
一篇专栏文章反思生成式AI让人放弃独立思考,并引用MIT AI与教育委员会报告提出的“认知投降”概念,即学生面对难题时停止自主思考、不加批判地接受AI答案。
第23届中国—东盟博览会在南宁设立人工智能展馆,展示制造、智慧城市、医疗、金融、网络安全、农业和教育等领域应用。文章指出AI只有本地化、可信并嵌入日常工作才能创造价值,而东南亚1200多种语言构成翻译等技术瓶颈。
美国参议员迈克·朗兹在电视采访中称中国AI快速发展构成国家安全威胁,强调美国必须在AI技术上领先对手,并呼吁以平衡的监管方式促进本土创新。
据乌克兰国家通讯社报道,OpenAI首席执行官Sam Altman将在联合国安理会就人工智能带来的风险发表讲话。此举凸显AI安全议题正被推向国际最高安全决策层面。
Hugging Face推出tokenizers v1候选版,重点优化性能,称相比v0.23常快数十倍。团队称在大规模训练、高并发服务和长输入场景下,分词可能成为瓶颈,拖慢GPU利用效率。IBM、NVIDIA和ExecuTorch团队参与了补丁和跨硬件测试。
V7利用GPT-5.6将企业内部散落的文件转化为AI代理可用的上下文,使其能够完成复杂且可溯源的任务。这显示GPT-5.6正被用于企业知识管理和代理工作流场景。
富达国际的James Durance表示不愿买入为AI热潮提供融资的科技债券。此举显示部分债券投资者对AI相关债务持谨慎态度,尽管市场正大举发债支持AI基础设施建设。
杨百翰大学研究发现,AI生成的钓鱼邮件比人类撰写的更容易让人上钩:参与者仅52%能正确分辨作者,AI在80%的情况下点击率持平或超过人类,AI邮件欺骗率28%高于人类的21%。随着个人信息广泛公开,AI代理正被用于大规模生成此类定向诈骗。
一位Reddit用户分享,他用本地GLM 5.3 Flash(q4 qat)进行编码,其兄弟则使用GPT-6-Astra并对模型出错时大声斥责,两人截然不同的提示风格引发社区讨论。
jevals是一个开源工具,用类型化Jev决策模型替代LLM评判,为智能体提供评估和护栏。所有评估合并为一个HTTP请求,成本仅千分之一美分,响应时间几百毫秒,适合在每次追踪或智能体循环中运行。支持Jev、Kev、Laya及普通聊天LLM。
谷歌推出开源智能体编排系统AX,通过声明式YAML定义任务,为智能体提供沙箱隔离、工作区配置和网络策略,支持单任务或组合式智能体运行,并在集群上大规模扩展。该系统提供创建、挂起、恢复和删除等基本原语,旨在管理会累积状态并调用模型API的智能体任务。