行业追踪

全部内容 · 按时间倒序

模型、产品与 AI 创业公司的动态,相似报道只保留最可信的一篇

Anthropic考虑IPO前推出新AI模型

路透社报道,Anthropic正考虑在IPO前发布新AI模型,以应对OpenAI的GPT-6 Astra带来的竞争压力。其7月年化收入达650亿美元,投资者预计年底超1200亿美元,但IPO估值预期在1.5万亿至4万亿美元之间,分歧巨大。

pymnts.com · · 详情

HN热帖:我不再盲信AI

一篇Hacker News热帖以个人经历反思AI炒作,作者批评“喝Kool-Aid”一词的邪教含义,并透露其经理多次要求他盲信AI。帖子引发社区对职场AI盲目推崇的讨论。

Hacker News · · 详情

瑞士与南非小实验室开源27B创意写作模型Hemmingway-1

一个来自瑞士和南非的小型实验室以Apache-2.0协议开源了基于Qwen3.8-27B微调的27B创意写作模型Hemmingway-1,权重已上线HuggingFace,bf16精度约54.7GB,兼容vLLM。在EQ-Bench 4上得分1330,内部盲测写作基准中沟通能力与人类相似度超过所测前沿模型,但数学、代码和事实召回与基座模型持平,属专用型模型。

r/MachineLearning · · 详情

评论:MCP从一开始就是个坏主意

一篇Hacker News讨论文章认为,Anthropic于2024年11月发布的MCP是为LLM能力尚弱时期设计的协议,如今已显过时。随着用户接入大量MCP服务器,工具schema导致上下文膨胀,催生了Composio、MintMCP、Pipedream等通用搜索/执行方案。MCP已于2025年捐给Linux基金会下的Agentic AI Foundation。

Hacker News · · 详情

Vocci推出249美元智能戒指,主打会议记录

Vocci发布了一款售价249美元的智能戒指,双击按钮即可录制会议并生成转录。戒指重不足6克,单次充电可录制8小时,配套充电盒可额外充电三次。但软件体验欠佳,短笔记会生成冗长的AI洞察,且戒指形态可能引发隐私担忧。

TechCrunch · · 详情

Qwen 27B在单张3090上自主运行三周

一位用户用单张RTX 3090本地运行Qwen 27B量化模型约21天,目标是让智能体自行编写CUDA推理引擎。期间共运行约2.3亿token、699次压缩耗时约83小时,最终预填充速度约为llama.cpp的一半,但产出了可用的kernel和测试。

r/LocalLLaMA · · 详情

ScrollEd将教科书变成TikTok式信息流

帕洛阿尔托初创公司ScrollEd推出可将PDF、教科书等文本文件转为类似TikTok和Instagram Reels的滚动信息流的应用,内容以AI生成的视频、音频、文字或互动测验呈现。该公司由学生创始人Utsav Gupta与Rebecca Neff创立,正在TechCrunch Disrupt的Startup Battlefield 200竞赛中展示。

TechCrunch · · 详情

腾讯Gander边工作边对话 打断率仅8%

腾讯Gander可同时处理语音、图像和文本,并在后台执行任务;其“小脑”维持对话,“大脑”可替换以搜索文件或写代码。基准测试中Gander仅8%的情况会打断用户,优于对手,但任务准确率落后。

The Decoder · · 详情

ChatGPT通过广告追踪器获取用户站外浏览数据

调查发现,OpenAI在bzr.openai.com设置__obi cookie并绑定ChatGPT账户,广告主网站的OpenAI代码会将该标识符及用户浏览的商品、文章和购买行为回传,使OpenAI能把站外活动关联到账户。作者在自有设备上复现了该机制,并观测到跨1029个域名的936个广告像素。

Hacker News · · 详情

小型神经网络策略游戏竞赛引发讨论

Hacker News上出现一项针对能玩策略游戏的小型神经网络竞赛,并引发社区讨论。该竞赛聚焦在受限算力下训练小型模型完成策略博弈,相关讨论见HN帖子。

Hacker News · · 详情

高中生开源C++张量库与自动求导项目

一名高三学生用数周时间在C++中实现了简单的张量库和自动求导,代码已在GitHub开源,目的是学习机器学习基础,并向机器学习与C++社区征求建议和批评。

r/MachineLearning · · 详情

研究者称去污染报告无法解决基准污染,评估方须接手测试

一篇文章指出,实验室自审训练数据、发布去污染报告的做法无法根治基准污染:实验室自我核查、语料涉及版权无法公开、训练数据中的转述与合成内容也难被完全匹配。作者建议改为评估方掌控测试,提交方无法获取标签,评测在离线环境从指定commit自行构建代码复现分数,并尽可能在提交冻结后生成测试数据,只有被复现的结果才算数。

r/MachineLearning · · 详情
加载更多