行业追踪

全部内容 · 按时间倒序

模型、产品与 AI 创业公司的动态,相似报道只保留最可信的一篇

腾讯Gander边工作边对话 打断率仅8%

腾讯Gander可同时处理语音、图像和文本,并在后台执行任务;其“小脑”维持对话,“大脑”可替换以搜索文件或写代码。基准测试中Gander仅8%的情况会打断用户,优于对手,但任务准确率落后。

The Decoder · · 详情

ChatGPT通过广告追踪器获取用户站外浏览数据

调查发现,OpenAI在bzr.openai.com设置__obi cookie并绑定ChatGPT账户,广告主网站的OpenAI代码会将该标识符及用户浏览的商品、文章和购买行为回传,使OpenAI能把站外活动关联到账户。作者在自有设备上复现了该机制,并观测到跨1029个域名的936个广告像素。

Hacker News · · 详情

小型神经网络策略游戏竞赛引发讨论

Hacker News上出现一项针对能玩策略游戏的小型神经网络竞赛,并引发社区讨论。该竞赛聚焦在受限算力下训练小型模型完成策略博弈,相关讨论见HN帖子。

Hacker News · · 详情

高中生开源C++张量库与自动求导项目

一名高三学生用数周时间在C++中实现了简单的张量库和自动求导,代码已在GitHub开源,目的是学习机器学习基础,并向机器学习与C++社区征求建议和批评。

r/MachineLearning · · 详情

研究者称去污染报告无法解决基准污染,评估方须接手测试

一篇文章指出,实验室自审训练数据、发布去污染报告的做法无法根治基准污染:实验室自我核查、语料涉及版权无法公开、训练数据中的转述与合成内容也难被完全匹配。作者建议改为评估方掌控测试,提交方无法获取标签,评测在离线环境从指定commit自行构建代码复现分数,并尽可能在提交冻结后生成测试数据,只有被复现的结果才算数。

r/MachineLearning · · 详情

研究:聊天式大模型复刻“通灵者骗术”机制

一篇研究文章认为,聊天式大模型表现出的“智能”源于用户心理错觉,其机制类似通灵者的冷读术,即通过肯定性话术引导对方自我补全。作者指出大模型只是语言令牌的数学模型,并无思考机制,许多拟议用例近乎伪科学。

Hacker News · · 详情
加载更多