DeepSeek V4.1 Flash成最佳攻防模型
DeepSeek V4.1 Flash在AI攻防基准中对11个易受攻击目标全部取得代码执行,4个已修复目标保持安全;被接受的运行成本为$4.65(含失败为$5.14)。测试中用掉2,349条Bash命令、约2小时38分钟模型活跃时间,输入令牌268.3M(其中266.2M被缓存)。审计发现6个计划内利用和5个意外路径。
DeepSeek 是一家/一个开发并提供大型 AI 模型与 API 的实体,面向低成本推理与本地部署场景。近期报道关注它推出“每百万token仅几分之一美分”的超低成本模型、内部测试的 deepseek-v4.1-flash(原生多模态、与 v4‑flash 同价、每帐户 20 并发限额)以及软退役 V4 Pro,外界也在讨论其 tech report 在 PhD 申请中的价值。
DeepSeek V4.1 Flash在AI攻防基准中对11个易受攻击目标全部取得代码执行,4个已修复目标保持安全;被接受的运行成本为$4.65(含失败为$5.14)。测试中用掉2,349条Bash命令、约2小时38分钟模型活跃时间,输入令牌268.3M(其中266.2M被缓存)。审计发现6个计划内利用和5个意外路径。
Foreign Policy报道Anthropic指控Moonshot AI、DeepSeek等中国公司大规模利用Claude生成训练数据,称有案例在10天内向Claude路由30万次用户请求,涉敏感监控、内部代码与凭证等信息,可能引发更大数据和安全担忧。
DeepSeek v4.1 推出后,一位参与主算子编写的工程师反思:小模型进步迅速,AI 已能自动读写低层代码并优化算子,预计半年到一年内AI产出的算子可与人类持平或更优,强调人类在速度与并行性上的劣势。
BBC综述了人工智能的基本原理、生成式AI的工作方式及其在推荐系统、医疗等领域的应用,同时指出能耗、伦理和监管等带来的风险与争议。文章呼吁在发展与监管间取得平衡。
一则Reddit贴询问将大型模型报告(非arXiv学术论文)如Kimi K3、DeepSeek、Gemini或Mistral Leanstral等放在博士申请中,其分量是否可比于第一作者A*论文,征求社区意见。
Bloomberg 报道 DeepSeek 推出按百万 tokens 收费不到一美分的低价 AI 模型,加大对 Anthropic、OpenAI 和 Z.ai 等竞争者的压力。
Deepseek 宣布将 V4 Pro 软停用,表明该产品线进入退役阶段并停止主动推广与更新。
DeepSeek 宣布内部测试 deepseek-v4.1-flash(标注为 expires-on-0910)的中间版本 V4.1 Flash 已开放内测,采用新架构支持原生多模态、更快更便宜。当前定价与 deepseek-v4-flash 相同,每账号并发限流为20。发布信息来自 Chubby 在 𝕏 的说明。