跳到文章正文
AI 日报 编辑推荐

AI 日报|10 月 3 日:OpenAI 安全团队地震,Jev 百亿估值,苹果给 AI 智能体上锁

今天是 10 月 3 日。假期里的 AI 行业一点没闲着:OpenAI 的“安全透明度”负责人悄…

今天是 10 月 3 日。假期里的 AI 行业一点没闲着:OpenAI 的“安全透明度”负责人悄悄离职,三名安全研究员又因泄密被开除;一个名叫 Jev、号称“不会聊天、只会做决定”的模型,估值被传冲到 100 亿美元;苹果则因为 AI 智能体“显著增加风险”,收紧了 macOS 的完全磁盘访问权限。一天下来,“安全”“信任”“落地成本”这些词,比任何跑分都更抢眼。下面是今天 34 篇稿件的完整梳理。

AI 日报 2026 年 10 月 3 日封面
2026 年 10 月 3 日 · AI 日报:安全、信任与落地成本,压过跑分

一分钟速览

  • OpenAI 安全透明度负责人 David Robinson 离职,三名研究员因泄密被开
  • Jev 爆火,创始人 Diogo Almeida 称“给十亿美元也不从头预训练”
  • 苹果收紧 macOS 完全磁盘访问权限,AI 智能体安全上升为平台议题
  • DeepSeek 抛出 DSec 沙盒报告并再度扩招,38 万沙盒同时在线
  • 小米 MiMo-V2.6-Flash、淘宝 TaoMate-H3 同日开源,国产模型继续加码

今日头条

1. OpenAI 安全团队再地震:信任的两根支柱同时松动

据多家媒体报道,OpenAI Safety Systems 团队内负责“安全透明度”职能的负责人 David Robinson 已经离职,没有公开原因,也没有公布继任者。他是 OpenAI《Preparedness Framework 2.0》的主要起草人,这套框架规定了模型能力达到 High、Critical 门槛时公司必须做什么评估和防护;他领导的团队负责产出 system card——那份被称为“模型风险营养成分表”的文件。更早之前,OpenAI 还开除了 Jasmine Wang、Tomek Korbak 和 Mikita Balesni 三名安全与对齐研究员,理由是向一家外部 AI 安全机构分享了敏感信息,其中涉及基础设施架构。第三方评估与安全透明本是 OpenAI 对外重建信任的两根支柱,如今一根的人走了、另一根的人被开,信号并不轻松。原文见 OpenAI 安全团队再地震。

2. Jev 估值 100 亿美元:“不会聊天”的模型,讲了一个新故事

Jev 发布视频浏览量 6 天突破 3870 万,在第三方 JevBench v1.2.1 综合榜以 75.3 分排名第一。它的联合创始人 Diogo Almeida 在一期访谈里几乎把行业底裤都掀了:公开 benchmark 极易被操纵,真正该信的是针对具体工作流的长期评估;整个行业卷速度、拼成本,却把可靠性弄丢了,而“可靠性才是产品真正的灵魂”。他还抛出那句被广泛引用的话——就算给十亿美元,他也不会从零开始预训练大模型,因为“预训练实在太烧钱”。公司日处理量已突破一万亿 token,他更看重重度开发者而非注册量。详见 估值 100 亿美元的 Jev。

3. 苹果收紧 macOS 权限:AI 智能体的安全,终于成了平台级问题

苹果调整了 macOS 的“完全磁盘访问”权限,理由是 AI 智能体会“显著增加”风险。过去这类权限主要提防恶意软件,而当智能体可以自主读文件、跑命令、改系统时,一把能打开整台电脑的钥匙就成了隐患。同一天还有多条与“Agent 安全与治理”相关的动向:英伟达开源 OpenShell,给自主智能体一个“安全的家”;Cloudflare 开源决策模型 Clef,专治 Agent 里的选择题;InfoQ 也介绍了企业级 Agent Infra 从安全沙箱到身份治理的实践。平台、芯片与云厂商同时动手,说明 Agent 安全已从论文话题变成产品前置条件。

模型与开源

国产开源今天相当密集。小米 MiMo-V2.6-Flash 开源,309B 参数只激活 15B,支持 1M 上下文并带多模态(小米 MiMo-V2.6-Flash 开源);淘宝 TaoMate-H3 主打“三步生成分钟级连续音视频”,直指电商内容生产(淘宝开源 TaoMate-H3)。基础设施层面,DeepSeek 甩出《弹性计算 DSec》技术报告并再度扩招:一套分片约 160 台服务器、3 万 CPU 核心、250TB 内存,每天服务约 300 万个沙盒,高峰期同时在线超 38 万个,镜像按需加载让创建任务提速约 1.71 倍(DeepSeek 又招人)。此外,英伟达开源 OpenShell(英伟达开源 OpenShell)、Cloudflare 开源 Clef(Cloudflare 开源决策模型 Clef)、Meta 开源 Muse 硬件代码(Meta 开源 Muse 硬件代码)、Allen AI 开源 8B 报告模型 AstaBrief(Allen AI 开源 AstaBrief)等也相继亮相。

方法论上,MIT 与 Sakana 用“LLM 当裁判”把 AI 改代码的评测成本砍下来(MIT 和 Sakana 用 LLM 当裁判);谷歌 WikiSkill 让 AI 记住“上次错在哪”却不必把教训塞进提示词(谷歌的 WikiSkill);AutoSynthData 想用 AI 造数据,解决企业 Agent 训不出来的难题(AutoSynthData 想用 AI 造数据);影身智能则押注“原生 4D”,比李飞飞 World Labs 还早两年(押注原生 4D 的影身智能)。

产品与应用

OpenAI 的 Dot 被认为是企业软件,却能顺手帮你点份晚饭(OpenAI 的 Dot 上手实测);Suno 现在能“说话”了,一边生成人声旁白一边自动配背景音乐(Suno 现在能说话了);Utopai X 在 Artificial Analysis 带音频文生视频盲评榜冲到全球第二,是排名最高的美国公司模型,而它的东家是一家影视公司(Utopai X 出道即巅峰);Meta 雷朋 Display 大更新,视频通话换成 AI 虚拟化身(Meta 雷朋 Display 大更新);苹果 homeOS 前瞻把 iPhone、iPad、手表的界面揉在一起,让 Siri 当“总开关”(苹果 homeOS 前瞻)。

行业与资本

资本与政策面同样热闹。Anthropic 一面掏出 1 亿美元培训一万名工程师,直言 AI 落地真正的瓶颈是“人不会用”(Anthropic 掏 1 亿美元培训工程师),一面被曝最早 11 月中旬上市(曝 Anthropic 最早 11 月中旬上市)。Sean Parker 把 Stability AI 往音乐上拽,一群“生成派”老将开始二次创业(Sean Parker 把 Stability AI 往音乐上拽)。政策侧,白宫不再说“AI”,改口叫“超级智能”(白宫改口叫超级智能)。与此同时,一份调查给热闹的发布会泼了冷水——只有 2% 的消费者真正在为 AI 买单(只有 2% 的消费者真正在为 AI 买单)。

基建与供应链继续拉扯:亚马逊发 3000 字长文劝社区别挡数据中心,反而招来更多反驳(亚马逊发长文劝社区别挡数据中心);甲骨文威斯康星 AI 数据中心卡在“接电审批”上(甲骨文数据中心卡在接电审批);有人提议把数据中心伪装成树林(把数据中心伪装成树林);内存涨价正在惩罚消费硬件,DGX Spark 减配降价、Shield TV 反而贵了 100 刀(内存涨价正在惩罚消费硬件)。文化与伦理话题也没缺席:教皇利奥十四世开炮 AI 艺术,称“算法缺少人性的火花”(教皇利奥十四世开炮 AI 艺术);Zig 正式禁止 AI 贡献并把仓库搬出 GitHub(Zig 正式禁止 AI 贡献)。

趋势洞察

把今天 34 条串起来看,主线很清楚:行业重心正从“更强”转向“更可靠、更可控、更便宜”。OpenAI 的安全透明度负责人走人,苹果用系统权限给 AI 智能体上锁,英伟达、Cloudflare 同一天发布 Agent 安全与决策组件——这些都不是巧合,而是智能体开始真正接管操作权限后的必然反应。模型侧,Jev 代表的“不做聊天机器人、只做决策”路线,和小米、淘宝、DeepSeek 在开源与基础设施上的持续加码,共同指向一个判断:下一阶段的胜负,不取决于谁的通用榜单更高,而取决于谁能把可靠的模型,接进真实、有商业价值的工作流。

结语

热闹的发布会和冷静的钱包之间,差的就是今天这些看起来不性感的活儿:安全、透明度、成本与可靠性。哪家先把这些补齐,哪家才有资格谈下一轮增长。

(本文由 AI 日报自动汇编,覆盖 2026 年 10 月 3 日站内全部 34 篇稿件。)

本文地址:https://www.163264.com/16162