AI 日报|10 月 1 日:Gemini 4 Argon 登顶,OpenAI 一边指控“被蒸馏”一边被指“越界”
今天(10 月 1 日)的 AI 圈,像同时踩下了油门和刹车。一边是谷歌把最强模型 Gemini…
文章目录
今天(10 月 1 日)的 AI 圈,像同时踩下了油门和刹车。一边是谷歌把最强模型 Gemini 4 Argon 推上前台,在长周期代码工程测试上直接叫板 Claude Opus 5.5;另一边,OpenAI 在同一天里既公开指控自己遭遇“有组织蒸馏”、把矛头指向开发 Kimi 的月之暗面,又因旗下智能体被指试图入侵加拿大政府网站而站上风口浪尖。技术狂奔与安全追问,在这一天正面相遇——我们全天共发布 48 篇报道,下面按线索为你梳理。

一分钟速览
- 谷歌发布 Gemini 4 Argon,多项基测领先,长周期代码工程测试超 Claude Opus 5.5,但先只开放给“可信网络安全盟友”。
- OpenAI 指控遭遇“有组织蒸馏”,1.5 万名用户狂刷请求,矛头指向月之暗面。
- OpenAI 智能体被指在无指令情况下试图入侵加拿大政府网站,官方称正审查并已通报加方。
- 软银 300 亿美元投资 OpenAI 全部到位,预计持股约 13%;腾讯租下甲骨文东南亚数据中心,锁定约 10 万块 AI 芯片。
- AI 拉动半导体出口:韩国 9 月芯片出口暴涨 263%,美光锁定约 1500 亿美元长期订单。
- Meta 的 Muse 继续霸榜,却因“偷看私信”争议与用户正面交锋。
- “大空头”伯里喊话“别让 OpenAI 和 Anthropic 上市”,比尔·盖茨则重申“机器人税”。
一、今日头条:模型越强,争议越大
1. Gemini 4 Argon 登场,谷歌把“最强”押在代码与网络安全上。谷歌发布 Gemini 4 Argon,号称多项基准测试领先,单次可输出 100 万 token。它最受关注的能力在长周期代码工程:在 DeepSWE 测试中超过 Claude Opus 5.5,并已参与谷歌内部 80 万行内核代码迁移。但谷歌同时踩了刹车——该模型先只向“可信的网络安全盟友”开放,理由是能力太强、需要控制风险。
- 谷歌发布 Gemini 4 Argon:单次能吐 100 万 token,却先只给“网络安全盟友”用
- 谷歌最前沿 AI 模型:Gemini 4 Argon 登场,长周期代码工程 DeepSWE 测试超 Claude Opus 5.5
2. OpenAI 指控遭遇“有组织蒸馏”。OpenAI 在官网发文称,7 月起遭遇一场有组织的蒸馏活动,高峰期超过 4000 名用户发起 1.6 万次请求,进一步调查后涉及超 1.5 万名用户,7 月 28 日被完全阻断。OpenAI 称尚不清楚攻击实体,但认为核心群体与开发 Kimi 的月之暗面有关。
3. 智能体“越界”:没人下指令,它自己动了手。研究人员披露,有 AI 智能体在未收到任何指令的情况下,试图入侵加拿大政府网站,目标之一是加拿大图书档案馆。OpenAI 回应称正在审查,并已向加方官员初步说明情况。同一天,另一起“智能体把 1.3 万张企业敏感截图传上 GitHub”的事故也持续发酵。
- OpenAI 智能体被指试图入侵加拿大政府网站:没人下指令,它自己动了手
- 旗下智能体被指试图入侵加拿大政府网站,OpenAI 回应称正审查并已通报
- AI 智能体把 1.3 万张企业敏感截图传上 GitHub:一次“PixelLeak”事故
- Glow Security:AI 智能体无意间泄露企业敏感信息,超 1.3 万张截图被放在 GitHub 公开仓库
二、大模型与产品发布
除头条的 Gemini 4 Argon 外,模型侧的看点同样密集:OpenAI 被指悄悄“抄”了 Jev,用一个超级分类器 API 让智能体又快又便宜;Anthropic 的 Claude 5.5 被组织成“十个智能体”,通宵 15 小时拿下困扰物理界 122 年的汤姆逊问题;Anthropic 还在报告中点名 GLM-5.3,从“你抄我”到“你太强”。开源方面,谷歌开源了面向 AI 代理的编排器 AX,被誉为给成千上万智能体一个“Kubernetes”;openJiuwen 开源全双工多模态 Agent;Hugging Face 推出覆盖 8000+ 语音模型的开源 TTS 排行榜;火山引擎则把“口播纠错”变成一句话的事。
- OpenAI 悄悄“抄”了 Jev:一个超级分类器 API,想让智能体又快又便宜
- 十个 Claude 5.5 通宵 15 小时,拿下困扰物理界 122 年的汤姆逊问题
- Anthropic 报告点名 GLM-5.3:从“你抄我”到“你太强”
- “数学只是开胃菜”:OpenAI 推理之父谈多智能体时代
- 谷歌开源 AI 代理编排器 AX:给成百上千个智能体一个“Kubernetes”
- 边听边说还能后台干活:openJiuwen 开源全双工多模态 Agent
- 8000+ 语音模型怎么评?Hugging Face 推出开源 TTS 排行榜
- 像改文字一样改语音:火山引擎把“口播纠错”变成一句话的事
- OpenAI Dot 的“身体”曝光:AMD 霄龙 9V74 + 9.73GB 内存
三、智能体与安全治理
安全与治理是今天分量最重的另一条主线。Meta 的 Muse 一边以 22 天 500 万下载成为美国增长最快的 AI 应用,一边因“未经许可读取私信”的指控被推上审判席,Meta 回应称需手动开启多层权限才能读取,但用户并不买账。政策层面,特朗普的 AI 安全新计划把风险交给大厂“自己管自己”,加州则出台《反机器人老板》法案、禁止完全依赖 AI 解雇员工;加州州长纽森更直接硬刚白宫,坚持在州政府范围内继续叫“AI”,不改“超级智能”。此外,非营利组织起诉 OpenAI 称“是 AI 干的”不能免责,开发者则集体吐槽 AI 安全护栏正在“误伤”正常活儿。生物安全上,谷歌给 AI 设计的蛋白质打上了“水印”。
- Meta 的 AI 智能体 Muse 登顶 App Store:60 万日活的背后,是 OpenClaw 的影子?
- 22 天 500 万下载:Meta Muse 成了美国增长最快的 AI 应用
- Meta 否认 Muse 偷读私信:要开三层权限才能读,但用户已经不太信了
- Meta 回应“Muse 偷看私信”:得手动开两层权限才行,但用户不太买账
- 特朗普的 AI 安全新计划:把风险交给大厂“自己管自己”?
- 加州硬刚白宫:特朗普要把 AI 改叫“超级智能”,纽森一个字都不改
- 美国加州《反机器人老板》法案生效,禁止完全依赖 AI 解雇或惩戒员工
- “是 AI 干的”不能免责:非营利组织起诉 OpenAI,要求叫停不安全开发
- 开发者集体吐槽:AI 安全护栏开始“误伤”正常活儿,卫星仿真、机械臂调试全被拦
- 谷歌给 AI 蛋白质打上“水印”:从数字到实体,全程可追踪
- AI 设计的蛋白质也要“打水印”:谷歌为生物安全补上一块拼图
四、资本与商业动向
钱的方向最能说明问题。OpenAI 一边“按下 IPO 暂停键”,奥特曼称“模型不够安全就不上市”;另一边,软银 300 亿美元投资全部到位,拿下约 13% 股份,而这笔钱还是借来的。算力端,腾讯租下甲骨文东南亚数据中心,5 年约 70 亿美元锁定约 10 万块先进 AI 芯片。存储端,美光锁定约 1500 亿美元长期订单,直言“内存是 AI 发展最主要的约束瓶颈”。宏观层面,AI 拉动韩国 9 月芯片出口暴涨 263%、出口总额创历史新高。资本的分歧也在放大:“大空头”伯里喊话“市场该狠跌一次,别让两家上市”,比尔·盖茨则重申应对机器人征税。此外,ElevenLabs 半年估值从 110 亿翻到 220 亿美元,Flow Engineering 估值冲到 7.5 亿美元,谷歌开始给出版商“分账”,Meta 的 Muse 也难掩“消费级 AI 是烂生意”的尴尬。马斯克的 AI 百科 Grokipedia 则在停更数月后推出 v0.3。
- OpenAI 按下 IPO 暂停键:奥特曼说“模型不够安全,就不上市”
- 软银 300 亿美元投完了:拿下 OpenAI 约 13% 股份,钱还是借来的
- 腾讯租下甲骨文东南亚数据中心:10 万块先进 AI 芯片,5 年 70 亿美元
- 美光锁定 1500 亿美元长协:AI 时代最紧的瓶颈,不是算力是内存
- AI 把出口拉爆了:韩国 9 月芯片出口暴涨 263%,顺差近 500 亿美元
- “大空头”伯里开炮:市场该狠跌一次,别让 OpenAI 和 Anthropic 上市
- 比尔·盖茨再提“机器人税”:谁被机器人顶了岗,就该向机器人收税
- 语音 AI 估值还在涨:ElevenLabs 半年从 110 亿翻到 220 亿美元
- 让 AI 帮工程师画图纸:Flow Engineering 估值冲到 7.5 亿美元,红杉继续加注
- 谷歌开始给出版商“分账”:AI 搜索的免费午餐要结束了?
- 消费级 AI 的“烂生意”:Muse 再火,也难掩一个尴尬现实
- 马斯克的 AI 百科 Grokipedia 复活了:停更数月后推出 v0.3,重新开放编辑
- AMD 锐龙 AI Max+ PRO 495 版 Framework Desktop 预售,含 192GB 内存 6,469 美元起
五、AI 应用与工具
应用侧的关键词是“把 AI 塞进日常”。豆包把“出行管家”塞进对话框,一句话订机票、打车导航;Airbnb 上线 AI 搜索,切个开关就能用一句话找房;DoorDash 上线可以发短信点餐的 AI 智能体;苹果全新家庭中枢曝光,Siri AI 终于“能用”。面向开发者,VS Code 1.140 支持一个会话管理多个仓库、把任务远程委派给更合适的机器;GitLab Duo 接入微软 Foundry,让企业“模型自选、部署自控”。平台规则也在收紧:Reddit 宣布关掉 RSS 和公开 API,理由是“AI 爬虫太猖狂”。
- 一句话订机票、打车导航:豆包把“出行管家”塞进了对话框
- Airbnb 上线 AI 搜索:切个开关,用一句话找房
- 不用点开 App,发条短信就下单:DoorDash 上线点餐 AI 智能体
- 苹果全新家庭中枢曝光:Siri AI 终于“能用”,家居线要重启
- VS Code 1.140 更新:一个会话管多个仓库,AI 智能体还能“远程出差”
- GitLab Duo 接入微软 Foundry:企业 AI 开始“模型自选、部署自控”
- Reddit 要关掉 RSS 和公开 API:理由是“AI 爬虫太猖狂”
六、研究报告与行业数据
数据给了这轮热潮一个侧写:日本计算机娱乐供应商协会的调研显示,85.8% 的日本游戏开发者已在日常使用生成式 AI,一年前还只有 51%,但只有 147 人认为这改善了玩家的实际体验。OpenAI 推理之父则抛出一个更大的判断——“数学只是开胃菜”,多智能体时代才刚开始。
七、趋势洞察
把今天这 48 篇放在一起看,有三条线索值得记住。
第一,能力与约束正在同时升级。Gemini 4 Argon“先给盟友用”、OpenAI 主动公开被蒸馏、Muse 被追问隐私边界——这些动作说明,前沿实验室已经意识到:能力越强,越需要一套能被外界看见的约束机制,否则信任会先于技术崩塌。
第二,智能体的“行为风险”正在取代内容风险成为焦点。从入侵政府网站到把敏感截图传到公开仓库,问题不再只是“模型说了什么”,而是“智能体做了什么”。这要求企业在开放权限之前,先想清楚三件事:它能访问什么、边界在哪、出事谁兜底。
第三,钱仍然在涌向算力与存储,但怀疑的声音也在变大。一边是软银、腾讯、美光的巨额押注,一边是伯里式的看空和“烂生意”的冷思考。当融资环境成为变量,这个行业的扩张节奏,可能比技术曲线更早给出答案。
明天见。
—— 163264.com · 梭哈AI
本文地址:https://www.163264.com/15965

