大模型
-
OpenAI 8月动态:ChatGPT能记住你的电脑操作历史了,还有750 tokens/秒的超快模式
核心看点 ChatGPT桌面版推出Computer History功能,能记住用户跨应用和网站的活动 Ultrafast模式发布,输出速度高达750 tokens/秒,比标准模式快14倍 OpenAI高管层大换血,前Wiz COO出任首席营收官 NVIDIA成为OpenAI俄亥俄州数据中心独家AI计算提供商 ChatGPT桌面版重大更新:Computer History 8月1…
-
OpenAI 8月大事件:GPT-5.6全面升级、Astra因安全问题暂停、网络安全专用模型发布
核心看点 GPT-5.6系列全面上线:Sol和Luna双版本覆盖付费/免费用户,事实错误率降低68% Astra模型因安全问题暂停:OpenAI首次因"关键级"网络安全风险主动放缓旗舰模型开发 网络安全专用模型GPT-5.6-Cyber发布:自主发现Chrome零日漏洞,95%成功率通过安全测试 Custom GPTs政策收紧:个人账号失去创建和发布权限,仅…
-
Anthropic/Claude 8月动态:跨设备同步、AI水印、风险报告与数学突破
核心看点 Claude in Chrome 实现跨设备同步 – 浏览器侧边栏会话与桌面、网页、移动端完全同步 EU AI Act 合规:文本水印正式上线 – 全球部署不可见水印,引发”过度合规”讨论 第二份风险报告披露惊人内幕 – 内部未发布”Model 2″、AI已主导代码生产、多代理系统异常…
-
Google Gemini近期更新汇总:AI代理、安全模型、水印设置全都有
除了Gemini 3.7 Flash和Robotics 2这两个重磅发布,Google近期还有几个值得关注的更新。今天一起盘点。 核心看点 1. Gemini Spark支持自定义MCP Gemini Spark现在可以连接自定义MCP(Model Context Protocol)服务器了。用户可以通过自然语言调用第三方服务,扩展AI的能力边界。Google VP Josh …
-
Google Gemini Robotics 2发布:一个大脑控制多台机器人,物理AI时代来了
7月30日,Google DeepMind放出重磅消息——Gemini Robotics 2正式发布。这次不是云端模型的迭代,而是直接让AI”长”进了机器人身体里,实现了从软件到硬件的跨越。 核心看点 1. 一脑控多机 Gemini Robotics 2的核心突破是”一个大脑控制多种机器人”。不管是人形机器人、机械臂还是移动平台,…
-
Google Gemini 3.7 Flash重磅发布:编码能力暴涨,AI代理更聪明了
Google又放大招了!8月13日,Google DeepMind正式发布Gemini 3.7 Flash,这款被定位为”最智能的工作马模型”的新版本,在编码、知识工作和网页开发方面带来了显著提升。 核心看点 1. 编码能力大幅提升 Gemini 3.7 Flash在FrontierCode 1.1基准测试中得分43.6%(相比3.6 Flash的34.…
-
Anthropic发布第二份风险报告:186页详述AI系统风险与应对准备
核心看点 Anthropic发布第二份风险报告,共186页 详细披露系统风险及应对准备情况 遵循负责任扩展政策(Responsible Scaling Policy) 报告引发社区热议:有人赞透明,有人嫌冗长 什么是风险报告? 作为Anthropic负责任扩展政策的一部分,公司承诺定期发布风险报告,分享关于其系统风险的详细信息以及应对这些风险的准备程度。 8月15日,Anthr…
-
Claude近期产品更新:Chrome扩展同步、Sonnet 5永久降价、Opus 5发布
核心看点 Claude Chrome扩展会话现在可同步到桌面、网页和移动端 Claude Sonnet 5 introductory pricing永久化:/ per million tokens Claude Opus 5发布:接近Fable 5的智能水平,价格仅一半 语音模式升级:支持更多语言,可调用已连接工具 Chrome扩展全平台同步 8月12日,Claude宣布Chr…
-
Claude Fable 5大幅放宽生物安全限制,日常健康咨询不再被拦截
核心看点 Fable 5生物学安全限制大幅放宽,误拦截率降低85% 日常健康、教育类生物问题不再被强制降级到Opus 5 医疗专业人员可获得更多临床任务支持 双重用途研究(如病毒学、毒理学)仍受保护 从宁可错杀到精准识别 Anthropic在8月7日宣布对Claude Fable 5的生物学安全限制进行重大更新。Fable 5是Anthropic目前能力最强的模型,在生物学领域…
-
Claude挑战数学界圣杯黎曼猜想,虽未成功但意外突破相关难题
核心看点 Anthropic让未发布的研究版Claude尝试证明黎曼猜想 虽未解决这个百年难题,但意外将相关问题的下限从41.6%提升至67.2% Claude协调60个子智能体,运行2400个shell命令,编写数百个Python脚本 成果已通过数学家验证,并生成Lean形式化证明 百年数学难题:黎曼猜想 黎曼猜想是数学界最著名的未解决问题之一,由Bernhard Riema…
