大模型
-
Anthropic发布第二份风险报告:186页详述AI系统风险与应对准备
核心看点 Anthropic发布第二份风险报告,共186页 详细披露系统风险及应对准备情况 遵循负责任扩展政策(Responsible Scaling Policy) 报告引发社区热议:有人赞透明,有人嫌冗长 什么是风险报告? 作为Anthropic负责任扩展政策的一部分,公司承诺定期发布风险报告,分享关于其系统风险的详细信息以及应对这些风险的准备程度。 8月15日,Anthr…
-
Claude近期产品更新:Chrome扩展同步、Sonnet 5永久降价、Opus 5发布
核心看点 Claude Chrome扩展会话现在可同步到桌面、网页和移动端 Claude Sonnet 5 introductory pricing永久化:/ per million tokens Claude Opus 5发布:接近Fable 5的智能水平,价格仅一半 语音模式升级:支持更多语言,可调用已连接工具 Chrome扩展全平台同步 8月12日,Claude宣布Chr…
-
Claude Fable 5大幅放宽生物安全限制,日常健康咨询不再被拦截
核心看点 Fable 5生物学安全限制大幅放宽,误拦截率降低85% 日常健康、教育类生物问题不再被强制降级到Opus 5 医疗专业人员可获得更多临床任务支持 双重用途研究(如病毒学、毒理学)仍受保护 从宁可错杀到精准识别 Anthropic在8月7日宣布对Claude Fable 5的生物学安全限制进行重大更新。Fable 5是Anthropic目前能力最强的模型,在生物学领域…
-
Claude挑战数学界圣杯黎曼猜想,虽未成功但意外突破相关难题
核心看点 Anthropic让未发布的研究版Claude尝试证明黎曼猜想 虽未解决这个百年难题,但意外将相关问题的下限从41.6%提升至67.2% Claude协调60个子智能体,运行2400个shell命令,编写数百个Python脚本 成果已通过数学家验证,并生成Lean形式化证明 百年数学难题:黎曼猜想 黎曼猜想是数学界最著名的未解决问题之一,由Bernhard Riema…
-
Anthropic详解Claude文本水印: invisible but detectable,用户无感知
核心看点 Anthropic发布Claude文本水印技术详解,回应用户关切 水印完全不可见,不影响文本质量和阅读体验 为遵守欧盟AI法案,全球同步实施 不添加隐藏字符,不增加token消耗,不追溯个人身份 什么是文本水印? Anthropic在8月14日发布详细FAQ,解释了Claude文本水印的工作原理。简单来说,大语言模型在生成文本时,每次选择下一个词都有一定的随机性。水印…
-
OpenAI升级GPT-5.6:免费用户也能无限用,付费用户推理更精准
OpenAI升级GPT-5.6系列:Plus/Pro用户全面换用新版GPT-5.6 Sol,事实性错误减少68%;免费/Go用户获得GPT-5.6 Luna无限文本对话和Think按钮功能。
-
ChatGPT正式登陆Linux!Ubuntu、Debian、Fedora都能用
ChatGPT桌面版正式推出Linux预览版,支持Ubuntu、Debian、Fedora等主流发行版,提供.deb和.rpm安装包,完整支持ChatGPT、ChatGPT Work和Codex功能。
-
OpenAI推出Ultrafast模式:GPT-5.6 Sol速度飙升14倍
OpenAI推出Ultrafast模式,GPT-5.6 Sol速度提升14倍,每秒生成750 token,由Cerebras芯片提供算力支持,优先向API企业客户开放。
-
Gemini App月活突破10亿!Google史上增长最快的产品
核心看点 Gemini App月活用户正式突破10亿,成为Google史上增长最快的产品 63%用户直接用语音对话,忙碌父母使用语音的比例高出43% 每天生成1.5亿+张图片,小企业营销素材需求旺盛 iOS用户超1亿,macOS重度用户互动频率是其他平台2倍 新增大量第三方应用连接:Granola、Otter.ai、Wix、OpenTable等 详细解析 8月11日,Googl…
-
Google Gemini 3.7 Flash重磅发布:编码能力飙升,价格还砍半
核心看点 Google刚刚发布Gemini 3.7 Flash,距离3.6 Flash仅三周 编码能力大幅提升:FrontierCode 1.1从34.4%飙升至43.6%,DeepSWE v1.1从49%跃升至65.3% 网页开发更强:WebDev Arena Elo评分从1538提升到1588 价格直接砍半:输入$0.75/百万token,输出$3.75/百万token G…
