欢迎来到今天的AI日报!这里每天为你精选AI领域最值得关注的动态,帮你快速了解技术趋势和产品创新。
1、MiniMax 发布 Music3 音乐模型:给歌词就能生成完整歌曲
MiniMax 推出了全新的音乐生成模型 Music3,这家伙能根据你提供的歌词和音乐风格描述,直接生成最长5分钟的完整歌曲。
它的架构挺有意思——用了一个「全局+局部」的双模型协作方案:全局模型负责把控整首歌的结构和情绪走向,局部模型则专注于每一帧的声学细节。这种分层设计让生成的音乐在长时段内能保持主题一致,不会前半段摇滚后半段突然变民谣。
支持的结构也很丰富,前奏、主歌、副歌、桥段都能安排得明明白白。对音乐创作者来说,这相当于多了一个随时待命的编曲助手。
👉 模型地址
2、百度 GenFlow 官宣中文名「库库AI」,独立办公产品矩阵上线
百度文库网盘的通用智能体 GenFlow 终于有中文名了——「库库AI」。同时推出了独立的产品矩阵,覆盖PC客户端、网页版、小程序和企业版。
数据方面,库库AI的月活已经突破1亿,其中AI办公月活超过2500万,在通用AI办公赛道排第一。它能一句话调用PPT、Excel、Word等Agent并行处理复杂任务,还能生成海报、视频、播客、思维导图等多种内容。
首期还针对金融场景做了专项优化,支持跨设备任务接力,电脑关了也能在小程序里继续处理。
3、智谱 GLM-5.3 发布:不换底座,后训练直接登顶开源编程榜
智谱这次没换基座模型,而是通过放大后训练阶段的投入,直接让 GLM-5.3 的编程能力大幅跃升,成为当前开源模型里的编程最强者。
更难得的是,它在安全维度也表现优异,展现出网络防御场景的潜力。这种「不堆参数、精练后训」的路线,给行业提供了一个新思路。
4、OpenAI 推出「电脑历史」功能:记住你的操作,不用截图
OpenAI 给 ChatGPT 加了一个新能力——追踪你在电脑上的交互事件,自动生成记忆,提升上下文理解。
隐私方面做得比较克制:默认关闭,用户可以随时暂停或排除特定应用。目前已向全球订阅用户推送,欧洲地区稍后开放。
5、谷歌 Gemini 3.7 Flash 发布:编码性能大涨,价格砍半
谷歌发布了 Gemini 3.7 Flash,编码性能全面升级,FrontierCode 基准测试得分提升到43.6%,在Web开发、文档理解和业务流程自动化等场景超越了 Claude Sonnet 5 和 GPT-5.6 Terra。
定价方面很激进:输入每百万token 0.75美元,输出3.75美元,比前代降了50%。高性价比模型商业化落地的节奏在加快。
6、App Store 现 AI 欺诈应用:假截图刷到4.9分
一款叫 TabControl 的 Safari 扩展程序,靠AI生成的虚假截图和评分冲到了Mac App Store付费榜第12位。这类应用一旦安装,可能威胁用户隐私安全。
这也暴露了苹果审核机制的漏洞——AI生成的宣传物料越来越逼真,平台审核需要升级对策了。
7、DeepSeek V4 Pro 登陆硅基流动:百万上下文,三档推理强度
DeepSeek-V4-Pro 在硅基流动平台上线,主打三个卖点:1M上下文窗口、三档推理强度可调、对编码和Agent工作流的优化。
定价方面,缓存命中的成本低至0.44美元/百万token,长文本场景的成本锚点更清晰了。
8、京东七鲜咖啡开24小时无人店:机器人现制+AI荐饮
京东七鲜咖啡的首家24小时智能化无人咖啡店落地北京银河Soho,机器人和AI全程接管制作流程。
比较有意思的是AI荐饮功能——会根据用户的身体状况智能推荐咖啡因摄入量。零售场景的智能化又往前迈了一步。
以上就是今天的AI日报,明天见!
本文地址:https://www.163264.com/14955


微信扫一扫,鼓励一下~