AI日报:腾讯开源770B参数Hy4preview模型;Midjourney V8.2上线图像编辑功能;谷歌Gemini Omni 1.1 Flash登场

AI科技
AI科技
AI科技

今天AI圈又热闹了,几大巨头同时放大招。来看看有哪些值得关注的动态:

1、腾讯混元开源旗舰模型 Hy4preview

腾讯混元这次放了个大招——开源旗舰模型 Hy4preview,总参数达到 770B,上下文窗口支持 1M。这个模型定位很明确:不是刷榜用的,是真干活的。

在软件工程、办公场景、游戏开发和科研领域都有显著进展。内部盲测数据显示,它的性能优于 GLM-5.3 和 Kimi K3。腾讯这波开源策略也很聪明,推动行业从参数竞赛转向实际生产力验证。

2、谷歌 Gemini Omni 1.1 Flash 视频模型登场

谷歌发布了全新的 Gemini Omni 1.1 Flash 视频生成模型,主打高清、长时视频生成。

几个亮点功能:

  • 场景扩展:在已有视频结尾无缝衔接,每次扩展10秒,累计最长40秒
  • 运镜控制:指定起始帧和结束帧,实现平滑转场
  • 参考视频:支持引入最长3秒的参考片段,保持画面一致性

采用阶梯式定价,降低了使用门槛。

3、Midjourney V8.2 图像编辑模型上线

Midjourney V8.2 的图像编辑模型来了,这次升级让 AI 绘画更可控:

  • 指令编辑:用文本指令直接修改已有图像
  • 多图参考:单次最多融合4张图片作为参考
  • 局部重绘与画布扩展:细节调整和尺寸延展更方便

4、蚂蚁集团 x 中金公司:金融大模型 Ling-3.0-flash-Fin

蚂蚁集团和中金公司合作推出了金融增强大模型 Ling-3.0-flash-Fin,专注投研场景。

在信息检索等核心能力上表现突出,双方还推出了 FinFIRST 金融搜索基准并计划开源,提供免费 API 调用。

5、阿里 Qoder 升级:从编程工具到智能体工作台

阿里发布了全新 Qoder,从 AI 编程工具升级为面向所有人的智能体工作台。

技术层面支持”读—改—验证—迭代”的自主闭环,具备跨文件编辑能力。产品提供编程模式和通用模式双入口,非技术用户也能参与开发。

6、谷歌搜索 AI 模式升级:支持机票追踪和酒店预订

谷歌的”AI 模式”对话式搜索新增了旅行相关功能:

  • 整合300多家航空公司及旅行网站的价格追踪
  • 基于用户偏好推荐酒店,无缝跳转完成支付
  • 支持查询航空里程和酒店积分兑换额度

谷歌正在把 AI 模式打造成全流程的旅行代理。

7、小鹏 VLA 大模型升级:安全能力暴增20倍

小鹏第二代 VLA 大模型迎来重大升级,核心是让 AI 真正理解时间,从静态3D空间跃迁到动态4D时空。

引入了 Infini-VLA 长时序架构,实现”边看、边想、边行动”的并行处理。还首次推出了 Master Agent,实现 VLA 与 VLM 的驾舱融合,并将 Robotaxi 的 L4 级体验下放至量产车型。

8、Anthropic 推出 MHS 硬件标准,进军物理 AI

Anthropic 发布了模型硬件标准(MHS),首次公开进军具身智能和物理 AI 领域。

MHS 是一套统一的控制与通信标准,让 AI 智能体能够操控多种物理设备。在生物医药、量子计算和先进制造等领域已经展现出强大的提速能力。


以上就是今天的 AI 日报,觉得有用的话欢迎点赞收藏

本文地址:https://www.163264.com/15341

(0)
上一篇 13小时前
AI日报:腾讯开源770B参数旗舰模型;Midjourney V8.2上线;谷歌Gemini Omni视频模型登场
下一篇 3小时前

相关推荐