AI日报:腾讯开源770B模型Hy4preview;Midjourney V8.2上线图像编辑;谷歌Gemini Omni 1.1登场

AI日报

欢迎来到今天的AI日报!这里是你每天探索人工智能世界的指南,聚焦AI领域的热点内容,助你洞悉技术趋势、了解创新AI产品应用。

1、腾讯混元发布开源旗舰模型 Hy4preview

腾讯混元刚刚扔出一颗重磅炸弹——开源旗舰模型 Hy4preview,总参数高达 770B,上下文窗口直接拉到 1M,定位真实生产力场景。

这模型已经在多个平台上线,在软件工程、办公场景、游戏开发和科研领域都取得了显著进展。内部盲测数据显示,它的性能优于 GLM-5.3 与 Kimi K3。

腾讯这次开源策略很明确:推动大模型竞争从参数竞赛转向生产力实效验证。不再是比谁参数多,而是看谁真能帮开发者干活。

2、谷歌 Gemini Omni 1.1 Flash 视频模型登场

谷歌发布了全新的 Gemini Omni 1.1 Flash 视频生成模型,在多模态领域实现了高清、长时视频生成的突破。

几个亮点功能:

  • 场景扩展:在已有视频结尾无缝衔接生成后续画面,每次扩展 10 秒,累计最长可达 40 秒
  • 运镜控制:通过指定镜头起始帧与结束帧,实现平滑自然的转场效果
  • 参考视频引入:支持最长 3 秒的参考视频片段,维持画面上下文与角色一致性

模型还提供多种分辨率选项,采用阶梯式定价策略,降低了使用门槛。

3、Midjourney V8.2 上线图像编辑模型

Midjourney V8.2 图像编辑模型的发布,标志着 AI 绘画领域的一次重要升级。

核心功能包括:

  • 指令编辑:通过文本指令对已有图像进行修改
  • 多图参考:单次最多支持融合 4 张图片作为参考
  • 局部重绘与画布扩展:画面细节调整与尺寸延展变得轻而易举

详情链接:https://updates.midjourney.com/edit-model-for-v8/

4、蚂蚁集团 × 中金公司推出金融增强大模型

蚂蚁集团与中金公司合作推出 Ling-3.0-flash-Fin,这是首个金融增强大模型。

该模型通过专业金融语料训练,显著提升了投研核心能力,在信息检索等四大核心能力上表现突出。双方还推出了 FinFIRST 金融搜索基准并计划开源,提供免费 API 调用和模型权重开源。

5、阿里 Qoder 升级:从编程工具到智能体工作台

阿里发布了全新 Qoder,从 AI 编程工具升级为面向所有人的智能体工作台。

新版本将工作对象从”代码工程”转向”智能体任务”,支持”读—改—验证—迭代”的自主闭环,具备跨文件编辑等能力。产品提供编程模式与通用模式双入口,让非技术用户也能参与开发。

6、谷歌搜索 AI 模式升级:机票酒店一站式搞定

谷歌对其对话式搜索体验”AI 模式”进行了重大升级,新增:

  • 整合 300 多家航空公司及旅行网站的即时价格与推荐
  • 基于用户偏好推荐附带评价的酒店房源,无缝跳转支付
  • 支持自然语言查询航空里程或酒店积分兑换额度

谷歌正加速将 AI 模式打造为全流程 AI 旅行代理

7、小鹏第二代 VLA 大模型重大升级

小鹏第二代 VLA 大模型迎来首次重大升级,核心在于让 AI 真正理解时间,实现从静态 3D 空间到动态 4D 时空的跃迁。

升级亮点:

  • 引入 Infini-VLA 长时序架构,提升时间理解能力
  • 推理效率提升,实现”边看、边想、边行动”的并行处理
  • 首次推出 Master Agent,实现 VLA 与 VLM 的驾舱融合
  • 将 Robotaxi 的 L4 级体验下放至量产车型

综合安全能力暴增 20 倍

8、Anthropic 推出 MHS 硬件标准,杀入物理 AI 赛道

Anthropic 发布了模型硬件标准(MHS),首次公开进军具身智能与物理 AI 领域。

MHS 是一套统一的控制与通信标准,使 AI 智能体能够操控多种设备。在生物医药领域,MHS 显著缩短了实验开发与运行周期;在量子计算和先进制造等领域也展现出强大的提速能力。

这标志着大模型竞争从对话延伸到动手操作领域。

新鲜 AI 产品点击了解:https://app.aibase.com/zh

本文地址:https://www.163264.com/15308

(0)
上一篇 14小时前
StableDiffusion最强大的插件ContorlNet今天更新了1.1版本
下一篇 2023年4月14日 下午7:38

相关推荐