MirroS 发布 AgentGarten:让智能体在可执行的世界里“边玩边进化”
推开一块挡板,通道就此封闭;搬来一段坡道,高墙便有了越过的可能。每一次行动都会改变世界,而改变后…
文章目录
推开一块挡板,通道就此封闭;搬来一段坡道,高墙便有了越过的可能。每一次行动都会改变世界,而改变后的世界,又成为智能体下一次决策的起点。当这样的世界既能由代码构建、又能由扩散模型实时绘出,AI 就拥有了一座可以反复探索的“试炼场”。
这正是 MirroS 团队最新发布的 AgentGarten 所做的事。它将可执行的代码环境与实时神经渲染器连接起来:代码定义物理规则,模型生成视觉反馈,以超过 30fps 的吞吐,让智能体持续与世界交互。
一分钟速览
- MirroS 发布 AgentGarten,把“可执行代码环境 + 实时神经渲染”接成闭环。
- 物理交给代码、光影交给神经模型,兼顾确定性与画面真实感。
- 经典捉迷藏实验中,躲藏者第 4 轮学会搭掩体,搜寻者第 10 轮学会翻墙。
- 智能体在每轮结束后写下“实验手册”,把经验带进下一轮。
为什么智能体需要一个“能反复练手的世界”
想让 AI 真正理解物理世界,只靠海量视频远远不够。就像学游泳不能只看录像,智能体必须亲自下场:采取行动、观察结果、再决定下一步。这就需要一种具备物理因果确定性的环境——推开的箱子必须留在原地,封堵的通道必须不能通行。
当前两条主流路径各有短板:传统游戏与代码引擎状态精准、规则透明,但画面往往只有粗糙几何白模,要覆盖成百上千开放场景,美术与工程投入是天文数字;而视频生成式的世界模型画质惊艳,物理信息却隐式藏在网络记忆中,无法查询、难以干预,想让机械臂拧紧一颗螺丝都寸步难行。
代码推进世界,模型负责“看起来怎样”
AgentGarten 的解法是让两者各司其职。一次标准交互闭环中:智能体给出动作指令;代码环境立即计算碰撞与状态更新,并从第一人称视角导出一份轻量“几何草图”(空间深度或表面法线);神经渲染器再读取草图与历史,实时合成画面。如此,物理的严谨与视觉的逼真被拆开,各自做到极致。
趋势洞察
当智能体拥有一个可以行动、试错并积累经验的世界,“智能如何在其中持续进化”就不再是哲学问题,而是工程问题。可执行环境、实时渲染与经验沉淀的闭环,很可能成为下一代智能体训练基础设施的标配。
本文地址:https://www.163264.com/16565