核心看点
- OpenAI联合创始人安德烈·卡帕西提出新AI基准测试:用文学文本构建3D世界
- Claude Opus 5在100万Tokens、约10美元成本下,2小时输出5500行代码
- 生成作品以3D动画形式呈现《指环王》开场场景
- 标志着AI在代码生成、场景设计与多媒体制作方面的综合表现达到新高度
详细解析
8月2日,OpenAI联合创始人安德烈·卡帕西(Andrej Karpathy)在X平台发布推文,提出了一项创新的AI基准测试思路:向模型提供《指环王》开篇首段文字,要求模型创建对应的3D世界。
这一测试思路的提出背景是,此前业内习惯使用生成”鹈鹕骑车图”的SVG图片方式来评估大语言模型在空间推理、几何逻辑和复杂代码生成方面的能力。但随着模型能力的不断提升,这类简单任务已不在话下,需要更具挑战性的测试标准。
卡帕西要求Claude Opus 5使用three.js创建3D世界,输入内容为《指环王》的首段文字。测试的最高资源额度为100万Tokens,成本约为10美元。在这一配置下,Claude Opus 5耗时约2小时,输出约5500行代码。
生成作品以3D动画形式呈现《指环王》开场相关场景,包括人们参加比尔博告别宴会,以及充满财宝的洞穴。虽然该作品无法与人工耗费数小时制作的内容相比,但考虑到AI在约2小时内完成生成,其完成度仍较高。
总结
卡帕西提出的这一新基准测试,不仅展示了Claude Opus 5在复杂代码生成和3D场景构建方面的能力,也为AI能力评估提供了新思路。从生成SVG图片到构建可交互的3D场景,AI基准测试正在向更复杂、更综合的方向发展。
本文地址:https://www.163264.com/14673


微信扫一扫,鼓励一下~