AI 自己改代码,评测却太贵:MIT 和 Sakana 用“LLM 当裁判”把成本砍下来
让 AI 自己写代码、自己改进,是“自进化”最诱人的想象。但每一次改进都要重新评测,而评测本身极其昂贵——跑一次基准测试可能烧掉大量算力。MIT 与 Sakana AI 的新框架想了个聪明的办法:让一个语言模型来当裁判…
主题标签
让 AI 自己写代码、自己改进,是“自进化”最诱人的想象。但每一次改进都要重新评测,而评测本身极其昂贵——跑一次基准测试可能烧掉大量算力。MIT 与 Sakana AI 的新框架想了个聪明的办法:让一个语言模型来当裁判…